NSIG_

Hugging Face

LiquidAI veröffentlicht DSpark-Entwurfsmodelle für bis zu 3,2-fach schnellere Inferenz

Vom Abgerufen Themen Lokal betreiben

Die DSpark-Checkpoints ergänzen drei Modelle der LFM2.5-Familie um einen spekulativen Dekodierungspfad. Auf der GPU steigt der Durchsatz um das bis zu 3,18-Fache, auf einem M4 Max MacBook Pro um das 2,87-Fache. Unterstützung für llama.cpp und SGLang ist ab sofort verfügbar.

Bei huggingface.co lesen →

← Alle Meldungen