Hugging Face
LiquidAI veröffentlicht DSpark-Entwurfsmodelle für bis zu 3,2-fach schnellere Inferenz
Vom Abgerufen Themen Lokal betreiben
Die DSpark-Checkpoints ergänzen drei Modelle der LFM2.5-Familie um einen spekulativen Dekodierungspfad. Auf der GPU steigt der Durchsatz um das bis zu 3,18-Fache, auf einem M4 Max MacBook Pro um das 2,87-Fache. Unterstützung für llama.cpp und SGLang ist ab sofort verfügbar.