Herramientas y Reviews 5 min lectura
LFM2.5-DSpark: hasta 3.2x más rápida la inferencia y menos latencia en agentes
Hugging Face lanza checkpoints DSpark para tres modelos de la familia LFM2.5, introduciendo un camino especulativo que acelera la decodificación sin afectar la calidad. Los modelos muestran mejoras de hasta 3.18x en GPU y hasta 2.87x en dispositivos locales.