Liquid AI accélère l’inférence de ses modèles jusqu’à 3,2× sans changer un seul token produit
Le 20 août 2026, Liquid AI publie des modèles draft DSpark pour sa famille LFM2.5, avec un gain de débit allant jusqu’à 3,18× sur GPU et 2,87× sur appareil, sans altérer la sortie. Les équipes qui servent du LLM en production ont une raison concrète de réévaluer leur coût par token.