EN
en direct
tag

#deepseek

DeepSeek V4.1 Flash divise par quatre la mémoire KV et pousse V4 Pro vers la retraite

Le 10 septembre 2026, DeepSeek publie V4.1 Flash, un modèle multimodal open source qui réduit de quatre fois la mémoire du cache KV et fait baisser les prix de l’API de 11 à 57 % ; les requêtes V4 Pro seront basculées vers Flash dès le 14 septembre. Re-benchmarkez vos charges avant cette date.

En août 2026, trois labos font du prix d’un LLM une grille qui bouge

En deux semaines d’août 2026, DeepSeek instaure une facturation heures pleines/heures creuses, Google annonce un tarif de lancement qui double en janvier 2027 et Anthropic annule une hausse prévue. Pour qui budgète une charge d’inférence, le prix au million de tokens n’est plus un nombre fixe mais une équation à trois variables.

Tapez au moins deux caractères.

↑ ↓ naviguer ↵ ouvrir esc fermer