DeepSeek4 min read
Recherche en IA open source
Contexte d'un million de tokens avec un dixième du cache KV : le pari d'efficacité de DeepSeek-V4
L'aperçu V4 de DeepSeek associe un modèle Pro de 1,6T de paramètres à une variante Flash de 284B, tous deux avec un contexte d'un million de tokens. Le document revendique 27 % des FLOPs d'inférence et 10 % du cache KV de V3.2, soit les chiffres qui rendent ce contexte rentable à servir.
2026-06-22