SevenTnewS

DeepSeek

DeepSeek-V3, DeepSeek-R1, Coder et la percée chinoise dans les LLM open source.

7 published articles

4 min read

Agents IA · Open Source

DeepSeek lance un harness d'agents où même le modèle est un plugin

DeepSeek a publié DeepSeek Harness, un runtime d'agents open source où modèles, outils, sandboxes et UI sont tous des plugins Cordis. Des journaux de session en écriture seule et un mode minimal à deux outils révèlent une ambition plus discrète : des exécutions d'agents auditées et reproductibles.

2026-08-16

2 min read

Intelligence Artificielle

DeepSeek-OCR 2 : Le Flux Causal Visuel s'ouvre à la compréhension open-source des documents

DeepSeek-OCR 2 introduit le flux causal visuel pour un encodage visuel de type humain. Désormais open source sur GitHub, le modèle prend en charge vLLM et Transformers, une résolution dynamique (jusqu'à 1 216 tokens visuels) et la conversion document-vers-markdown.

2026-07-09

Featured2 min read

Économie des API

DeepSeek V4 arrive en juillet avec un changement de tarification qui fera mal si vous codez quand le soleil est levé

DeepSeek V4 arrive à la mi-juillet avec une tarification en fonction des pics de charge. Le coût de l'API double pendant les heures de bureau, jusqu'à 1,74 $ par million de tokens de sortie, mais les tarifs hors pointe peuvent être une affaire pour les charges de travail avec hits de cache.

2026-07-09

5 min read

Sortie de modèle

DeepSeek-V4 en avant-première : le calcul en open-weight se corse pour tout le monde

DeepSeek dévoile l'avant-première de DeepSeek-V4 avec un raisonnement de premier ordre et des capacités agentiques renforcées, désormais disponible sur toutes les plateformes. Cette sortie marque une escalade majeure dans la course à l'IA open-weight, mettant la pression sur OpenAI et Google pour justifier leurs stratégies closed-source.

2026-07-05

2 min read

Optimisation de l'inférence LLM

Aleph Alpha construit un modèle d'inférence théorique pour décoder les performances de DeepSeek V3 à partir de primitives matérielles

Le modèle théorique d'Aleph Alpha prédit les performances d'inférence de DeepSeek V3 à partir des seuls paramètres matériels, révélant comment le nombre de GPU et la bande passante d'interconnexion déplacent le goulot d'étranglement entre le calcul, la mémoire et la communication.

2026-07-04

3 min read

Intelligence artificielle

Le nouveau modèle de DeepSeek place l'efficacité au cœur de la course à l'IA

DeepSeek a publié un nouveau LLM qui renforce sa compétition avec les grands laboratoires d'IA en misant sur l'efficacité plutôt que sur la force brute. Le modèle vise à offrir des performances solides avec une utilisation optimisée des ressources, reflétant un virage plus large du secteur vers une IA économique.

2026-06-30

4 min read

Recherche en IA open source

Contexte d'un million de tokens avec un dixième du cache KV : le pari d'efficacité de DeepSeek-V4

L'aperçu V4 de DeepSeek associe un modèle Pro de 1,6T de paramètres à une variante Flash de 284B, tous deux avec un contexte d'un million de tokens. Le document revendique 27 % des FLOPs d'inférence et 10 % du cache KV de V3.2, soit les chiffres qui rendent ce contexte rentable à servir.

2026-06-22