SevenTnewS

OCR

4 published articles

IAFeatured3 min read

Analyse

Le modèle 0.8B qui a tout remis en question dans l'analyse de documents

OvisOCR2, un analyseur de documents à 0,8 milliard de paramètres de Tencent, a atteint 96,58 sur OmniDocBench, devenant le premier modèle de bout en bout à dominer le classement. Le modèle utilise l'apprentissage par renforcement et la distillation pour surpasser des systèmes en pipeline plus volumineux, remettant en question les hypothèses sur la nécessité des architectures multi-étapes.

2026-07-26

LLM & ModèlesFeatured3 min read

IA documentaire

Le Mistral OCR 4 obtient de bons scores, mais son propre audit montre pourquoi les chiffres des benchmarks ne racontent pas toute l'histoire

Mistral OCR 4 introduit des boîtes englobantes, une classification par blocs et des scores de confiance en complément de l'extraction de texte, prenant en charge 170 langues. Il atteint un taux de préférence humaine de 72 % et des scores de référence élevés, mais l'analyse de Mistral montre que les benchmarks standards pénalisent les résultats corrects pour des artefacts de formatage, et non pour des erreurs de précision.

2026-07-16

IA4 min read

Spécialisation par domaine

Pourquoi un modèle OCR vieux de six mois surpasse toujours ses rivaux plus récents en portugais brésilien

DharmaOCR obtient un score de 0,925 sur un benchmark portugais contre 0,798 pour Mistral OCR4 et 0,7587 pour Unlimited-OCR. L'écart provient d'une allocation d'entraînement concentrée et d'une approche DPO qui supprime la dégradation du texte dans les documents complexes.

2026-07-16

DeepSeek2 min read

Intelligence Artificielle

DeepSeek-OCR 2 : Le Flux Causal Visuel s'ouvre à la compréhension open-source des documents

DeepSeek-OCR 2 introduit le flux causal visuel pour un encodage visuel de type humain. Désormais open source sur GitHub, le modèle prend en charge vLLM et Transformers, une résolution dynamique (jusqu'à 1 216 tokens visuels) et la conversion document-vers-markdown.

2026-07-09