OCR
4 published articles
Analyse
Le modèle 0.8B qui a tout remis en question dans l'analyse de documents
OvisOCR2, un analyseur de documents à 0,8 milliard de paramètres de Tencent, a atteint 96,58 sur OmniDocBench, devenant le premier modèle de bout en bout à dominer le classement. Le modèle utilise l'apprentissage par renforcement et la distillation pour surpasser des systèmes en pipeline plus volumineux, remettant en question les hypothèses sur la nécessité des architectures multi-étapes.
2026-07-26
IA documentaire
Le Mistral OCR 4 obtient de bons scores, mais son propre audit montre pourquoi les chiffres des benchmarks ne racontent pas toute l'histoire
Mistral OCR 4 introduit des boîtes englobantes, une classification par blocs et des scores de confiance en complément de l'extraction de texte, prenant en charge 170 langues. Il atteint un taux de préférence humaine de 72 % et des scores de référence élevés, mais l'analyse de Mistral montre que les benchmarks standards pénalisent les résultats corrects pour des artefacts de formatage, et non pour des erreurs de précision.
2026-07-16
Spécialisation par domaine
Pourquoi un modèle OCR vieux de six mois surpasse toujours ses rivaux plus récents en portugais brésilien
DharmaOCR obtient un score de 0,925 sur un benchmark portugais contre 0,798 pour Mistral OCR4 et 0,7587 pour Unlimited-OCR. L'écart provient d'une allocation d'entraînement concentrée et d'une approche DPO qui supprime la dégradation du texte dans les documents complexes.
2026-07-16
Intelligence Artificielle
DeepSeek-OCR 2 : Le Flux Causal Visuel s'ouvre à la compréhension open-source des documents
DeepSeek-OCR 2 introduit le flux causal visuel pour un encodage visuel de type humain. Désormais open source sur GitHub, le modèle prend en charge vLLM et Transformers, une résolution dynamique (jusqu'à 1 216 tokens visuels) et la conversion document-vers-markdown.
2026-07-09