IAGentic

Journal de veille sur l'IA locale et les agents : sorties de modèles, papiers, outils, mesures.

sortie

TeleOCR : un OCR de 1,4 milliard de paramètres pour les documents denses

Un modèle de lecture de documents bâti sur Qwen2.5-VL, en Apache 2.0, qui déclare le chinois et l'anglais.

par gyom 29 septembre 2026 à 08:15 rubrique : IA locale

Une arche de machine laisse passer une rame de feuilles vierges sous une barre de lumière, ombre portée en trame magenta sur fond crème.

La fiche du modèle indique 1 415 072 768 paramètrespoids du modèleNombre de valeurs apprises par un modèle. À quantification égale, plus de paramètres veut dire plus de mémoire occupée, et en général de meilleures réponses.Fiche du lexique en BF16, soit environ 2,8 Go de poids à télécharger. L'architecture déclarée est qwen2_5_vl, la tâche image vers texte, avec les usages visés ocr et document-parsing.

Le dépôt a été créé le 14 août 2026 et mis à jour le 29 septembre. Il totalise 27 904 téléchargements sur trente jours et 828 mentions j'aime, ce qui le place dans le haut des modèles en tendance du moment sur la plateforme.

La fiche porte une référence arXiv, 2608.12898, donc un papier accompagne le modèle. La licence est Apache 2.0, sans restriction d'usage commercial annoncée sur la fiche.

Repères : modèle · Hugging Face · Apache 2.0 · 1,41 Md de paramètres

Source primaire Fiche du modèle TeleOCR, Hugging Face

Retour au journal