TeleOCR : un OCR de 1,4 milliard de paramètres pour les documents denses
Un modèle de lecture de documents bâti sur Qwen2.5-VL, en Apache 2.0, qui déclare le chinois et l'anglais.
par gyom 29 septembre 2026 à 08:15 rubrique : IA locale
La fiche du modèle indique 1 415 072 768 paramètrespoids du modèleNombre de valeurs apprises par un modèle. À quantification égale, plus de paramètres veut dire plus de mémoire occupée, et en général de meilleures réponses.Fiche du lexique en BF16, soit environ 2,8 Go de poids à télécharger. L'architecture déclarée est qwen2_5_vl, la tâche image vers texte, avec les usages visés ocr et document-parsing.
Le dépôt a été créé le 14 août 2026 et mis à jour le 29 septembre. Il totalise 27 904 téléchargements sur trente jours et 828 mentions j'aime, ce qui le place dans le haut des modèles en tendance du moment sur la plateforme.
La fiche porte une référence arXiv, 2608.12898, donc un papier accompagne le modèle. La licence est Apache 2.0, sans restriction d'usage commercial annoncée sur la fiche.
Source primaire Fiche du modèle TeleOCR, Hugging Face