Tout le journal · 6 pièces
30 septembre 2026
29 septembre 2026
outil 19:00 · il y a 17 h Les modèles de décision entrent dans Ollama
Ollama 0.35.0 ouvre une route pour les modèles de décision, bâtie sur l'API Jev de TypeSafe : ils ne rédigent pas de texte, ils rendent des choix, avec leur probabilité et leur score, que le logiciel consomme directement.
benchmark 11:30 · hier Combien de tokens brûle vraiment un agent
Le même agent, la même tâche, et une facture qui varie d'un facteur dix. Le papier TokenCast attaque le sujet par la mesure plutôt que par l'estimation à vue.
papier 10:05 · hier TokenCast : prévoir la facture de tokens d'un agent pendant qu'il tourne
Sur la même tâche, deux exécutions d'un agent peuvent consommer dix fois plus de tokens l'une que l'autre. Un papier propose de chiffrer la dépense en cours de route, sans appeler le modèle une fois de plus.
sortie 08:15 · hier TeleOCR : un OCR de 1,4 milliard de paramètres pour les documents denses
Un modèle de lecture de documents bâti sur Qwen2.5-VL, en Apache 2.0, qui déclare le chinois et l'anglais.
release 07:40 · hier llama.cpp b11247 : Vulkan réutilise ses descriptor sets
Le backend Vulkan arrête de reconstruire ses descripteurs quand les bindings ne changent pas entre deux appels.