IAGentic

Journal de veille sur l'IA locale et les agents : sorties de modèles, papiers, outils, mesures.

outil

Les modèles de décision entrent dans Ollama

Ollama 0.35.0 ouvre une route pour les modèles de décision, bâtie sur l'API Jev de TypeSafe : ils ne rédigent pas de texte, ils rendent des choix, avec leur probabilité et leur score, que le logiciel consomme directement.

par gyom 29 septembre 2026 à 19:00 rubrique : IA locale · IA Agentique

Un grand cadran à secteurs colorés et son aiguille, relié par un câble en spirale à un petit terminal à l'écran vide.

Sortir du texte d'un modèle, c'est déjà la moitié du travail : il faut ensuite lire la réponse, la valider, et décider quoi en faire. Un modèle de décision supprime cette étape. Il ne rend pas une phrase, il rend un choix pris parmi une liste déclarée, avec la probabilité qui va avec.

Des choix typés à la place d’une phrase à lire

Ollama 0.35.0 expose ces modèles sur une route dédiée, /v1/systemone, construite sur l'API Jev de TypeSafe. Deux modèles sont proposés au départ, Nimble de Bespoke Labs et Tev1 de Together AI, avec trois usages annoncés : le tri de tickets, le routage de modèles et la classification de contenu. Le service démarre à côté de l'instance locale, sur la même API.

TypeSafe, qui publie Jev, résume la différence en une phrase : un état non structuré entre, des décisions probabilistes typées sortent. L'éditeur en tire un argument, le modèle ne peut pas inventer, puisqu'il ne produit pas de texte libre. Pour une chaîne d'agents, l'intérêt est ailleurs : la décision est lisible par le programme sans analyse de réponse, donc sans cas particulier à écrire.

Deux ordres de grandeur revendiqués

Un modèle qui ne rédige rien

Un modèle de décision ne rédige rien. Il ne remplace pas un modèle de langage, il le précède : la décision d'abord, la rédaction ensuite, si elle est utile. La contrepartie tient à la liste des choix déclarés, qui devient un morceau du système à maintenir, à côté du modèle.

Reste la mesure. Les chiffres avancés viennent de l'éditeur et du banc qui l'accompagne, aucun essai indépendant n'est publié à ce jour. Sur une machine locale, le test tient en une soirée : prendre une tâche de tri ou de routage, comparer le coût et la latence d'un appel de décision avec l'appel de texte équivalent, et regarder ce que donnent les probabilités quand l'entrée sort du cadre prévu.

Repères : outil · ollama 0.35.0 · API Jev, TypeSafe · 2 modèles au départ

Source primaire ollama v0.35.0, notes de version

Retour au journal