Les modèles de décision entrent dans Ollama
Ollama 0.35.0 ouvre une route pour les modèles de décision, bâtie sur l'API Jev de TypeSafe : ils ne rédigent pas de texte, ils rendent des choix, avec leur probabilité et leur score, que le logiciel consomme directement.
par gyom 29 septembre 2026 à 19:00 rubrique : IA locale · IA Agentique
Sortir du texte d'un modèle, c'est déjà la moitié du travail : il faut ensuite lire la réponse, la valider, et décider quoi en faire. Un modèle de décision supprime cette étape. Il ne rend pas une phrase, il rend un choix pris parmi une liste déclarée, avec la probabilité qui va avec.
Des choix typés à la place d’une phrase à lire
Ollama 0.35.0 expose ces modèles sur une route dédiée, /v1/systemone, construite sur l'API Jev de TypeSafe. Deux modèles sont proposés au départ, Nimble de Bespoke Labs et Tev1 de Together AI, avec trois usages annoncés : le tri de tickets, le routage de modèles et la classification de contenu. Le service démarre à côté de l'instance locale, sur la même API.
TypeSafe, qui publie Jev, résume la différence en une phrase : un état non structuré entre, des décisions probabilistes typées sortent. L'éditeur en tire un argument, le modèle ne peut pas inventer, puisqu'il ne produit pas de texte libre. Pour une chaîne d'agents, l'intérêt est ailleurs : la décision est lisible par le programme sans analyse de réponse, donc sans cas particulier à écrire.
Deux ordres de grandeur revendiqués
- Jev est annoncé en accès anticipé le 15 septembre 2026, avec une méthode d'entraînement maison, l'apprentissage par renforcement pour décisions calibrées.
- L'éditeur annonce une intelligence comparable aux grands modèles sur ses tâches, pour un coût et un temps réduits de deux ordres de grandeur.
- Ollama 0.35.0 publie la route le 29 septembre 2026, et 0.35.1 le même jour.
Un modèle qui ne rédige rien
Un modèle de décision ne rédige rien. Il ne remplace pas un modèle de langage, il le précède : la décision d'abord, la rédaction ensuite, si elle est utile. La contrepartie tient à la liste des choix déclarés, qui devient un morceau du système à maintenir, à côté du modèle.
Reste la mesure. Les chiffres avancés viennent de l'éditeur et du banc qui l'accompagne, aucun essai indépendant n'est publié à ce jour. Sur une machine locale, le test tient en une soirée : prendre une tâche de tri ou de routage, comparer le coût et la latence d'un appel de décision avec l'appel de texte équivalent, et regarder ce que donnent les probabilités quand l'entrée sort du cadre prévu.
Source primaire ollama v0.35.0, notes de version