Matériel
Cartes graphiques, Apple Silicon, mini-pc d'IA locale : ce qui tourne, quelle mémoire il faut pour quelle taille de modèle, et ce que ça coûte.
Les constructeurs suivis
- NVIDIA Cartes graphiques et accelerateurs 7 références relevées
- AMD Cartes graphiques et processeurs 4 références relevées
- Apple Ordinateurs à mémoire unifiée 6 références relevées
- Minisforum Mini-pc et serveurs compacts 6 références relevées
- HP Stations de travail compactes 3 références relevées
- Intel Cartes graphiques et processeurs 2 références relevées
- Qualcomm Processeurs pour portables 3 références relevées
- Tenstorrent Accélérateurs ouverts 4 références relevées
- Framework Ordinateurs modulaires 3 références relevées
- Raspberry Pi Cartes et modules d'extension 4 références relevées
Aucune pièce publiée dans cette rubrique pour l'instant. Les constructeurs ci-dessus en tiennent déjà le périmètre.
En attendant, dans les autres rubriques
papier 09:52 · il y a 2 h GLM-5.3 franchit le seuil de l'exploit construit seul
Anthropic a testé GLM-5.3, le modèle ouvert de Zhipu AI, sur ses propres bancs d'exploitation : il trouve des vulnérabilités inédites et les enchaîne en attaques qui fonctionnent, au niveau où seuls les modèles les mieux gardés se tenaient il y a cinq mois. Débrider le modèle demande une opération de quelques milliers de dollars.
outil 19:00 · il y a 17 h Les modèles de décision entrent dans Ollama
Ollama 0.35.0 ouvre une route pour les modèles de décision, bâtie sur l'API Jev de TypeSafe : ils ne rédigent pas de texte, ils rendent des choix, avec leur probabilité et leur score, que le logiciel consomme directement.
benchmark 11:30 · hier Combien de tokens brûle vraiment un agent
Le même agent, la même tâche, et une facture qui varie d'un facteur dix. Le papier TokenCast attaque le sujet par la mesure plutôt que par l'estimation à vue.