Tech • IA • Robotique • Jeu

VIDÉO
ENFR

Claude Haiku 5.5 écrase les prix, Mistral Large 4 riposte

IAvendredi 9 octobre 2026· 24 vidéos

Briefing

Lecteur audio
0:00 / 0:00

Claude Haiku 5.5 casse les prix

Anthropic lance Claude Haiku 5.5 comme son petit modèle le plus rapide et le plus performant, avec un coût moyen annoncé en baisse d'environ 75 % face à Haiku 4.5. Le tarif descend à 0,10 $ par million de tokens en entrée et 0,50 $ en sortie pour les prompts sous 100 000 tokens. Le modèle vise le support client, la classification, le résumé, l'automatisation navigateur et les sous-agents de code. Les benchmarks affichent un bond rare pour une gamme compacte, notamment de 15,7 % à 72,4 % sur OSWorld.

Mistral Large 4 vise l'Europe

Mistral Large 4 entre sur le segment des très grands modèles avec une architecture Mixture of Experts de 1 trillion de paramètres, dont environ 49 milliards actifs. Le groupe mise moins sur une confrontation frontale avec OpenAI ou Anthropic que sur une offre européenne, contrôlable juridiquement et adaptée aux secteurs réglementés. Le modèle est présenté comme fort en code, cybersécurité et workflows d'agents, déjà cité chez HSBC, Ericsson, Cisco, BMW ou AXA. Sa faiblesse reste l'autonomie opérationnelle sur terminal et la dépendance à des connecteurs, des permissions et une préparation de données rigoureuse.

OpenAI rallume la guerre des maths

OpenAI affirme avoir résolu 300 puis 372 problèmes ouverts de mathématiques, ce qui a immédiatement provoqué une contestation académique. Le cas Navier-Stokes concentre les critiques, car une avancée crédible sur ce problème millénaire bouleverserait l'équilibre entre laboratoires industriels et recherche publique. Dans une lettre du 11 septembre 2026, Terence Tao juge néfaste l'usage de problèmes difficiles comme simples benchmarks d'entreprise. Au-delà de la performance brute, le débat porte sur la vérifiabilité, l'attribution scientifique et la capacité de la communauté à transformer une preuve machine en compréhension partagée.

GPT-6 devient plus visuel

OpenAI étend GPT-6 à plusieurs niveaux d'abonnement, avec GPT-6 Sol pour les offres payantes standard et GPT-6 Luna pour les comptes gratuits. La vraie rupture ergonomique vient de Intelligent UI, qui permet à ChatGPT de générer automatiquement graphiques, mini-apps, diagrammes et autres éléments interactifs dans ses réponses. Cette logique déplace l'interface du texte vers des sorties directement exploitables sans demander explicitement un rendu visuel. Les offres premium conservent des variantes plus puissantes comme Astra, signe d'une segmentation produit assumée.

Gemini 4 Argon reste en attente

Google n'a finalement pas lancé Gemini 4 Argon lors de Gemini at Work 2026, malgré des fuites décrivant un modèle de raisonnement dédié. Les éléments divulgués évoquaient des contextes 512K et 900K, des multiplicateurs de quota de 1,3x et 1,8x, ainsi qu'une API à 4 $ par million de tokens d'entrée et 20 $ en sortie. Sundar Pichai a néanmoins présenté Argon comme capable de traiter de grands volumes d'information non structurée et des workflows d'entreprise complets. Le retard semble lié autant au profil de risque cybersécurité qu'à la préparation commerciale.

La crypto redoute un choc IA

Les progrès des mathématiques assistées par IA ravivent la crainte d'une fragilisation plus rapide que prévu de la cryptographie à clé publique. Le cryptographe Matthew Green de Johns Hopkins résume l'enjeu sans détour: la possibilité de "perdre" cette base de sécurité. Pour Bitcoin, Ethereum et l'économie numérique, le risque dépasse la simple faille logicielle et toucherait la propriété même des actifs. Vitalik Buterin pousse déjà le secteur à préparer une migration vers des schémas résistants à l'IA et, à terme, post-quantiques.

Anthropic pousse Claude vers l'entreprise

Anthropic multiplie les signaux d'une stratégie centrée sur les usages professionnels à grande échelle. D'un côté, Claude Motion convertit rapports et tableaux en animations exportables en MP4 en générant du code plutôt que de la vidéo brute, avec un accès limité aux offres Team et Enterprise. De l'autre, l'éditeur détaille une discipline d'usage pour Claude: raccourcir les fils, utiliser Projects pour le cache documentaire et surveiller les limites de session et hebdomadaires. L'objectif est clair: rendre l'outil plus prévisible, économe et mieux intégré aux workflows métier.

Robots hybrides et open models montent

À Shenzhen, Arc Shell Robotics dévoile le MX01, prototype humanoïde transformable capable de marcher debout, de passer en mode quadrupède et d'utiliser un module aérien d'amarrage. En parallèle, la bataille des modèles ouverts s'intensifie: Reflection lance Beam, un MoE de 501 milliards de paramètres entraîné sur 23,8 billions de tokens, alors que les modèles ouverts représentaient déjà 56 % du trafic IA sur AI Gateway de Vercel en août. La dynamique confirme un déplacement de la valeur vers l'infrastructure, les poids ouverts et l'exécution spécialisée. Elle souligne aussi la pression concurrentielle exercée par DeepSeek, Qwen, Kimi et GLM sur les acteurs américains et européens.

Vidéos couvertes

Briefings précédents · IA