Tech • IA • Robotique • Jeu

VIDÉO
ENFR

OpenAI publie 722 papiers maths, Mistral Large 4 et Claude Haiku 5.5

IAjeudi 8 octobre 2026· 32 vidéos

Briefing

Lecteur audio
0:00 / 0:00

OpenAI lâche 722 papiers maths

OpenAI a publié le 6 octobre un corpus de 722 manuscrits couvrant 372 familles de résultats, issus d’un modèle frontier testé sur environ 4 000 problèmes de recherche. L’entreprise affirme avoir retenu seulement les sorties jugées significatives, avec des domaines allant de la fonction zêta de Riemann à la conjecture de Hodge, en passant par les verres de spin et les algèbres d’opérateurs. Pour 235 familles, des preuves en Lean permettent une vérification formelle partielle, fait rare pour des travaux IA de cette ampleur. Les résultats restent provisoires, mais la consultation de l’Institute for Advanced Study et d’experts externes montre qu’OpenAI traite l’enjeu comme potentiellement majeur.

Mistral Large 4 vise l'entreprise

Mistral a dévoilé Mistral Large 4, son premier grand modèle frontier depuis près d’un an, avec une architecture Mixture of Experts totalisant 1 trillion de paramètres pour 49 milliards actifs par requête. Le système prend en charge le texte et les images, sort en texte, et embarque un contexte de 1 million de tokens pour le raisonnement, le code et les charges lourdes. Le positionnement est clairement celui des secteurs réglementés européens, avec un discours centré sur la souveraineté, le contrôle d’infrastructure et les déploiements on-premises ou juridiquement maîtrisés. Sans revendiquer la tête absolue face aux leaders américains fermés, Mistral cherche à devenir l’option de référence hors Chine dans la catégorie des modèles ouverts haut de gamme.

Claude Haiku 5.5 casse les prix

Anthropic a lancé Claude Haiku 5.5 comme son modèle compact le plus rapide et le moins coûteux, avec un prix de 0,10 $ par million de tokens d’entrée et 0,50 $ en sortie sous 100 000 tokens. Cela représente environ 90 % de baisse versus Haiku 4.5, pour un coût d’exploitation moyen annoncé 75 % plus bas. L’entreprise met en avant de forts gains sur OSWorld (15,7 % à 72,4 %) et sur Humanity’s Last Exam (10,2 % à 45,9 % sans outils). Anthropic cible explicitement les tâches de volume: support, classification, automatisation navigateur, sous-agents de code et bureautique.

Anthropic prépare une IPO sous tension

Un document d’introduction en Bourse attribué à Anthropic relance le débat sur l’économie réelle de l’IA de pointe. Le chiffre qui frappe est une perte de 42 milliards de dollars, dont environ 34 milliards liés à des instruments convertibles accordés à Google et Amazon, donc largement non cash. Cette mécanique comptable n’efface pas la pression infrastructurelle, mais elle nuance l’idée d’un gouffre opérationnel pur. L’opération, attendue avant Thanksgiving avec une cotation au Nasdaq, pourrait devenir la première radioscopie financière complète d’un grand laboratoire de modèles.

ChatGPT ajoute Spaces et Pages

OpenAI déploie Spaces et Pages dans ChatGPT pour transformer l’assistant en espace de travail collaboratif plutôt qu’en simple fil de conversation. Spaces centralise documents, images, sites générés et fichiers connectés depuis Google Drive, tandis que Pages apporte un éditeur live pour rédiger, restructurer et réviser des contenus longs. L’édition peut se faire passage par passage via Ask for change ou par insertion ciblée avec Generate, ce qui rapproche ChatGPT d’un outil de productivité documentaire complet. Le lancement commence chez les offres Pro et Business, avec un élargissement attendu.

Codex passe au cloud persistant

OpenAI a présenté Codex Cloud pour exécuter des agents de programmation persistants dans des environnements gérés, sur le web, le desktop, le terminal et désormais dans Slack et Microsoft Teams. Le but est de sortir du schéma du prompt ponctuel sur laptop pour aller vers des tâches qui tournent des heures ou des jours, avec configuration automatique des dépôts et dépendances. En parallèle, Codex est mis en avant sur la réponse aux incidents: corrélation de signaux Grafana, historique de déploiement, code modifié, puis proposition de correctif. Dans la démo, une panne de checkout à 20 % d’erreurs sur v2 est revenue à zéro sans rollback, après validation humaine d’un patch ciblé.

Grockbot devient un routeur d'agents

Grockbot s’oriente vers une logique multi-modèles où l’interface reste unique mais les tâches sont envoyées au meilleur backend disponible. Les noms cités incluent Claude Opus 5.5, MidJourney et Suno, signe qu’un agent pourrait bientôt masquer complètement le choix du modèle à l’utilisateur. Ce déplacement réduit la faiblesse perçue de Grok sur le code et le raisonnement complexe, tout en renforçant la bataille sur la couche d’orchestration plutôt que sur le seul modèle maison. Le message de fond est stratégique: la valeur migre vers le routage, la mémoire de contexte et l’exécution d’outils.

Poids ouverts et souveraineté s'accélèrent

La poussée pour les modèles à poids ouverts s’intensifie, portée à la fois par les États, les entreprises réglementées et les nouveaux entrants. Reflection AI a lancé Beam, un modèle de 501 milliards de paramètres entraîné sur environ 24 trillions de tokens, avec un calcul estimé à 6,3 milliards de dollars. En parallèle, le discours souverainiste de Mistral illustre une demande croissante pour des systèmes auditables, déployables localement et moins dépendants des plateformes étrangères. Cette dynamique redessine la concurrence mondiale autour d’un triptyque devenu central: coût, contrôle et juridiction.

Vidéos couvertes

Briefings précédents · IA