Article complet du Daily Podcast
Fuite géante d’Opus 5.5 et prix en baisse ? Qwen 4, Kimi K3.1, MiniMax M3.1 et Step 5 Preview dans l’actualité IA
La fin septembre concentre une nouvelle vague de signaux autour des grands modèles : Anthropic préparerait Claude Opus 5.5 à un tarif plus agressif, tandis que plusieurs laboratoires chinois avancent Step 5 Preview, MiniMax M3.1, Qwen 4 et Kimi K3.1. Mais toutes les informations n’ont pas le même niveau de certitude.
Où en est vraiment l’histoire
Le titre de travail reste bien celui-ci: Huge Opus 5.5 Leaks + Cheaper? Qwen 4, Kimi K3.1, MiniMax M3.1 & Step 5 Preview! AI News. L’actualité ne se résume pas à une annonce officielle unique. Elle ressemble plutôt à une grappe de signaux: une fuite précise autour de Claude Opus 5.5, un lancement plus concret de StepFun avec Step 5 Preview, des indices de préparation chez MiniMax, et des rumeurs plus légères autour de Qwen 4 et Kimi K3.1.
La première règle est donc de séparer les niveaux de confiance. Step 5 Preview est déjà accessible via API, avec une promesse de poids ouverts à venir. Claude Opus 5.5, lui, reste décrit par des fuites, des noms de routage et des recoupements communautaires, sans fiche modèle officielle d’Anthropic. MiniMax M3.1 se situe entre les deux: des chaînes repérées dans des fichiers et des commentaires antérieurs de direction suggèrent une préparation avancée, mais pas encore un lancement public. Qwen 4 et Kimi K3.1, enfin, appartiennent encore surtout à la catégorie “à surveiller”.
Opus 5.5: une fuite précise, mais non confirmée
Le cœur du dossier Anthropic est une affirmation: un modèle Claude Opus 5.5, associé au nom de code ou d’accès anticipé claude-wafer-eap, serait en test avant une possible sortie le mardi 22 septembre 2026 . Cette date attire l’attention parce qu’elle placerait Anthropic dans une séquence très dense de discussions sur les modèles frontières concurrents et sur les nouvelles sorties chinoises .
Le point le plus spectaculaire est le prix supposé. Plusieurs reprises de la fuite évoquent 4 dollars par million de tokens en entrée et 20 dollars par million de tokens en sortie, avec une lecture de cache à 0,20 dollar et une écriture de cache à 5 dollars par million de tokens . Si ces chiffres se vérifiaient, ils représenteraient une baisse notable par rapport au tarif cité pour Opus 5, soit 5 dollars en entrée et 25 dollars en sortie par million de tokens . Pour les développeurs d’agents, ce n’est pas un détail: les workflows de codage, navigation, recherche documentaire et usage d’outils peuvent consommer énormément de tokens.
Mais la prudence reste nécessaire. L’analyse d’APIMaster publiée le 21 septembre indique qu’Opus 5.5 n’était pas disponible au moment de la publication et qu’il n’existait pas encore d’identifiant officiel, de fiche modèle, de grille tarifaire ou d’annonce Anthropic . OrcaRouter arrive à une conclusion comparable: la mention claude-wafer-eap est suffisamment précise pour être vérifiable, mais elle reste non confirmée et dépend de sources limitées . La bonne formulation éditoriale est donc “rumeur à fort signal”, pas “lancement”.
Pourquoi un Opus moins cher changerait la donne
Si le tarif rapporté est exact, Anthropic attaquerait deux problèmes à la fois. D’un côté, la société défendrait la gamme Claude premium face aux modèles frontières rivaux. De l’autre, elle rendrait les agents persistants moins coûteux à exploiter. Le résumé HelloBro présente Opus 5.5 comme un possible remplacement de la piste Opus 5.2 et comme le lancement Anthropic le plus probable à court terme parmi plusieurs systèmes évoqués .
La vraie question n’est pas seulement de savoir si le prix $4/$20 apparaîtra officiellement. Il faut aussi savoir si le modèle réussit autant ou mieux avec le même volume de tokens, voire moins. Une baisse nominale de 20% peut disparaître si le modèle raisonne plus longtemps, appelle davantage d’outils ou produit des traces intermédiaires plus longues. À l’inverse, une baisse modeste devient très intéressante si la fiabilité augmente et si les équipes réduisent les relances.
C’est pourquoi le comportement supposé du modèle compte presque autant que son prix. Les fuites insistent sur l’exécution longue, les tâches de codage complexes et certains usages de génération visuelle ou 3D . Ce sont précisément les domaines où les laboratoires veulent transformer les progrès de benchmarks en usages payants: non pas seulement une meilleure réponse de chatbot, mais un système capable de maintenir un fil de projet pendant des heures.
Step 5 Preview: le signal le plus concret
Parmi tous les modèles cités, StepFun Step 5 Preview est le moins spéculatif. DeAI a rapporté le 21 septembre que l’API Step 5 Preview était disponible, en décrivant le modèle comme un Mixture-of-Experts clairsemé de 600 milliards de paramètres, avec 27 milliards de paramètres actifs par token, une fenêtre de contexte de 1 million de tokens, et un tarif de 1 dollar par million de tokens en entrée et 2,70 dollars par million de tokens en sortie . La même source indique que StepFun prévoit de publier les poids ouverts le 15 octobre 2026, tout en soulignant qu’aucune licence n’était encore nommée .
Ce dernier point est essentiel. “Poids ouverts” peut couvrir des réalités très différentes: usage commercial large, licence de recherche restrictive, ou conditions qui limitent fortement le déploiement. Pour les développeurs, le 15 octobre n’est donc pas la fin de l’analyse, mais son début. La licence, la recette de service, la facilité de quantification, le débit et les hébergeurs tiers détermineront si Step 5 devient vraiment un modèle ouvert utile pour les agents, ou surtout une API performante avec promesse de téléchargement.
Le positionnement de StepFun est néanmoins clair. L’entreprise ne met pas seulement en avant l’intelligence; elle vend un coût par tâche inférieur. Dans un marché où les meilleurs modèles restent chers, un modèle de 600 milliards de paramètres totaux qui n’en active que 27 milliards par token vise directement l’économie du service. Même sans dominer tous les benchmarks, il peut compter s’il livre assez de capacité à un coût nettement plus bas.
MiniMax M3.1: la fumée du dépôt avant le feu du lancement
MiniMax M3.1 est un autre candidat proche d’une sortie, mais les preuves publiques restent indirectes. Juya AI Daily a signalé le 20 septembre que des chaînes MiniMax-M3.1 apparaissaient dans plusieurs fichiers de l’outil open source MiniMax Code CLI, notamment autour des listes de modèles, paramètres et mécanismes de persistance . Le même rapport évoque de grandes configurations de contexte et de sortie, ainsi que plusieurs niveaux d’effort de raisonnement, tout en précisant que M3.1 n’était pas encore intégré comme modèle effectivement disponible .
AGI HUNT a suivi le même signal dans son digest du 20 septembre, en indiquant qu’un utilisateur de X avait repéré une chaîne MiniMax M3.1 dans un fichier model-selection.test.ts récent du dépôt MiniMax-Code, et que MiniMax n’avait pas encore fait de commentaire public . Pris ensemble, ces indices ressemblent à de la plomberie de fin de préparation plutôt qu’à un lancement utilisateur.
L’attente autour de MiniMax vient aussi de sa feuille de route. Le résumé HelloBro rappelle que la direction de MiniMax avait déjà présenté M3.1, M3 Pro et H3.1 comme proches de l’achèvement, avec un M3.1 moins centré sur la démonstration de taille brute que sur la stabilité, la qualité de sortie, l’efficacité d’inférence et la généralisation agentique . Cela correspond très bien au moment actuel: les équipes veulent des modèles plus réguliers et moins chers en boucles de production, pas seulement plus impressionnants en démo.
Qwen 4 et Kimi K3.1: liste de surveillance, pas confirmation
Les éléments Qwen et Kimi exigent le plus de retenue. Le tour d’horizon DealCan du 20 septembre place la série Qwen4 d’Alibaba et Kimi K3.1 de Moonshot parmi les modèles chinois attendus autour des congés de la Fête de la mi-automne et de la Fête nationale, aux côtés de Step 5 Preview, MiniMax M3.1 et d’autres . Cela les inscrit dans la même vague de sorties probables, mais ne prouve pas qu’ils soient lancés.
Chez Alibaba, l’activité confirmée est ailleurs. L’équipe Qwen a publié Qwen3.8-LiveTranslate, un modèle d’interprétation simultanée en temps réel qui ferait passer le retard moyen de 2,8 secondes à 2,3 secondes sur 60 langues . Cette sortie ne démontre pas que Qwen 4 arrive immédiatement, mais elle montre qu’Alibaba continue de livrer des modèles spécialisés pendant la même fenêtre.
Chez Moonshot, le signal ressemble davantage à un teaser. Juya AI Daily rapporte que le compte Zhihu vérifié de Kimi a publié une suite de chiffres de pi commençant après “3.1”, ce que la communauté a interprété comme un indice possible pour Kimi K3.1; le même rapport précise que le post ne mentionnait pas directement K3.1, ne donnait ni date ni capacités, et a ensuite été supprimé . C’est du carburant de rumeur pré-lancement, pas une confirmation.
Le vrai fil conducteur: l’économie des capacités
La grande histoire n’est donc pas simplement “encore plus de modèles”. C’est le déplacement de la compétition IA vers le rapport prix-performance, la longueur de contexte, l’efficacité des paramètres actifs et la fiabilité des agents. Une baisse de prix d’Opus 5.5 viserait le haut de gamme propriétaire. Step 5 Preview attaque le coût par tâche avec une activation clairsemée. MiniMax semble préparer une itération axée sur la stabilité et l’efficacité. Alibaba et Moonshot sont scrutés parce que leurs mises à jour peuvent vite devenir des pressions de marché.
Le bilan éditorial est clair: Step 5 Preview est disponible via API; Opus 5.5 est une fuite précise mais non confirmée; MiniMax M3.1 semble proche mais non lancé; Qwen 4 et Kimi K3.1 restent des éléments de veille. Si Anthropic publie mardi, l’histoire deviendra celle d’une guerre de prix. Sinon, elle restera une photo utile du prochain cycle IA: contextes plus longs, coûts par tâche plus bas, et modèles conçus pour les agents plutôt que pour le chat seul.
Sources des dernières 72 heures
- [1]Huge Opus 5.5 Leaks + Cheaper? Qwen 4, Kimi K3.1, MiniMax M3.1 & Step 5 Preview! AI News21 sept. 2026, 06:15 UTC
- [2]Claude Opus 5.5: Anthropic Is Skipping a Version to Fight GPT-6 | APIMaster.AI21 sept. 2026, 00:00 UTC
- [3]Claude Opus 5.5 泄露:一个名为“claude-wafer-eap”的检查点,以及传闻中的周二发布20 sept. 2026, 00:00 UTC
- [4]StepFun's Step 5 Preview API ships; open weights promised October 1521 sept. 2026, 00:00 UTC
- [5]橘鸦 AI 日报 — Juya AI Daily19 sept. 2026, 16:00 UTC
- [6]Alibaba Qwen Team Releases Qwen3.8-LiveTranslate: A Real-Time Interpretation Model That Cuts Average Lag to 2.3 Seconds Across 60 Languages20 sept. 2026, 00:00 UTC
- [7]AGI HUNT · AI News Daily 2026-09-20 — Today's AI Highlights20 sept. 2026, 00:00 UTC
- [8]Tech Express | September 20, 2026 Over a Dozen Large Models Set to Launch Around China's Double Holiday - DealCan20 sept. 2026, 00:00 UTC
Article généré par IA à partir d’une recherche web récente, puis conservé comme instantané éditorial daté.

Commentaires
Sois le premier à commenter.