Le 21 septembre 2026, Xiaomi a publié la série MiMo-V2.6 et open-source les poids. La paire vedette est MiMo-V2.6-Pro et MiMo-V2.6-Flash, tous deux positionnés comme modèles nativement omnimodaux — texte, image, vidéo, audio — avec une fenêtre de contexte d'un million de tokens et des capacités orientées agent, dont l'utilisation d'ordinateur et le raisonnement spatial 3D.
Xiaomi a également livré MiMo-V2.6-Distill-Qwen-9B, les ressources de recherche en apprentissage par renforcement associées, et un ensemble vérifié de pratiques d'entraînement. Les fiches Pro-RL et Flash-RL sont sur Hugging Face sous licence MIT, dans la collection MiMo-V2.6.
L'API est également en ligne sur la Xiaomi MiMo Open Platform avec des prix inchangés par rapport à V2.5, plus une liste OpenRouter et un client de bureau sorti de l'accès anticipé.
Ce qui a réellement été livré
| Élément | Description |
|---|---|
| MiMo-V2.6-Pro | Modèle open weight phare, contexte 1M, multimodal, poids MIT. |
| MiMo-V2.6-Flash | Cadet plus rapide, même canal de sortie, poids MIT, API bon marché. |
| MiMo-V2.6-Pro-UltraSpeed | Variante de service API, débit annoncé jusqu'à ~20× plus rapide que Pro à qualité égale ; poids non confirmés séparément. |
| MiMo-V2.6-Distill-Qwen-9B | Point de contrôle distillé 9B plus des ressources de recherche en RL. |
| MiMo Desktop | Première release officielle du client de bureau avec Pro et Flash intégrés, plus un plan d'adhésion. |
| MiMo Code | L'agent de terminal open source de Xiaomi, construit sur la fondation OpenCode. |
Cette dernière ligne mérite une pause. L'agent de terminal de Xiaomi est un dérivé d'OpenCode, ce qui fait de la bande gratuite sur OpenCode Zen pour le nouveau modèle Flash moins une promo au hasard que la rencontre des deux bouts d'une même stratégie de distribution.
Appelez les modèles en minuscules sur l'API : mimo-v2.6-pro, mimo-v2.6-flash, mimo-v2.6-pro-ultraspeed. Sur OpenRouter, ils apparaissent comme xiaomi/mimo-v2.6-pro, xiaomi/mimo-v2.6-flash et xiaomi/mimo-v2.6-pro-ultraspeed.
L'histoire RL en dessous
Xiaomi présente V2.6 comme une étape sur la voie RSI — amélioration récursive de soi : augmenter la puissance de calcul en RL sur des tâches complexes vérifiables et laisser l'exploration et le retour d'expérience repousser la limite.
Selon la lecture de TechNode, les deux modèles ont complété 30 étapes de RL en moins de six jours avec environ 750 000 trajectoires, pour des coûts déclarés d'environ 2,62 M$ pour Pro et 850 K$ pour Flash.
Que l'on adhère ou non au cadre RSI, la revendication opérationnelle est concrète : c'est un investissement RL sérieux derrière des poids téléchargeables sous MIT. Cette combinaison — entraînement capital-intensive, licence permissive — reste la partie de la vague open weight chinoise qui déstabilise le plus l'hypothèse selon laquelle les modèles au niveau frontier doivent rester derrière un compteur d'API.
Prix : inchangés, et maintenant avec un canal gratuit
La tarification API temps réel hors Chine a été reportée depuis V2.5. L'API Batch est à moitié prix.
| Route | Entrée (par 1M) | Sortie (par 1M) | Notes |
|---|---|---|---|
| MiMo API · Flash | 0,14 $ | 0,28 $ | Mises en cache moins chères ; batch à moitié prix. |
| MiMo API · Pro | 0,435 $ | 0,87 $ | Cache à 0,0036 $/M selon le tarif publié. |
OpenRouter · xiaomi/mimo-v2.6-* |
mesuré | mesuré | Une seule clé entre fournisseurs. |
OpenCode Zen · opencode/mimo-v2.6-flash-free |
0 $ | 0 $ | Canal gratuit à durée limitée ; contexte 200K indiqué. |
| OpenCode Go | — | — | 10 $/mois, Pro et Flash parmi plus de 30 modèles. |
| Xiaomi Token Plan Lite | — | — | 6 $/mois, 4,1 milliards de crédits, utilisable dans OpenCode et Claude Code. |
| Poids Hugging Face | — | — | MIT ; votre calcul, votre déploiement. |
OpenCode l'a en gratuit
Cette offre est temporaire : vérifiez qu'elle est toujours active avant de vous y fier. L'annonce de lancement parlait d'environ une semaine à partir du 21 septembre ; la fiche Zen actuelle d'OpenCode fait foi pour savoir si elle est encore active.
Le 21 septembre, OpenCode a annoncé que MiMo-V2.6-Flash serait gratuit sur OpenCode Zen pendant environ une semaine. L'identifiant du modèle est :
opencode/mimo-v2.6-flash-freeIl est servi depuis https://opencode.ai/zen/v1 via une API de complétions compatible OpenAI, indique 200 000 tokens de contexte et 32 000 tokens de sortie max, et affiche chaque compteur — entrée, sortie, lecture du cache, écriture du cache — à 0 $.
En pratique : ouvrez un projet, lancez opencode, tapez /models, et choisissez MiMo V2.6 Flash Free (Zen) si l'étiquette apparaît dans votre sélecteur. Vérifiez cette étiquette avant une longue session — la documentation publique de Zen affichait encore l'ancienne fiche MiMo-V2.5 Free un moment après l'annonce, et un utilisateur a répondu au post de lancement avec une capture de facturation. Confirmez que vous êtes bien sur la variante gratuite.
Trois réserves, aucune n'est exotique :
- C'est Flash, pas Pro. Pro existe, mais il passe par OpenCode Go (10 $/mois), votre propre clé Xiaomi, Token Plan, ou OpenRouter.
- C'est limité dans le temps. OpenCode a annoncé environ une semaine à partir du 21 septembre, sans préciser ici l'heure exacte de fin. Vérifiez la fiche Zen et votre sélecteur
/modelsavant de l'utiliser. Siopencode/mimo-v2.6-flash-freea disparu ou n'est plus indiqué comme gratuit, ne supposez pas qu'une autre route MiMo est gratuite : choisissez une route API payante seulement après en avoir vérifié le tarif actuel, ou exécutez les poids MIT sur une infrastructure que vous contrôlez. - La réserve sur les données est explicite. La documentation de Zen d'OpenCode indique que les données collectées sur ses modèles MiMo gratuits peuvent servir à améliorer le modèle. N'envoyez pas de dépôts client confidentiels ni de données clients par le canal gratuit. Les poids sont sous MIT et l'API payante est mesurée normalement — la prudence vise spécifiquement le point d'essai gratuit.
Un contrôle supplémentaire : les anciens points d'entrée MiMo Pro sur OpenRouter acceptaient mal les appels d'outils natifs (tools), ce qui les rendait peu pratiques dans les harnais d'agents. La génération V2.6 semble avoir corrigé cela — des tests publiés de xiaomi/mimo-v2.6-pro via l'application de bureau d'OpenCode ont réussi des tâches multi-outils que V2.5 peinait à accomplir. Si votre rotation dépend des appels d'outils natifs, re-testez plutôt que d'hériter de la limitation du mois dernier.
(Transparence : cet article a été rédigé sur opencode/mimo-v2.6-flash-free, le canal gratuit qu'il décrit.)
Hors-sujet : l'économie des resets Codex
Pendant que le côté open weight de l'économie des agents faisait une sortie, le côté abonnement faisait ce qu'il fait toujours autour d'une grande mise en ligne — remettre les quotas à zéro.
Tibo — Thibault Sottiaux, qui travaille sur Codex et ChatGPT chez OpenAI — a maintenu le schéma familier tout au long du déploiement de GPT-6 Astra : resets en banque les 3 et 4 septembre, un reset global le 7 septembre, puis un post de correctifs de qualité avec un nouveau reset à minuit le 11 septembre. Le centre d'aide d'OpenAI documente maintenant les resets en banque comme mécanisme formel : un rafraîchissement unique des quotas Codex que vous appliquez vous-même, distinct du type automatique global.
La raison d'incruster ceci à côté d'un post de sortie MiMo, c'est que les deux histoires sont la même histoire vue de deux directions. L'économie de l'usage des agents de codage s'assouplit des deux côtés à la fois. Les vendeurs d'abonnements colmatent les frictions de déploiement avec des resets de courtoisie et du quota en banque. Les vendeurs de open weights offrent une semaine d'un nouveau modèle Flash pour attirer les gens vers un écosystème où le vrai produit est le client de bureau, l'adhésion, le token plan, ou l'API. Le gratuit est le moteur d'acquisition dans les deux cas ; la question est toujours ce que le canal gratuit vous habitue à chercher ensuite.
L'autre côté : GPT-6 Sol, Luna et le repricing des abonnements
Le déploiement d'Astra a apporté plus que des resets. Les posts de Tibo en septembre mentionnent deux noms de modèles qui comptent pour quiconque budgète des charges de travail agents :
| Modèle | Contexte | Ce qui a changé |
|---|---|---|
| GPT-6 Astra | Déploiement phare vers Plus/Pro/Business, puis Plus | Resets en banque 3–4 sept, reset global 7 sept, reset correctifs 11 sept. Positionné comme nouveau défaut pour Codex. |
| GPT-5.6 Sol | Palier "explorer les limites" pour le cap des 8M d'utilisateurs | Reset weekend 13 sept, limite 5h levée, vendu pour tâches longues ambitieuses. |
| GPT-5.6 Luna | Variante haut débit | "100 000 threads Luna ce weekend" reset 12 sept, limite 5h retirée, cadre pour expérimentation volume. |
Le signal pratique : OpenAI utilise les resets de quota comme levier de prix. Au lieu de couper les taux au token, ils élargissent l'allocation effective — resets en banque, plafonds 5h levés, fenêtres weekend illimitées — ce qui baisse le coût effectif par heure d'agent utile. Pour les équipes sur Plus/Pro/Business, le coût marginal d'une session Codex a chuté brutalement en septembre sans changement de prix publié.
Pendant ce temps, le côté open-weight fait l'inverse : MiMo-V2.6-Flash à 0 $ pour une semaine, puis 0,28 $/M en sortie sur API, ou 0 $ pour toujours si vous auto-hébergez les poids MIT. Le côté abonnement assouplit les quotas ; le côté open-weight durcit un plancher de prix à zéro.
Si vous faites tourner une flotte mixte — certaines tâches sur Codex, d'autres sur OpenCode avec MiMo ou DeepSeek — le virage de septembre signifie que la partie abonnement vient de devenir moins chère en pratique tandis que la partie open-weight gagne un nouveau point d'entrée gratuit. Le calcul de rotation change : vous pouvez vous permettre plus d'escalade Codex car les resets absorbent les pics, et vous avez un travailleur parallèle gratuit crédible (MiMo Flash sur Zen) pour les tâches courantes qui n'ont pas besoin de GPT-6.
Où cela se situe dans la rotation
Cela ne remplace pas la rotation de septembre construite autour de DeepSeek V4.1 Flash comme pilote quotidien et GLM 5.3 pour l'escalade. Ce que V2.6 change, c'est le palier gratuit et quasi gratuit :
| Emplacement | Avant | Après V2.6 |
|---|---|---|
| Travailleur parallèle gratuit | Unbiased Pareto, Big Pickle | Ajouter opencode/mimo-v2.6-flash-free tant que la semaine dure. |
| Raisonnement fort et bon marché | GLM 5.3 Flash | L'API Flash à 0,28 $/M en sortie devient un concurrent sérieux. |
| Second avis gratuit | Big Pickle (OpenCode Zen) | Même emplacement, un occupant fort de plus. |
| Option auto-hébergée | — | Les poids MIT Pro-RL / Flash-RL sont le nouveau plancher. |
La note sur la flotte de modèles gratuits avait déjà MiMo Pro comme palier de délégation. V2.6 rafraîchit les deux bouts : la délégation gagne une vraie montée de génération, et le canal gratuit passe d'un palier statique à un essai en fenêtre de lancement.
À vérifier maintenant
- Confirmez que MiMo V2.6 Flash Free apparaît réellement avec une étiquette Free dans votre sélecteur
/modelsd'OpenCode avant une longue session. - Gardez les dépôts confidentiels hors du canal Zen gratuit tant que la réserve sur les données d'amélioration s'applique.
- Si vous routez par identifiant de modèle, passez aux noms V2.6 en minuscules et relancez une vérification de disponibilité en direct.
- Agents ayant besoin d'outils natifs : re-testez
mimo-v2.6-proplutôt que d'hériter de la limitation V2.5. - Vérifiez si la période gratuite est toujours active. Si le modèle a disparu ou n'est plus indiqué comme gratuit, utilisez une route API dont le tarif actuel est confirmé ou hébergez les poids MIT vous-même ; ne supposez pas que l'offre a été transférée au plan OpenCode Go.
- Utilisateurs Codex : vérifiez Settings → Usage pour un éventuel reset en banque avant de supposer que le global s'applique à votre plan.
Sources
- Xiaomi MiMo — notes de sortie MiMo-V2.6
- Hugging Face — collection MiMo-V2.6
- TechNode — Xiaomi open-source MiMo-V2.6 après mise à l'échelle du renforcement
- fonearena — fonctionnalités Xiaomi MiMo-V2.6-Pro et Flash
- kie.ai — qu'est-ce que Xiaomi MiMo V2.6
- kingy.ai — MiMo-V2.6-Pro est-il gratuit ? Tarifs, configuration et test OpenCode
- OpenCode Zen — fiche du modèle MiMo-V2.6-Flash Free
- Xiaomi MiMo — guide de configuration OpenCode
- Tibo sur X — correctifs de qualité Astra et reset à minuit
- OpenAI Help — comment fonctionnent les resets Codex en banque