Xiaomi MiMo-V2.6: najmocniejszy otwarty model
MiMo-V2.6-Pro ma 46 pkt w Artificial Analysis, najwięcej wśród otwartych modeli. Kosztuje 0,435 i 0,87 USD za mln tokenów i działa w Claude Code.

Xiaomi wydało w poniedziałek późnym wieczorem naszego czasu serię MiMo-V2.6 i od razu udostępniło wagi na licencji MIT, która pozwala na użytek komercyjny. Najmocniejszy MiMo-V2.6-Pro ma 46,32 punktu w indeksie inteligencji Artificial Analysis, najwięcej spośród modeli z otwartymi wagami. W API kosztuje 0,435 USD za milion tokenów na wejściu i 0,87 USD na wyjściu, tyle samo co poprzednik. Xiaomi ma oficjalną instrukcję podłączenia go do Claude Code i abonament Token Plan od 6 USD miesięcznie. Aplikacja MiMo Desktop nie działa jednak w Unii Europejskiej, więc w Polsce pozostają API, abonament i pośrednicy.
Trzy warianty, jedna rodzina
- MiMo-V2.6-Pro: flagowiec typu Mixture-of-Experts z 1,02 biliona parametrów, z których przy każdym tokenie pracuje 42 miliardy.
- MiMo-V2.6-Flash: lżejszy i około trzech razy tańszy od Pro, ma 309 miliardów parametrów, w tym 15 miliardów aktywnych.
- MiMo-V2.6-Pro-UltraSpeed: tryb pracy Pro, który według Xiaomi generuje odpowiedzi do 20 razy szybciej przy tej samej jakości. Jest dostępny tylko przez API i w aplikacji Xiaomi.
Oba modele przyjmują na wejściu tekst, obrazy, wideo i dźwięk, a odpowiadają tekstem. Okno kontekstu ma milion tokenów, a odpowiedź może mieć do 128 tysięcy tokenów. Najwięcej miejsca Xiaomi poświęca trenowaniu przez wzmacnianie: w niecałe sześć dni model Pro wykonał 30 kroków trenowania na około 750 tysiącach prób rozwiązania zadań, za około 2,62 mln USD, a jego wynik w DeepSWE v1.1 (długie zadania programistyczne) wzrósł o około 14 punktów. Kod treningu też jest publiczny.
Pierwsze miejsce wśród otwartych, dziesiąte w naszej tabeli

Na wykresie Xiaomi przed MiMo-V2.6-Pro stoją tylko zamknięte modele Anthropic, OpenAI i Mety, ale Xiaomi pominęło Claude Opus 5.5 i Groka 4.7, które mają więcej punktów.
Xiaomi pisze, że jego model wyprzedza Kimi K3 i Qwen3.8 Max. W naszej tabeli modeli MiMo-V2.6-Pro zajmuje 10. miejsce wśród 42 modeli i jest najwyżej spośród modeli otwartych, ale z niewielką przewagą: Qwen3.8 Max ma 45,4 punktu, GLM-5.3 44,8, a Kimi K3 43,6.
Artificial Analysis mierzy jednak tylko 54 tokeny na sekundę, a średnia w zestawieniu wynosi 67. W tabeli Xiaomi Pro wyraźnie odstaje w Terminal-Bench 4.0, w którym agent wykonuje długie zadania w terminalu: osiąga 34,9 procent, podczas gdy Claude Opus 5 ma 49,0, a GPT-6 Astra 59,6.

W DeepSWE v1.1 Pro ma 71,9 procent, niewiele mniej niż Claude Opus 5 (74,0) i GPT-5.6 Sol (73,0), a poprzedni MiMo-V2.5-Pro miał tu tylko 19,0.
Koszt zadania zamiast ceny za token
Artificial Analysis liczy też, ile średnio kosztuje rozwiązanie jednego zadania z testów indeksu. Dla MiMo-V2.6-Pro to 0,13 USD. Grok 4.7 z tym samym wynikiem potrzebuje 3,74 USD, GPT-6 Astra 3,26 USD, a Claude Opus 5.5 5,98 USD. Żaden model z co najmniej 46 punktami nie rozwiązuje ich taniej.
Cennik API za milion tokenów:
- Pro: 0,435 USD na wejściu i 0,87 USD na wyjściu, odczyt z pamięci podręcznej 0,0036 USD.
- Flash: 0,14 i 0,28 USD, odczyt z pamięci podręcznej 0,0028 USD.
- Pro-UltraSpeed: 4,35 i 8,70 USD, czyli dziesięć razy drożej niż zwykły Pro.
Pro i Flash są też dostępne w Batch API za połowę ceny, gdy wynik nie jest potrzebny od razu. Te same stawki obowiązują w OpenRouterze i w bramce Kilo Code. Starsze MiMo-V2.5-Pro i MiMo-V2.5 znikną z API 21 października o 4:00 czasu polskiego.
Co z abonamentami
Xiaomi sprzedaje programistom abonament Token Plan. Można z niego korzystać między innymi w Claude Code, Codeksie, OpenCode, Kilo Code, Cline i Qwen Code, a wszystkie narzędzia korzystają ze wspólnej puli kredytów.
- Lite: 6 USD miesięcznie, 4,1 mld kredytów.
- Standard: 16 USD, 11 mld kredytów.
- Pro: 50 USD, 38 mld kredytów.
- Max: 100 USD, 82 mld kredytów.
Model Pro zużywa 300 kredytów za token na wejściu i 600 na wyjściu, Flash trzy razy mniej. Lite wystarczy więc na około 13,7 mln tokenów wejściowych Pro bez pamięci podręcznej, czyli mniej więcej tyle tokenów, ile kupisz w API za te same 6 USD. Abonament daje za to przewidywalny koszt, 12 procent rabatu na pierwszy zakup i nocną zniżkę: od 18:00 do 2:00 czasu polskiego (po zmianie czasu od 17:00 do 1:00) zadania zużywają o 20 procent mniej kredytów.
Token Plan nie ma limitów pięciogodzinnych ani tygodniowych. Pula jest ważna przez miesiąc kalendarzowy od dnia zakupu, liczony według UTC, i nie przechodzi na kolejny okres. Po jej wyczerpaniu usługa przestaje działać, a Xiaomi nie pobiera nic z salda konta: pozostaje dopłata do wyższego planu albo przejście na zwykłe API. Zwrotów nie ma. Kredyty wolno zużywać tylko w narzędziach do kodowania, a wywołania ze skryptów lub z backendu aplikacji Xiaomi uznaje za nadużycie.
UltraSpeed nie wchodzi w żaden poziom Token Planu. W abonamencie dają go tylko droższe członkostwa w aplikacji MiMo Desktop, niedostępnej w UE. W Cursorze i GitHub Copilot MiMo-V2.6 nie ma na liście modeli. Najtaniej zaczniesz od płatności za zużycie przez API Xiaomi lub OpenRouter albo od planu Lite, który przy pierwszym zakupie kosztuje 5,28 USD.
Jak podłączyć MiMo do Claude Code
Xiaomi udostępnia adres zgodny z API Anthropic. W pliku ~/.claude/settings.json, w sekcji env, ustawiasz ANTHROPIC_BASE_URL na https://api.xiaomimimo.com/anthropic, ANTHROPIC_AUTH_TOKEN na swój klucz i ANTHROPIC_MODEL na mimo-v2.6-pro. Przy abonamencie adres bierzesz z panelu Token Planu (dla Europy jest osobny klaster). W instrukcji Xiaomi ten sam model trafia też do zmiennych odpowiadających za domyślne modele Sonnet, Opus i Haiku, a dopisek [1m] na końcu nazwy włącza pełny milion tokenów kontekstu. To po prostu BYOK: za tokeny płacisz Xiaomi, a nie Anthropic.
Czy uruchomisz go lokalnie
Tylko w okrojonej wersji. Wagi Pro zajmują 573,5 GB, choć większość z nich zapisano już w 4-bitowym formacie, a przykładowa konfiguracja opisana w karcie modelu zakłada serwer z ośmioma kartami graficznymi. Flash waży 177,8 GB, a najmocniej skompresowana wersja GGUF wydana przez ggml-org, zespół stojący za llama.cpp, wciąż zajmuje 125,7 GB.
Na zwykłym komputerze uruchomisz dopiero MiMo-V2.6-Distill-Qwen-9B, czyli model Qwen3.5-9B dotrenowany na danych wygenerowanych przez MiMo, także na licencji MIT. Jego plik GGUF w wariancie Q8_0 ma 9,5 GB, ale to inna liga: w Terminal-Bench 2.1 ma 37,1 procent, a Pro osiąga 89,9.
Co to znaczy dla vibe codingu
MiMo-V2.6-Pro to dziś najmocniejszy model do pobrania i najtańszy w przeliczeniu na zadanie spośród modeli z co najmniej 46 punktami. W Claude Code sprawdzisz go na własnym projekcie za grosze, choć jest wolniejszy od średniej i słabszy w długich zadaniach w terminalu. Na start wystarczy płatność za zużycie, a koszt przy swojej skali przeliczysz w kalkulatorze kosztów API.
Opanuj AI‑coding w 5 minut. W każdy poniedziałek.
Konkretne premiery, analizy cen i jeden trik, który przyspieszy Twoją pracę. Po polsku, bez żargonu, prosto na maila.