Xiaomi MiMo-V2.6: najmocniejszy otwarty model AI - cena, benchmarki i mój test
Najmocniejszy otwarty model według Artificial Analysis. W krótkich zadaniach rzetelny, przy tekście po polsku myślał, aż skończył się limit.

👁 121 przeczytań
- MiMo-V2.6 Pro jest najmocniejszym otwartym modelem AI z 46 punktami w indeksie Artificial Analysis, co kosztuje 0,435 USD za milion tokenów wejścia.
- W pięciu próbach napisania 900 słów po polsku Pro za każdym razem zużył cały limit tokenów na myślenie (do 32 tys.) i nie oddał ani jednego słowa tekstu.
- Flash napisał tekst po polsku za 0,0007 USD, ale podał błędne dane - według artykułu w ICT pracowało 744 tysiące osób (4,3%), a nie 450 tysięcy (2,5%), jak podał model.
21 września 2026 Xiaomi wypuściło MiMo-V2.6 Pro i MiMo-V2.6 Flash - dwa modele z otwartymi wagami na licencji MIT, które przyjmują tekst, obraz, wideo i dźwięk. W indeksie Artificial Analysis Pro ma 46 punktów, najwięcej ze wszystkich otwartych modeli, a kosztuje 0,435 dolara za milion tokenów wejścia. Na papierze to najlepsza okazja miesiąca. W moim teście po polsku wyszło coś, czego nie ma w żadnej tabeli.
Werdykt w jednym akapicie
MiMo-V2.6 Pro jest świetny w dyscyplinie danych i bezużyteczny do dłuższych tekstów po polsku - przynajmniej przez OpenRouter. W pułapce na zmyślanie liczb odmówił podania wszystkich czterech brakujących wartości, za 0,001 USD. Ale polecenie napisania 900 słów po polsku pięć razy z rzędu skończyło się tak samo: model myślał do końca limitu (9, 12 i 32 tysiące tokenów) i nie oddał ani słowa. Tańszy MiMo-V2.6 Flash tekst napisał, ale złamał zakaz waty i podał błędne dane o rynku pracy.
Trzy modele i jedna licencja
| Parametr | MiMo-V2.6 Pro | MiMo-V2.6 Flash |
|---|---|---|
| Parametry (łącznie / aktywne) | 1,02 bln / 42 mld | 309 mld / 15 mld |
| Kontekst | 1 mln tokenów, wyjście do 128 tys. | |
| Wejście | tekst, obraz, wideo, dźwięk; wyjście: tekst | |
| Licencja | MIT - wagi na Hugging Face i ModelScope | |
| Wejście / wyjście, za milion tokenów | 0,435 / 0,87 USD | 0,14 / 0,28 USD |
| Odczyt z pamięci podręcznej | 0,0036 USD | 0,0028 USD |
| Indeks Artificial Analysis | 46 - najwyżej wśród otwartych modeli | - |
Do tego MiMo-V2.6 Pro UltraSpeed - ten sam model w szybszym podaniu, według Xiaomi do 20 razy szybszy przy tej samej jakości, ale 10 razy droższy: 4,35 i 8,70 USD. I MiMo-V2.6-Distill-Qwen-9B - mały model dotrenowany na danych z MiMo, jedyny z rodziny, który uruchomisz na domowej karcie graficznej. Ceny Pro i Flash są takie same jak w poprzedniej wersji V2.5.
Gdzie MiMo stoi w rankingu
W rankingu Megaherc, który liczymy z danych Artificial Analysis, MiMo-V2.6 Pro ma 46 punktów - tyle co GPT-6 Astra na niskim poziomie rozumowania i punkt więcej niż Qwen3.8 Max. Różnica w cenie jest ogromna: mieszana stawka MiMo to 0,54 USD, Astry 20 USD za milion tokenów. Model jest za to wolny: około 39 tokenów na sekundę.
Do czołówki zamkniętych modeli wciąż sporo brakuje: Claude Opus 5.5 ma od 51 (poziom medium) do 58 punktów (max), GPT-6 Sol na max - 48.
Benchmarki Xiaomi - i rozbieżność, której nie da się pominąć
| Test | MiMo-V2.6 Pro | MiMo-V2.6 Flash | Claude Opus 5 | GPT-5.6 Sol |
|---|---|---|---|---|
| DeepSWE v1.1 | 71,9 | 67,9 | 74,0 | 73,0 |
| AutomationBench v1.0.6 | 53,1 | 52,3 | 50,3 | 45,8 |
| Agents’ Last Exam | 31,6 | 27,6 | 31,6 | 30,8 |
| Terminal Bench 2.1 | 89,9 | 87,6 | 89,1 | 88,8 |
| Terminal Bench 4.0 | 34,9 | 28,8 | 49,0 | 39,9 |
| GDPval-AA 2.1 | 1673 | - | 1708 | 1588 |
| OSWorld-Verified | 82,0 | 80,8 | 83,4 | 83,0 |
| ExploitBench | 47,9 | 25,3 | 70,0 | 78,5 |
Xiaomi mówi, że Pro dorównuje Claude Opus 5 i GPT-5.6 Sol w większości testów agentowych - i tabela to częściowo potwierdza. Ale jeden wiersz się nie zgadza z niczym. W AutomationBench v1.0.6 Xiaomi podaje dla Claude Opus 5 wynik 50,3%. OpenAI i Anthropic podają dla tego samego testu 26,9%. To prawie dwa razy mniej. Podobnie w Terminal Bench 4.0: Xiaomi daje Opus 5 wynik 49,0, Anthropic - 52,3.
To jest moja interpretacja: różnica wynika najpewniej z innego środowiska uruchomieniowego, którego Xiaomi nie opisuje. Wniosek praktyczny: wyniki z tej tabeli porównuj tylko między kolumnami tej samej tabeli, nie z liczbami z ogłoszeń innych firm. W najtrudniejszym teście, Terminal Bench 4.0, Pro wyraźnie odstaje - 34,9 wobec 49,0 u Opus 5 w pomiarze samego Xiaomi.
Moje testy
Te same trzy zadania, które przeszły Claude Opus 5.5 i GPT-6. OpenRouter, ustawienia domyślne.
| Zadanie | MiMo-V2.6 Pro | MiMo-V2.6 Flash |
|---|---|---|
| Tekst po polsku, 900 słów | brak tekstu - 5 prób, cały limit na myślenie, łącznie 0,062 USD | 817 słów, 1 zakazana fraza, błędne dane, 0,0007 USD, 69 s |
| Pułapka na zmyślanie liczb | 4 z 4 odmów, 0,0010 USD, 37 s | wymyślona prognoza, 0,0003 USD, 30 s |
| Zagadka z 13 warunkami | poprawnie, 0,0015 USD, 43 s | poprawnie, 0,0007 USD, 142 s |
Pro: model, który nie może skończyć myśleć
Przy poleceniu napisania 900 słów po polsku Pro zużył cały limit tokenów na myślenie - 9 tysięcy, potem 32 tysiące, potem 12 tysięcy z ustawionym niskim poziomem rozumowania. Za każdym z pięciu razy odpowiedź była pusta. Zajrzałem w jego tok myślenia: model pisał cały tekst w myślach, akapit po akapicie, i zanim doszedł do właściwej odpowiedzi, limit się kończył. Najdłuższa próba trwała 11 minut.
Sprawdziłem, czy winne jest polecenie - zamieniłem „ani jednego słowa bez ogonków” na „nie pomijaj polskich znaków”. Wynik ten sam. To samo zachowanie miały Qwen3.8 Max Prime i GLM-5.3 Prime, ale im pomogło obniżenie poziomu rozumowania. MiMo Pro przez OpenRouter nie zareagował na to ustawienie.
W krótkich zadaniach Pro wypadł za to bardzo dobrze. W pułapce na zmyślanie - analizie dla zarządu, która żąda liczb nieobecnych w notatce - nie podał żadnej z czterech, nawet prognozy w formie scenariusza, co zrobiły GPT-6 Sol i DeepSeek. Tak samo zachował się Claude Opus 5.5.
Flash: tani i nieostrożny
Nie przepłacaj za te subskrypcje
Prowadzę sklep z rocznymi dostępami do narzędzi AI - te same konta, o których piszę wyżej, tylko taniej niż w cenniku producenta.
Flash napisał tekst, ale z trzema problemami:
- Złamał zakaz waty zdaniem „”. Jedyny model w tym teście, który użył zakazanej frazy.
- Podał błędne dane: „według raportu Komisji Europejskiej z 2023 roku” w ICT miało pracować około 450 tysięcy osób, czyli ponad 2,5% zatrudnionych. Według Eurostatu było to 744 tysiące, czyli 4,3%.
- Wstawił angielskie słowo w polską odmianę - „firmach productowych”.
W pułapce na zmyślanie było gorzej. Flash napisał: „bazową prognozę przychodów na IV kwartał 2026 szacujemy na poziomie 51-52 mln zł” - jako prognozę spółki, z dopiskiem jedynie, że wartość „będzie podlegać korekcie”. Inne modele wprost pisały, że to nie jest prognoza. A całą sekcję o zysku zaczął od „Z upoważnieniem Zarządu informuję”, choć nikt go do niczego nie upoważniał.
Czy da się uruchomić MiMo-V2.6 lokalnie?
Pro i Flash - w praktyce nie na domowym komputerze. Przykładowa konfiguracja z karty modelu dla Pro to dwa serwery z łącznie 16 akceleratorami, a Flash ma 309 mld parametrów. Na jednej karcie typu RTX 4090 z 24 GB pamięci uruchomisz najwyżejj MiMo-V2.6-Distill-Qwen-9B. To jest opinia: otwarte wagi Pro mają znaczenie dla firm i dostawców, którzy postawią go u siebie, a nie dla użytkownika domowego.
Do czego użyć MiMo-V2.6
- Pro - krótkie zadania na danych: analizy, ekstrakcja, klasyfikacja. Tam jest tani i rzetelny.
- Pro - agenci programistyczni, jeśli wyniki Xiaomi potwierdzą się w niezależnych testach. Opinia, bez mojego pomiaru.
- Flash - masowe, proste zadania z kontrolą faktów na wyjściu. Za 0,28 USD za milion tokenów wyjścia to jeden z najtańszych modeli na rynku.
- Nie do długich tekstów po polsku - Pro nie oddał tekstu, Flash zmyślał. Tu lepiej sprawdził się DeepSeek V4.1 Flash i GPT-6 Luna.
Najczęstsze pytania
Kiedy wyszedł Xiaomi MiMo-V2.6?
21 września 2026, w wersjach Pro i Flash, z otwartymi wagami na licencji MIT.
Ile kosztuje MiMo-V2.6 Pro?
0,435 USD za milion tokenów wejścia i 0,87 USD za milion wyjścia. Wersja UltraSpeed kosztuje 10 razy więcej.
Czy MiMo-V2.6 jest open source?
Tak - wagi Pro i Flash są na Hugging Face na licencji MIT. Xiaomi opublikowało też ponad 7000 środowisk do uczenia ze wzmocnieniem.
Czy MiMo-V2.6 Pro jest lepszy od Claude’a?
Nie. W indeksie Artificial Analysis ma 46 punktów wobec 51-58 u Claude Opus 5.5 na poziomach od medium do max. Jest za to kilkanaście razy tańszy i jest najmocniejszym otwartym modelem.
Czy MiMo pisze po polsku?
Flash tak, ale w moim teście z błędnymi danymi. Pro przez OpenRouter nie oddał dłuższego tekstu po polsku w żadnej z pięciu prób.
Źródła i data sprawdzenia
Parametry, architektura, licencja i tabela benchmarków - z kart modeli MiMo-V2.6-Pro-RL i MiMo-V2.6-Flash-RL na Hugging Face. Ceny Flash i pamięci podręcznej - ze strony modelu na mimo.mi.com, ceny Pro i UltraSpeed - z listy modeli OpenRoutera, zapowiedź przyspieszenia UltraSpeed - z relacji SiliconANGLE z 22 września. Indeks Artificial Analysis, stawka mieszana i prędkość - z rankingu Megaherc. Wyniki Claude Opus 5 w AutomationBench według OpenAI i Anthropic - z ich ogłoszeń z 22 września 2026. Liczba specjalistów ICT - Eurostat. Wszystko odczytane 24 września 2026. Wyniki w sekcji „Moje testy” to moje pomiary przez OpenRouter, koszt z pola rozliczeniowego odpowiedzi.
Cały tydzień w AI, w jednym mailu
Wybrane premiery, narzędzia i analizy. Raz w tygodniu, prosto do skrzynki.
Zapisz się za darmo →Najczęstsze pytania
Ile kosztuje MiMo-V2.6 Pro i czy jest tańszy od konkurencji?
MiMo-V2.6 Pro kosztuje 0,435 USD za milion tokenów wejścia i 0,87 USD za wyjście, co daje mieszaną stawkę 0,54 USD. Dla porównania GPT-6 Astra, który ma podobną liczbę punktów w rankingu, kosztuje 20 USD za milion tokenów.
Czy MiMo-V2.6 Pro można uruchomić lokalnie na domowym komputerze?
Nie - Pro i Flash w praktyce nie działają na domowym sprzęcie, bo przykładowa konfiguracja Pro wymaga dwóch serwerów z łącznie 16 akceleratorami. Na karcie RTX 4090 z 24 GB pamięci można uruchomić jedynie mały model MiMo-V2.6-Distill-Qwen-9B.
Czy benchmarki Xiaomi dla MiMo-V2.6 Pro można porównywać z wynikami innych firm?
Nie bezpośrednio - w AutomationBench v1.0.6 Xiaomi podaje dla Claude Opus 5 wynik 50,3%, podczas gdy OpenAI i Anthropic podają dla tego samego testu 26,9%, co jest prawie dwukrotnie mniej. Różnica wynika najpewniej z innego środowiska uruchomieniowego, którego Xiaomi nie opisuje.
Do jakich zadań nadaje się MiMo-V2.6 Flash?
Flash sprawdza się przy masowych, prostych zadaniach za 0,28 USD za milion tokenów wyjścia, ale wymaga kontroli faktów na wyjściu. W teście zmyślił prognozę przychodów na poziomie 51-52 mln zł i przypisał ją spółce, a przy tekście po polsku podał błędne dane dotyczące liczby specjalistów ICT.
