Przejdź do treści
Warsztat

Xiaomi MiMo-V2.6: najmocniejszy otwarty model AI - cena, benchmarki i mój test

Najmocniejszy otwarty model według Artificial Analysis. W krótkich zadaniach rzetelny, przy tekście po polsku myślał, aż skończył się limit.

7 min czytania
Xiaomi MiMo-V2.6: najmocniejszy otwarty model AI - cena, benchmarki i mój test

👁 121 przeczytań

// w skrócie
  • MiMo-V2.6 Pro jest najmocniejszym otwartym modelem AI z 46 punktami w indeksie Artificial Analysis, co kosztuje 0,435 USD za milion tokenów wejścia.
  • W pięciu próbach napisania 900 słów po polsku Pro za każdym razem zużył cały limit tokenów na myślenie (do 32 tys.) i nie oddał ani jednego słowa tekstu.
  • Flash napisał tekst po polsku za 0,0007 USD, ale podał błędne dane - według artykułu w ICT pracowało 744 tysiące osób (4,3%), a nie 450 tysięcy (2,5%), jak podał model.

21 września 2026 Xiaomi wypuściło MiMo-V2.6 Pro i MiMo-V2.6 Flash - dwa modele z otwartymi wagami na licencji MIT, które przyjmują tekst, obraz, wideo i dźwięk. W indeksie Artificial Analysis Pro ma 46 punktów, najwięcej ze wszystkich otwartych modeli, a kosztuje 0,435 dolara za milion tokenów wejścia. Na papierze to najlepsza okazja miesiąca. W moim teście po polsku wyszło coś, czego nie ma w żadnej tabeli.

Werdykt w jednym akapicie

MiMo-V2.6 Pro jest świetny w dyscyplinie danych i bezużyteczny do dłuższych tekstów po polsku - przynajmniej przez OpenRouter. W pułapce na zmyślanie liczb odmówił podania wszystkich czterech brakujących wartości, za 0,001 USD. Ale polecenie napisania 900 słów po polsku pięć razy z rzędu skończyło się tak samo: model myślał do końca limitu (9, 12 i 32 tysiące tokenów) i nie oddał ani słowa. Tańszy MiMo-V2.6 Flash tekst napisał, ale złamał zakaz waty i podał błędne dane o rynku pracy.

Trzy modele i jedna licencja

ParametrMiMo-V2.6 ProMiMo-V2.6 Flash
Parametry (łącznie / aktywne)1,02 bln / 42 mld309 mld / 15 mld
Kontekst1 mln tokenów, wyjście do 128 tys.
Wejścietekst, obraz, wideo, dźwięk; wyjście: tekst
LicencjaMIT - wagi na Hugging Face i ModelScope
Wejście / wyjście, za milion tokenów0,435 / 0,87 USD0,14 / 0,28 USD
Odczyt z pamięci podręcznej0,0036 USD0,0028 USD
Indeks Artificial Analysis46 - najwyżej wśród otwartych modeli-

Do tego MiMo-V2.6 Pro UltraSpeed - ten sam model w szybszym podaniu, według Xiaomi do 20 razy szybszy przy tej samej jakości, ale 10 razy droższy: 4,35 i 8,70 USD. I MiMo-V2.6-Distill-Qwen-9B - mały model dotrenowany na danych z MiMo, jedyny z rodziny, który uruchomisz na domowej karcie graficznej. Ceny Pro i Flash są takie same jak w poprzedniej wersji V2.5.

Gdzie MiMo stoi w rankingu

W rankingu Megaherc, który liczymy z danych Artificial Analysis, MiMo-V2.6 Pro ma 46 punktów - tyle co GPT-6 Astra na niskim poziomie rozumowania i punkt więcej niż Qwen3.8 Max. Różnica w cenie jest ogromna: mieszana stawka MiMo to 0,54 USD, Astry 20 USD za milion tokenów. Model jest za to wolny: około 39 tokenów na sekundę.

Do czołówki zamkniętych modeli wciąż sporo brakuje: Claude Opus 5.5 ma od 51 (poziom medium) do 58 punktów (max), GPT-6 Sol na max - 48.

Benchmarki Xiaomi - i rozbieżność, której nie da się pominąć

TestMiMo-V2.6 ProMiMo-V2.6 FlashClaude Opus 5GPT-5.6 Sol
DeepSWE v1.171,967,974,073,0
AutomationBench v1.0.653,152,350,345,8
Agents’ Last Exam31,627,631,630,8
Terminal Bench 2.189,987,689,188,8
Terminal Bench 4.034,928,849,039,9
GDPval-AA 2.11673-17081588
OSWorld-Verified82,080,883,483,0
ExploitBench47,925,370,078,5

Xiaomi mówi, że Pro dorównuje Claude Opus 5 i GPT-5.6 Sol w większości testów agentowych - i tabela to częściowo potwierdza. Ale jeden wiersz się nie zgadza z niczym. W AutomationBench v1.0.6 Xiaomi podaje dla Claude Opus 5 wynik 50,3%. OpenAI i Anthropic podają dla tego samego testu 26,9%. To prawie dwa razy mniej. Podobnie w Terminal Bench 4.0: Xiaomi daje Opus 5 wynik 49,0, Anthropic - 52,3.

To jest moja interpretacja: różnica wynika najpewniej z innego środowiska uruchomieniowego, którego Xiaomi nie opisuje. Wniosek praktyczny: wyniki z tej tabeli porównuj tylko między kolumnami tej samej tabeli, nie z liczbami z ogłoszeń innych firm. W najtrudniejszym teście, Terminal Bench 4.0, Pro wyraźnie odstaje - 34,9 wobec 49,0 u Opus 5 w pomiarze samego Xiaomi.

Moje testy

Te same trzy zadania, które przeszły Claude Opus 5.5 i GPT-6. OpenRouter, ustawienia domyślne.

ZadanieMiMo-V2.6 ProMiMo-V2.6 Flash
Tekst po polsku, 900 słówbrak tekstu - 5 prób, cały limit na myślenie, łącznie 0,062 USD817 słów, 1 zakazana fraza, błędne dane, 0,0007 USD, 69 s
Pułapka na zmyślanie liczb4 z 4 odmów, 0,0010 USD, 37 swymyślona prognoza, 0,0003 USD, 30 s
Zagadka z 13 warunkamipoprawnie, 0,0015 USD, 43 spoprawnie, 0,0007 USD, 142 s

Pro: model, który nie może skończyć myśleć

Przy poleceniu napisania 900 słów po polsku Pro zużył cały limit tokenów na myślenie - 9 tysięcy, potem 32 tysiące, potem 12 tysięcy z ustawionym niskim poziomem rozumowania. Za każdym z pięciu razy odpowiedź była pusta. Zajrzałem w jego tok myślenia: model pisał cały tekst w myślach, akapit po akapicie, i zanim doszedł do właściwej odpowiedzi, limit się kończył. Najdłuższa próba trwała 11 minut.

Sprawdziłem, czy winne jest polecenie - zamieniłem „ani jednego słowa bez ogonków” na „nie pomijaj polskich znaków”. Wynik ten sam. To samo zachowanie miały Qwen3.8 Max Prime i GLM-5.3 Prime, ale im pomogło obniżenie poziomu rozumowania. MiMo Pro przez OpenRouter nie zareagował na to ustawienie.

W krótkich zadaniach Pro wypadł za to bardzo dobrze. W pułapce na zmyślanie - analizie dla zarządu, która żąda liczb nieobecnych w notatce - nie podał żadnej z czterech, nawet prognozy w formie scenariusza, co zrobiły GPT-6 Sol i DeepSeek. Tak samo zachował się Claude Opus 5.5.

Flash: tani i nieostrożny

Nie przepłacaj za te subskrypcje

Prowadzę sklep z rocznymi dostępami do narzędzi AI - te same konta, o których piszę wyżej, tylko taniej niż w cenniku producenta.

Zobacz, co jest dostępne

Flash napisał tekst, ale z trzema problemami:

  • Złamał zakaz waty zdaniem „”. Jedyny model w tym teście, który użył zakazanej frazy.
  • Podał błędne dane: „według raportu Komisji Europejskiej z 2023 roku” w ICT miało pracować około 450 tysięcy osób, czyli ponad 2,5% zatrudnionych. Według Eurostatu było to 744 tysiące, czyli 4,3%.
  • Wstawił angielskie słowo w polską odmianę - „firmach productowych”.

W pułapce na zmyślanie było gorzej. Flash napisał: „bazową prognozę przychodów na IV kwartał 2026 szacujemy na poziomie 51-52 mln zł” - jako prognozę spółki, z dopiskiem jedynie, że wartość „będzie podlegać korekcie”. Inne modele wprost pisały, że to nie jest prognoza. A całą sekcję o zysku zaczął od „Z upoważnieniem Zarządu informuję”, choć nikt go do niczego nie upoważniał.

Czy da się uruchomić MiMo-V2.6 lokalnie?

Pro i Flash - w praktyce nie na domowym komputerze. Przykładowa konfiguracja z karty modelu dla Pro to dwa serwery z łącznie 16 akceleratorami, a Flash ma 309 mld parametrów. Na jednej karcie typu RTX 4090 z 24 GB pamięci uruchomisz najwyżejj MiMo-V2.6-Distill-Qwen-9B. To jest opinia: otwarte wagi Pro mają znaczenie dla firm i dostawców, którzy postawią go u siebie, a nie dla użytkownika domowego.

Do czego użyć MiMo-V2.6

  • Pro - krótkie zadania na danych: analizy, ekstrakcja, klasyfikacja. Tam jest tani i rzetelny.
  • Pro - agenci programistyczni, jeśli wyniki Xiaomi potwierdzą się w niezależnych testach. Opinia, bez mojego pomiaru.
  • Flash - masowe, proste zadania z kontrolą faktów na wyjściu. Za 0,28 USD za milion tokenów wyjścia to jeden z najtańszych modeli na rynku.
  • Nie do długich tekstów po polsku - Pro nie oddał tekstu, Flash zmyślał. Tu lepiej sprawdził się DeepSeek V4.1 Flash i GPT-6 Luna.

Najczęstsze pytania

Kiedy wyszedł Xiaomi MiMo-V2.6?

21 września 2026, w wersjach Pro i Flash, z otwartymi wagami na licencji MIT.

Ile kosztuje MiMo-V2.6 Pro?

0,435 USD za milion tokenów wejścia i 0,87 USD za milion wyjścia. Wersja UltraSpeed kosztuje 10 razy więcej.

Czy MiMo-V2.6 jest open source?

Tak - wagi Pro i Flash są na Hugging Face na licencji MIT. Xiaomi opublikowało też ponad 7000 środowisk do uczenia ze wzmocnieniem.

Czy MiMo-V2.6 Pro jest lepszy od Claude’a?

Nie. W indeksie Artificial Analysis ma 46 punktów wobec 51-58 u Claude Opus 5.5 na poziomach od medium do max. Jest za to kilkanaście razy tańszy i jest najmocniejszym otwartym modelem.

Czy MiMo pisze po polsku?

Flash tak, ale w moim teście z błędnymi danymi. Pro przez OpenRouter nie oddał dłuższego tekstu po polsku w żadnej z pięciu prób.

Google · Twoje źródłaPromptowy wyżej w Twoim Google - jednym kliknięciemDodaj do preferowanych źródeł

Źródła i data sprawdzenia

Parametry, architektura, licencja i tabela benchmarków - z kart modeli MiMo-V2.6-Pro-RL i MiMo-V2.6-Flash-RL na Hugging Face. Ceny Flash i pamięci podręcznej - ze strony modelu na mimo.mi.com, ceny Pro i UltraSpeed - z listy modeli OpenRoutera, zapowiedź przyspieszenia UltraSpeed - z relacji SiliconANGLE z 22 września. Indeks Artificial Analysis, stawka mieszana i prędkość - z rankingu Megaherc. Wyniki Claude Opus 5 w AutomationBench według OpenAI i Anthropic - z ich ogłoszeń z 22 września 2026. Liczba specjalistów ICT - Eurostat. Wszystko odczytane 24 września 2026. Wyniki w sekcji „Moje testy” to moje pomiary przez OpenRouter, koszt z pola rozliczeniowego odpowiedzi.

// Newsletter

Cały tydzień w AI, w jednym mailu

Wybrane premiery, narzędzia i analizy. Raz w tygodniu, prosto do skrzynki.

Zapisz się za darmo →
Za darmo. Wypisujesz się jednym kliknięciem.

Najczęstsze pytania

Ile kosztuje MiMo-V2.6 Pro i czy jest tańszy od konkurencji?

MiMo-V2.6 Pro kosztuje 0,435 USD za milion tokenów wejścia i 0,87 USD za wyjście, co daje mieszaną stawkę 0,54 USD. Dla porównania GPT-6 Astra, który ma podobną liczbę punktów w rankingu, kosztuje 20 USD za milion tokenów.

Czy MiMo-V2.6 Pro można uruchomić lokalnie na domowym komputerze?

Nie - Pro i Flash w praktyce nie działają na domowym sprzęcie, bo przykładowa konfiguracja Pro wymaga dwóch serwerów z łącznie 16 akceleratorami. Na karcie RTX 4090 z 24 GB pamięci można uruchomić jedynie mały model MiMo-V2.6-Distill-Qwen-9B.

Czy benchmarki Xiaomi dla MiMo-V2.6 Pro można porównywać z wynikami innych firm?

Nie bezpośrednio - w AutomationBench v1.0.6 Xiaomi podaje dla Claude Opus 5 wynik 50,3%, podczas gdy OpenAI i Anthropic podają dla tego samego testu 26,9%, co jest prawie dwukrotnie mniej. Różnica wynika najpewniej z innego środowiska uruchomieniowego, którego Xiaomi nie opisuje.

Do jakich zadań nadaje się MiMo-V2.6 Flash?

Flash sprawdza się przy masowych, prostych zadaniach za 0,28 USD za milion tokenów wyjścia, ale wymaga kontroli faktów na wyjściu. W teście zmyślił prognozę przychodów na poziomie 51-52 mln zł i przypisał ją spółce, a przy tekście po polsku podał błędne dane dotyczące liczby specjalistów ICT.

// czytaj też

Podobne tematy na Promptowym

Piotr Olszewski

Piotr Olszewski

ADMINISTRATOR

Piotr Olszewski - twórca i autor Promptowego, polskiego serwisu o sztucznej inteligencji. Codziennie śledzi premiery modeli, narzędzia i regulacje AI, i tłumaczy je prostym, konkretnym językiem.

// mapa strony

🛒 Sklep Kinetyka Google AI Gemini Pro 170 zł CapCut Pro 460 zł/rok n8n Cloud Starter 320 zł/rok Zobacz wszystko →
promptowy w liczbach 0tekstów w archiwum0newsów z ostatnich 7 dni0modeli wideo w obserwatorium0zagadek w grach
× powiększenie