Ranking modeli AI
Ranking AI porównuje modele językowe według wyniku Artificial Analysis Intelligence Index, ceny API i szybkości. Obejmuje 25 wierszy z Megaherca; datę źródła znajdziesz pod opisem. Wybierz nagłówek tabeli, aby zmienić kolejność.
| # | |||||||
|---|---|---|---|---|---|---|---|
| 1 | Claude Fable 5.1 (max) Anthropic | Anthropic | 57 | 20 | 68 | 161 | 1M |
| 2 | Claude Fable 5.1 (high) Anthropic | Anthropic | 56 | 20 | 57 | 32.6 | 1M |
| 3 | GPT-6 Astra OpenAI | OpenAI | 55 | 20 | 63 | 198.5 | 1M |
| 4 | Claude Fable 5.1 (high) Anthropic | Anthropic | 55 | 20 | 54 | 10.4 | 1M |
| 5 | GPT-6 Astra (xhigh) OpenAI | OpenAI | 54 | 20 | 57 | 68.5 | 1M |
| 6 | Claude Opus 5 (max) Anthropic | Anthropic | 54 | 10 | 52 | 38.2 | 1M |
| 7 | GPT-6 Astra (high) OpenAI | OpenAI | 53 | 20 | 57 | 24.6 | 1M |
| 8 | Claude Opus 5 (high) Anthropic | Anthropic | 53 | 10 | 53 | 20.7 | 1M |
| 9 | Claude Fable 5 Anthropic | Anthropic | 53 | 20 | 62 | 51 | 1M |
| 10 | Muse Spark 1.3 OW Meta | Meta | 53 | 2 | 221 | 21.3 | 262k |
| 11 | Claude Fable 5.1 (medium) Anthropic | Anthropic | 53 | 20 | 53 | 7.9 | 1M |
| 12 | GPT-6 Astra (medium) OpenAI | OpenAI | 52 | 20 | 58 | 4.2 | 1M |
| 13 | Claude Opus 5 (high) Anthropic | Anthropic | 52 | 10 | 50 | 12.2 | 1M |
| 14 | Muse Spark 1.3 (xhigh) OW Meta | Meta | 52 | 2 | 187 | 25.8 | 262k |
| 15 | GPT-5.6 Sol OpenAI | OpenAI | 51 | 8 | 73 | 46.1 | 1.05M |
| 16 | Claude Fable 5.1 (low) Anthropic | Anthropic | 51 | 20 | 51 | 4.3 | 1M |
| 17 | Grok 4.6 (high) SpaceXAI | SpaceXAI | 51 | 3 | 57 | 36.4 | 500k |
| 18 | Kimi K3 OW Kimi | Kimi | 50 | 6 | 42 | 2.8 | 1M |
| 19 | Grok 4.6 (xhigh) SpaceXAI | SpaceXAI | 50 | 3 | 60 | 30.7 | 500k |
| 20 | GPT-5.6 Sol (xhigh) OpenAI | OpenAI | 50 | 8 | 80 | 22.6 | 1.05M |
| 21 | Claude Opus 5 (medium) Anthropic | Anthropic | 50 | 10 | 51 | 8 | 1M |
| 22 | GPT-6 Astra (low) OpenAI | OpenAI | 49 | 20 | 59 | 1.8 | 1M |
| 23 | Grok 4.6 (medium) SpaceXAI | SpaceXAI | 49 | 3 | 53 | 28.2 | 500k |
| 24 | GLM-5.3 OW Z AI | Z AI | 49 | 2.15 | 75 | 1.4 | - |
| 25 | GPT-5.6 Sol (high) OpenAI | OpenAI | 48 | 8 | 76 | 11.6 | 1.05M |
Przewiń tabelę w bok, żeby zobaczyć szybkość i kontekst.
Szybkie wnioski
Indeks inteligencji 57 - najwyżej w zestawieniu.
Cena porównawcza $2 za 1M tokenów, przy proporcji wejścia do wyjścia 3:1. Wynik dotyczy modeli z tej tabeli.
221 tokenów na sekundę - najwyższa przepustowość.
Model z otwartymi wagami z najwyższym indeksem (53). Lokalna praca wymaga sprawdzenia licencji, pamięci i obsługi konkretnego wariantu.
Wnioski wynikają wyłącznie z widocznych 25 wierszy. Próg 50 punktów jest przyjętą regułą wyboru, a nie granicą potwierdzonej jakości. Identyczne nazwy mogą występować w źródle więcej niż raz; tabela nie identyfikuje ich konfiguracji.
Wynik rankingu nie zastępuje sprawdzenia własnego zadania
Indeks Artificial Analysis łączy wyniki różnych ocen. Nie jest pomiarem ludzkiego IQ ani osobnym testem polszczyzny. Ma też kolejne wersje, dlatego porównanie z dawnym zrzutem wymaga sprawdzenia metodologii. Tabela pokazuje zaokrąglone wartości ze źródła, więc równe liczby nie dowodzą identycznych wyników pomiaru.
Własne próby Promptowego opisuję oddzielnie w dziale benchmarki. Przykładem jest porównanie ustawień wysokiego i ultra w GPT-6 Astra. Odróżniaj wynik konkretnego zestawu zadań od rankingu całego rynku.
Cena w tabeli zakłada trzy tokeny wejścia na jeden wyjścia
Odczytany mechanizm Megaherca korzysta z pola price_1m_blended_3_to_1 API Artificial Analysis. Jest to średnia ceny wejścia i wyjścia w proporcji 3:1, a nie stawka za dowolny milion tokenów ani abonament czatu. Dokumentacja API rozróżnia tę wartość od innych sposobów liczenia ceny, w tym wariantu uwzględniającego pamięć podręczną.
Własny przykład rachunkowy: przy wejściu za 2 USD i wyjściu za 8 USD za milion tokenów wskaźnik wyniesie 3,50 USD. Gdy połowa użycia to wejście, a połowa wyjście, koszt miliona wyniesie już 5 USD. To scenariusz z podanymi założeniami, nie cennik konkretnego modelu. Rzeczywistą kwotę obliczaj według zużycia, pamięci podręcznej, narzędzi i warunków dostawcy. Porównanie aplikacji i API znajdziesz w przewodniku po modelach AI.
Szybkie generowanie nie oznacza krótkiego oczekiwania na odpowiedź
Szybkość opisuje tempo generowania tokenów. Kolumna „Pierwszy token” pokazuje czas rozpoczęcia strumienia w pomiarze źródłowym. W modelach rozumujących może chodzić o pierwszy token rozumowania, więc nie utożsamiam tego z pierwszym fragmentem odpowiedzi widocznym dla człowieka. Szczegóły pomiaru opisuje metodologia Artificial Analysis.
Kontekst to rozmiar okna modelu w tokenach, nie gwarantowana liczba słów dokumentu. Tokenizacja zależy od modelu i języka, a część okna może być potrzebna na instrukcje i odpowiedź. Oznaczenie OW dotyczy otwartych wag. Nie potwierdza, że model zmieści się na Twoim komputerze ani że wszystkie zastosowania są dozwolone jego licencją.
Wybierz dwa modele i porównaj koszt poprawnego wyniku
Ustal jeden cel, ten sam materiał wejściowy i warunek akceptacji. Daj zadanie dwóm modelom, zapisz czas do gotowego wyniku, koszt i poprawki. Dopiero potem wybierz tańszą lub szybszą opcję. Przy pracy lokalnej sprawdź najpierw wymagania sprzętowe, na przykład w poradniku uruchomienia gpt-oss-20b. Ten ranking nie obejmuje cen urządzeń, jakości obsługi aplikacji ani prywatności całego procesu.
Dane: Megaherc / Artificial Analysis. Pełny ranking z wykresami i historią zmian: megaherc.pl.