Przejdź do treści
// Ranking modeli AI

Ranking modeli AI

Ranking AI porównuje modele językowe według wyniku Artificial Analysis Intelligence Index, ceny API i szybkości. Obejmuje 25 wierszy z Megaherca; datę źródła znajdziesz pod opisem. Wybierz nagłówek tabeli, aby zmienić kolejność.

Trzy stopnie podium i wyróżniony model
stan: 11.09.2026 - dane z Megaherca (Artificial Analysis API v2)
#
1 Claude Fable 5.1 (max) AnthropicAnthropic532069131.81M
2 Claude Fable 5.1 (high) AnthropicAnthropic53206144.51M
3 GPT-6 Astra OpenAIOpenAI532056241.11M
4 GPT-6 Astra (xhigh) OpenAIOpenAI53205399.21M
5 Claude Fable 5.1 (high) AnthropicAnthropic51205310.71M
6 GPT-6 Astra (high) OpenAIOpenAI51205338.51M
7 Claude Opus 5 (max) AnthropicAnthropic51105833.71M
8 GPT-6 Astra (medium) OpenAIOpenAI5020497.11M
9 Claude Fable 5 AnthropicAnthropic50206957.81M
10 Claude Opus 5 (high) AnthropicAnthropic50105524.61M
11 Claude Fable 5.1 (medium) AnthropicAnthropic49205571M
12 Muse Spark 1.3 OW MetaMeta48245528.7262k
13 Claude Opus 5 (high) AnthropicAnthropic48105417.11M
14 GPT-5.6 Sol OpenAIOpenAI4787278.51.05M
15 Claude Fable 5.1 (low) AnthropicAnthropic47205161M
16 GPT-6 Astra (low) OpenAIOpenAI4620491.91M
17 Muse Spark 1.3 (xhigh) OW MetaMeta45232328.1262k
18 Claude Opus 5 (medium) AnthropicAnthropic4510518.71M
19 GLM-5.3 OW Z AIZ AI452.15533-
20 Grok 4.6 (high) SpaceXAISpaceXAI4436837.4500k
21 Grok 4.6 (xhigh) SpaceXAISpaceXAI4436644.3500k
22 GPT-5.6 Sol (xhigh) OpenAIOpenAI4487233.11.05M
23 Kimi K3 OW KimiKimi446372.61M
24 Grok 4.6 (medium) SpaceXAISpaceXAI4336527.3500k
25 GPT-5.6 Sol (high) OpenAIOpenAI4386812.91.05M

Przewiń tabelę w bok, żeby zobaczyć szybkość i kontekst.

Szybkie wnioski

Najwyższy indeks w tabeli Claude Fable 5.1 (max)

Indeks inteligencji 53 - najwyżej w zestawieniu.

Najniższa cena przy indeksie co najmniej 50 Claude Opus 5 (max)

Cena porównawcza $10 za 1M tokenów, przy proporcji wejścia do wyjścia 3:1. Wynik dotyczy modeli z tej tabeli.

Najwyższa szybkość w tabeli Muse Spark 1.3

455 tokenów na sekundę - najwyższa przepustowość.

Najwyższy indeks wśród otwartych wag Muse Spark 1.3

Model z otwartymi wagami z najwyższym indeksem (48). Lokalna praca wymaga sprawdzenia licencji, pamięci i obsługi konkretnego wariantu.

Wnioski wynikają wyłącznie z widocznych 25 wierszy. Próg 50 punktów jest przyjętą regułą wyboru, a nie granicą potwierdzonej jakości. Identyczne nazwy mogą występować w źródle więcej niż raz; tabela nie identyfikuje ich konfiguracji.

Wynik rankingu nie zastępuje sprawdzenia własnego zadania

Indeks Artificial Analysis łączy wyniki różnych ocen. Nie jest pomiarem ludzkiego IQ ani osobnym testem polszczyzny. Ma też kolejne wersje, dlatego porównanie z dawnym zrzutem wymaga sprawdzenia metodologii. Tabela pokazuje zaokrąglone wartości ze źródła, więc równe liczby nie dowodzą identycznych wyników pomiaru.

Własne próby Promptowego opisuję oddzielnie w dziale benchmarki. Przykładem jest porównanie ustawień wysokiego i ultra w GPT-6 Astra. Odróżniaj wynik konkretnego zestawu zadań od rankingu całego rynku.

Cena w tabeli zakłada trzy tokeny wejścia na jeden wyjścia

Odczytany mechanizm Megaherca korzysta z pola price_1m_blended_3_to_1 API Artificial Analysis. Jest to średnia ceny wejścia i wyjścia w proporcji 3:1, a nie stawka za dowolny milion tokenów ani abonament czatu. Dokumentacja API rozróżnia tę wartość od innych sposobów liczenia ceny, w tym wariantu uwzględniającego pamięć podręczną.

Własny przykład rachunkowy: przy wejściu za 2 USD i wyjściu za 8 USD za milion tokenów wskaźnik wyniesie 3,50 USD. Gdy połowa użycia to wejście, a połowa wyjście, koszt miliona wyniesie już 5 USD. To scenariusz z podanymi założeniami, nie cennik konkretnego modelu. Rzeczywistą kwotę obliczaj według zużycia, pamięci podręcznej, narzędzi i warunków dostawcy. Porównanie aplikacji i API znajdziesz w przewodniku po modelach AI.

Szybkie generowanie nie oznacza krótkiego oczekiwania na odpowiedź

Szybkość opisuje tempo generowania tokenów. Kolumna „Pierwszy token” pokazuje czas rozpoczęcia strumienia w pomiarze źródłowym. W modelach rozumujących może chodzić o pierwszy token rozumowania, więc nie utożsamiam tego z pierwszym fragmentem odpowiedzi widocznym dla człowieka. Szczegóły pomiaru opisuje metodologia Artificial Analysis.

Kontekst to rozmiar okna modelu w tokenach, nie gwarantowana liczba słów dokumentu. Tokenizacja zależy od modelu i języka, a część okna może być potrzebna na instrukcje i odpowiedź. Oznaczenie OW dotyczy otwartych wag. Nie potwierdza, że model zmieści się na Twoim komputerze ani że wszystkie zastosowania są dozwolone jego licencją.

Wybierz dwa modele i porównaj koszt poprawnego wyniku

Ustal jeden cel, ten sam materiał wejściowy i warunek akceptacji. Daj zadanie dwóm modelom, zapisz czas do gotowego wyniku, koszt i poprawki. Dopiero potem wybierz tańszą lub szybszą opcję. Przy pracy lokalnej sprawdź najpierw wymagania sprzętowe, na przykład w poradniku uruchomienia gpt-oss-20b. Ten ranking nie obejmuje cen urządzeń, jakości obsługi aplikacji ani prywatności całego procesu.

Dane: Megaherc / Artificial Analysis. Pełny ranking z wykresami i historią zmian: megaherc.pl.

// mapa strony
🛒 Sklep Kinetyka Google AI Gemini Pro 170 zł CapCut Pro 460 zł/rok Lovable Pro 336 zł/rok Zobacz wszystko →
promptowy w liczbach 0tekstów w archiwum0newsów z ostatnich 7 dni0modeli wideo w obserwatorium0zagadek w grach
× powiększenie