-10% na wszystko w kinetyka.pldo 30.09, 23:59•PIZZASZWECJA• plany AI: Cursor, Gemini, Higgsfield w ułamku ceny Odbierz rabatkinetyka.pl →
Przejdź do treści
Artykuły

OpenAI Ultrafast: 300 tokenów/s, cennik i modele

Ultrafast przyspiesza GPT-6 Astra do 300 tokenów/s, ale w API kosztuje 6 razy więcej. Które modele, ile to złotych i kiedy dopłata się zwraca.

6 min czytania
OpenAI Ultrafast: 300 tokenów/s, cennik i modele

👁 120 przeczytań

OpenAI Ultrafast to nowy, najszybszy i najdroższy tryb pracy modeli OpenAI, ogłoszony na DevDay 29 września 2026. W Codex generuje do 300 tokenów na sekundę, według OpenAI do 8 razy szybciej niż zwykle, a w API do 6 razy szybciej. Na razie działa z GPT-6 Astra, a w API kosztuje sześć razy więcej niż tryb standardowy. Sprawdziłem cennik i dokumentację i policzyłem, kiedy ta dopłata ma sens.

W skrócie

Ultrafast to płatny poziom szybkości, nie nowy model. Dziś działa z GPT-6 Astra: w API dla wszystkich (z niskimi limitami), a w Codex i ChatGPT Work tylko w planie Pro 500 i w części planów Enterprise i Edu. W API kosztuje 60 USD za milion tokenów wejścia i 300 USD za milion tokenów wyjścia (231,42 zł i 1157,10 zł bez VAT). W Codex zużywa limit planu 8 razy szybciej. GPT-6.1 Sol w wersji Ultrafast ma przyjść w najbliższych dniach. Tryb nie obsługuje przetwarzania danych w UE, co w części polskich firm go wyklucza.

300tokenów na sekundę w Codex (GPT-6 Astra)
6xcena API wobec trybu standardowego
8xszybsze zużycie limitu w Codex i ChatGPT Work
0regionów przetwarzania w UE

Resztę nowości z konferencji opisuję w relacji z DevDay 2026.

Co to jest Ultrafast

Poza trybem wsadowym Batch OpenAI ma dziś w API cztery poziomy przetwarzania: tańszy i wolniejszy Flex (połowa ceny), Standard, Fast (do 30 lipca 2026 nazywany Priority, podwójna cena) i nowy Ultrafast. Różnią się szybkością generowania i ceną, model zostaje ten sam. Ultrafast OpenAI opisuje jako „poziom premium dla zadań, w których szybkość liczy się najbardziej”.

Tryb zadebiutował 13 sierpnia 2026 jako ograniczony podgląd dla GPT-5.6 Sol. Wtedy OpenAI mówiło o prędkości do 750 tokenów na sekundę i 14-krotnym przyspieszeniu na sprzęcie firmy Cerebras. Na DevDay tryb wszedł szerzej, ale z GPT-6 Astra, czyli większym modelem, i z niższą prędkością.

Jak szybki jest naprawdę

Źródła podają różne liczby, więc zestawiam je obok siebie:

  • podsumowanie DevDay: do 8 razy szybciej (300 tokenów/s) w Codex i do 6 razy w API,
  • dokumentacja API: „do 8 razy szybciej niż tryb Standard”,
  • Dan Shipper z Every, który widział pokazy przed premierą: 250 tokenów/s.

Z liczb OpenAI wynika, że standardowa Astra w Codex generuje około 37,5 tokenu na sekundę (300 podzielone przez 8). OpenAI zaznacza, że porównuje tylko prędkość generowania, a nie czas ukończenia całego zadania. W API zaleca połączenie WebSocket, bo bez stałego połączenia opóźnienia sieci zjadają część zysku, zwłaszcza przy wielu wywołaniach narzędzi.

Trybu Ultrafast sam nie testowałem: na OpenRouterze go nie ma, a bezpośredniego konta API OpenAI do tego testu nie używałem. Dla porównania: w moim teście GPT-6.1 Sol w trybie standardowym przez OpenRouter wypisywał około 58 tokenów na sekundę, licząc z opóźnieniem sieci.

Które modele i gdzie

ModelUltrafast w APIUltrafast w Codex i ChatGPT Work
GPT-6 Astratak, dla wszystkich, niskie limityPro 500, wybrane plany Enterprise i Edu
GPT-6.1 Solzapowiedzianyzapowiedziany, do 8x szybciej
GPT-5.6 Solograniczony podgląd dla wybranych firmnie
GPT-6 Sol, GPT-6 Lunanie, tylko Fastnie, tylko Fast

W Codex inne plany osobiste (Plus, Pro 100, Pro 200) nie mają dostępu do Ultrafast nawet po dokupieniu kredytów. W Enterprise tryb jest domyślnie wyłączony i włącza go właściciel przestrzeni roboczej. Szczegóły planu z Ultrafast opisałem w tekście o ChatGPT Pro 500.

Ile kosztuje Ultrafast w API

Stawki z cennika API OpenAI z 29.09.2026, za milion tokenów, dla zapytań do 272 000 tokenów wejścia. Przeliczenie po kursie 3,857 zł/USD, bez VAT.

GPT-6 AstraWejściePamięć podręcznaWyjście
Flex5 USD (19,29 zł)0,50 USD (1,93 zł)25 USD (96,43 zł)
Standard10 USD (38,57 zł)1 USD (3,86 zł)50 USD (192,85 zł)
Fast20 USD (77,14 zł)2 USD (7,71 zł)100 USD (385,70 zł)
Ultrafast60 USD (231,42 zł)6 USD (23,14 zł)300 USD (1157,10 zł)

Powyżej 272 000 tokenów wejścia Ultrafast kosztuje 120 USD za wejście i 450 USD za wyjście (462,84 zł i 1735,65 zł). Domyślne limity dla Astry w Ultrafast to 500 000 tokenów na minutę na poziomach konta 1-3, milion na poziomie 4 i 5 milionów na poziomie 5. Tryb włącza się parametrem service_tier="ultrafast".

Ważne dla firm w Polsce: Ultrafast działa tylko z przetwarzaniem w USA albo globalnym. Nie obsługuje regionalnych punktów dostępowych w UE, a w ChatGPT nie jest dostępny dla przestrzeni roboczych, które wymagają przetwarzania poza USA.

Ile kosztuje w Codex i ChatGPT Work

W abonamencie nie płacisz za tokeny, tylko zużywasz limit. Dokumentacja Codex podaje mnożniki względem trybu standardowego:

TrybZużycie limitu planuZużycie kupionych kredytów
Fast2,5x2x
Ultrafast (GPT-6 Astra)8x6x

W Pro 500 Ultrafast najpierw zużywa limit planu, a po jego wyczerpaniu kredyty. Przy samym Ultrafast 25-krotność limitu Plus wystarcza na tyle, co około trzy limity Plus w trybie standardowym.

Kiedy Ultrafast się opłaca

Policzyłem przykładowe zadanie agenta w API: 50 000 nowych tokenów wejścia, 150 000 tokenów z pamięci podręcznej i 20 000 tokenów odpowiedzi na GPT-6 Astra. To mój przykład, nie pomiar.

  • Standard: 0,50 + 0,15 + 1,00 = 1,65 USD (6,36 zł). Przy 37,5 tokenu/s samo generowanie trwa około 9 minut.
  • Ultrafast: 9,90 USD (38,18 zł). Przy 300 tokenach/s generowanie trwa około 67 sekund.

Oszczędzasz około 8 minut za 31,82 zł. Jeśli godzina twojej pracy kosztuje 150 zł, 8 minut czekania jest warte 20 zł, więc na pojedynczym zadaniu dopłata się nie zwraca. Zwraca się tam, gdzie czekanie blokuje więcej osób albo pieniądze: awaria na produkcji, obsługa klienta na żywo, praca w pętli „zmień i sprawdź” z wieloma krótkimi krokami. W sierpniowej zapowiedzi Ultrafast OpenAI podawało podobne przykłady: reagowanie na awarie, analizę transakcji i obsługę klienta. To moja opinia.

Jeśli zależy ci głównie na koszcie, GPT-6.1 Sol w trybie standardowym kosztuje 2 i 10 USD za milion tokenów, czyli 30 razy mniej niż Astra w Ultrafast, a według OpenAI w części zadań zbliża się do Astry. Gdy Sol dostanie własny Ultrafast, może to być najrozsądniejszy wybór dla szybkich agentów. Ceny tej wersji OpenAI jeszcze nie podało.

Najczęstsze pytania

Nie przepłacaj za te subskrypcje

Prowadzę sklep z rocznymi dostępami do narzędzi AI - te same konta, o których piszę wyżej, tylko taniej niż w cenniku producenta.

Zobacz, co jest dostępne

Ile tokenów na sekundę daje OpenAI Ultrafast?

Według OpenAI do 300 tokenów na sekundę w Codex z GPT-6 Astra, czyli do 8 razy szybciej niż standardowo. W API do 6 razy szybciej.

Ile kosztuje Ultrafast w API?

Dla GPT-6 Astra 60 USD za milion tokenów wejścia i 300 USD za milion tokenów wyjścia, sześć razy więcej niż w trybie standardowym.

Które modele obsługują Ultrafast?

Dziś GPT-6 Astra. GPT-6.1 Sol dostanie go w najbliższych dniach, a GPT-5.6 Sol jest w ograniczonym podglądzie dla wybranych firm.

Czy Ultrafast jest w planie Plus?

Nie. Z planów osobistych ma go tylko Pro 500. Kupno kredytów w Plus, Pro 100 czy Pro 200 go nie odblokowuje.

// Newsletter

Cały tydzień w AI, w jednym mailu

Wybrane premiery, narzędzia i analizy. Raz w tygodniu, prosto do skrzynki.

Zapisz się za darmo →
Za darmo. Wypisujesz się jednym kliknięciem.
// czytaj też

Podobne tematy na Promptowym

Piotr Olszewski

Piotr Olszewski

ADMINISTRATOR

Piotr Olszewski - twórca i autor Promptowego, polskiego serwisu o sztucznej inteligencji. Codziennie śledzi premiery modeli, narzędzia i regulacje AI, i tłumaczy je prostym, konkretnym językiem.

// mapa strony

🛒 Sklep Kinetyka Google AI Gemini Pro 170 zł CapCut Pro 460 zł/rok Cursor Pro+ 99 zł/mc Zobacz wszystko →
promptowy w liczbach 0tekstów w archiwum0newsów z ostatnich 7 dni0modeli wideo w obserwatorium0zagadek w grach
× ‹ powiększenie ›