OpenAI Ultrafast: 300 tokenów/s, cennik i modele
Ultrafast przyspiesza GPT-6 Astra do 300 tokenów/s, ale w API kosztuje 6 razy więcej. Które modele, ile to złotych i kiedy dopłata się zwraca.

👁 120 przeczytań
OpenAI Ultrafast to nowy, najszybszy i najdroższy tryb pracy modeli OpenAI, ogłoszony na DevDay 29 września 2026. W Codex generuje do 300 tokenów na sekundę, według OpenAI do 8 razy szybciej niż zwykle, a w API do 6 razy szybciej. Na razie działa z GPT-6 Astra, a w API kosztuje sześć razy więcej niż tryb standardowy. Sprawdziłem cennik i dokumentację i policzyłem, kiedy ta dopłata ma sens.
W skrócie
Ultrafast to płatny poziom szybkości, nie nowy model. Dziś działa z GPT-6 Astra: w API dla wszystkich (z niskimi limitami), a w Codex i ChatGPT Work tylko w planie Pro 500 i w części planów Enterprise i Edu. W API kosztuje 60 USD za milion tokenów wejścia i 300 USD za milion tokenów wyjścia (231,42 zł i 1157,10 zł bez VAT). W Codex zużywa limit planu 8 razy szybciej. GPT-6.1 Sol w wersji Ultrafast ma przyjść w najbliższych dniach. Tryb nie obsługuje przetwarzania danych w UE, co w części polskich firm go wyklucza.
Resztę nowości z konferencji opisuję w relacji z DevDay 2026.
Co to jest Ultrafast
Poza trybem wsadowym Batch OpenAI ma dziś w API cztery poziomy przetwarzania: tańszy i wolniejszy Flex (połowa ceny), Standard, Fast (do 30 lipca 2026 nazywany Priority, podwójna cena) i nowy Ultrafast. Różnią się szybkością generowania i ceną, model zostaje ten sam. Ultrafast OpenAI opisuje jako „poziom premium dla zadań, w których szybkość liczy się najbardziej”.
Tryb zadebiutował 13 sierpnia 2026 jako ograniczony podgląd dla GPT-5.6 Sol. Wtedy OpenAI mówiło o prędkości do 750 tokenów na sekundę i 14-krotnym przyspieszeniu na sprzęcie firmy Cerebras. Na DevDay tryb wszedł szerzej, ale z GPT-6 Astra, czyli większym modelem, i z niższą prędkością.
Jak szybki jest naprawdę
Źródła podają różne liczby, więc zestawiam je obok siebie:
- podsumowanie DevDay: do 8 razy szybciej (300 tokenów/s) w Codex i do 6 razy w API,
- dokumentacja API: „do 8 razy szybciej niż tryb Standard”,
- Dan Shipper z Every, który widział pokazy przed premierą: 250 tokenów/s.
Z liczb OpenAI wynika, że standardowa Astra w Codex generuje około 37,5 tokenu na sekundę (300 podzielone przez 8). OpenAI zaznacza, że porównuje tylko prędkość generowania, a nie czas ukończenia całego zadania. W API zaleca połączenie WebSocket, bo bez stałego połączenia opóźnienia sieci zjadają część zysku, zwłaszcza przy wielu wywołaniach narzędzi.
Trybu Ultrafast sam nie testowałem: na OpenRouterze go nie ma, a bezpośredniego konta API OpenAI do tego testu nie używałem. Dla porównania: w moim teście GPT-6.1 Sol w trybie standardowym przez OpenRouter wypisywał około 58 tokenów na sekundę, licząc z opóźnieniem sieci.
Które modele i gdzie
| Model | Ultrafast w API | Ultrafast w Codex i ChatGPT Work |
|---|---|---|
| GPT-6 Astra | tak, dla wszystkich, niskie limity | Pro 500, wybrane plany Enterprise i Edu |
| GPT-6.1 Sol | zapowiedziany | zapowiedziany, do 8x szybciej |
| GPT-5.6 Sol | ograniczony podgląd dla wybranych firm | nie |
| GPT-6 Sol, GPT-6 Luna | nie, tylko Fast | nie, tylko Fast |
W Codex inne plany osobiste (Plus, Pro 100, Pro 200) nie mają dostępu do Ultrafast nawet po dokupieniu kredytów. W Enterprise tryb jest domyślnie wyłączony i włącza go właściciel przestrzeni roboczej. Szczegóły planu z Ultrafast opisałem w tekście o ChatGPT Pro 500.
Ile kosztuje Ultrafast w API
Stawki z cennika API OpenAI z 29.09.2026, za milion tokenów, dla zapytań do 272 000 tokenów wejścia. Przeliczenie po kursie 3,857 zł/USD, bez VAT.
| GPT-6 Astra | Wejście | Pamięć podręczna | Wyjście |
|---|---|---|---|
| Flex | 5 USD (19,29 zł) | 0,50 USD (1,93 zł) | 25 USD (96,43 zł) |
| Standard | 10 USD (38,57 zł) | 1 USD (3,86 zł) | 50 USD (192,85 zł) |
| Fast | 20 USD (77,14 zł) | 2 USD (7,71 zł) | 100 USD (385,70 zł) |
| Ultrafast | 60 USD (231,42 zł) | 6 USD (23,14 zł) | 300 USD (1157,10 zł) |
Powyżej 272 000 tokenów wejścia Ultrafast kosztuje 120 USD za wejście i 450 USD za wyjście (462,84 zł i 1735,65 zł). Domyślne limity dla Astry w Ultrafast to 500 000 tokenów na minutę na poziomach konta 1-3, milion na poziomie 4 i 5 milionów na poziomie 5. Tryb włącza się parametrem service_tier="ultrafast".
Ważne dla firm w Polsce: Ultrafast działa tylko z przetwarzaniem w USA albo globalnym. Nie obsługuje regionalnych punktów dostępowych w UE, a w ChatGPT nie jest dostępny dla przestrzeni roboczych, które wymagają przetwarzania poza USA.
Ile kosztuje w Codex i ChatGPT Work
W abonamencie nie płacisz za tokeny, tylko zużywasz limit. Dokumentacja Codex podaje mnożniki względem trybu standardowego:
| Tryb | Zużycie limitu planu | Zużycie kupionych kredytów |
|---|---|---|
| Fast | 2,5x | 2x |
| Ultrafast (GPT-6 Astra) | 8x | 6x |
W Pro 500 Ultrafast najpierw zużywa limit planu, a po jego wyczerpaniu kredyty. Przy samym Ultrafast 25-krotność limitu Plus wystarcza na tyle, co około trzy limity Plus w trybie standardowym.
Kiedy Ultrafast się opłaca
Policzyłem przykładowe zadanie agenta w API: 50 000 nowych tokenów wejścia, 150 000 tokenów z pamięci podręcznej i 20 000 tokenów odpowiedzi na GPT-6 Astra. To mój przykład, nie pomiar.
- Standard: 0,50 + 0,15 + 1,00 = 1,65 USD (6,36 zł). Przy 37,5 tokenu/s samo generowanie trwa około 9 minut.
- Ultrafast: 9,90 USD (38,18 zł). Przy 300 tokenach/s generowanie trwa około 67 sekund.
Oszczędzasz około 8 minut za 31,82 zł. Jeśli godzina twojej pracy kosztuje 150 zł, 8 minut czekania jest warte 20 zł, więc na pojedynczym zadaniu dopłata się nie zwraca. Zwraca się tam, gdzie czekanie blokuje więcej osób albo pieniądze: awaria na produkcji, obsługa klienta na żywo, praca w pętli „zmień i sprawdź” z wieloma krótkimi krokami. W sierpniowej zapowiedzi Ultrafast OpenAI podawało podobne przykłady: reagowanie na awarie, analizę transakcji i obsługę klienta. To moja opinia.
Jeśli zależy ci głównie na koszcie, GPT-6.1 Sol w trybie standardowym kosztuje 2 i 10 USD za milion tokenów, czyli 30 razy mniej niż Astra w Ultrafast, a według OpenAI w części zadań zbliża się do Astry. Gdy Sol dostanie własny Ultrafast, może to być najrozsądniejszy wybór dla szybkich agentów. Ceny tej wersji OpenAI jeszcze nie podało.
01OpenAI DevDay 2026: wszystkie nowości - Dots, GPT-6.1 Sol, Pro 500Wszystkie nowości z OpenAI DevDay 2026 po polsku: agenci Dots, GPT-6.1 Sol, Ultrafast, ChatGPT Space, Pro 500, Codex w chmurze i Agents API. Keynote, grafiki i 10 tekstów.Czytaj →
02GPT-6.1 Sol: cena, dostępność i mój test po polskuGPT-6.1 Sol kosztuje w API tyle co GPT-6 Sol, ma tańszy cache i działa w Plus. W moim teście po polsku: 85,8 pkt, niemal jak GPT-6 Sol i Astra.Czytaj →
03ChatGPT Pro 500: cena w zł i porównanie planówPro 500 kosztuje 500 USD, czyli 2372 zł z VAT, i daje 25x limit Plus oraz Ultrafast. Za jednostkę limitu płacisz tyle co w Plus.Czytaj →
04OpenAI Dots: co to jest i czy działa w PolsceDots to agenci OpenAI z własnym komputerem w chmurze. W planie Pro omijają EOG, więc w Polsce działają tylko w Business Premium.Czytaj →
05ChatGPT Space i Pages: co to jest i jak zacząćSpace zastępuje Bibliotekę w ChatGPT, a Pages to dokumenty dla ludzi i agentów. Dla Pro, Business i Enterprise. Porównanie z Notion i Google Docs.Czytaj →Najczęstsze pytania
Nie przepłacaj za te subskrypcje
Prowadzę sklep z rocznymi dostępami do narzędzi AI - te same konta, o których piszę wyżej, tylko taniej niż w cenniku producenta.
Ile tokenów na sekundę daje OpenAI Ultrafast?
Według OpenAI do 300 tokenów na sekundę w Codex z GPT-6 Astra, czyli do 8 razy szybciej niż standardowo. W API do 6 razy szybciej.
Ile kosztuje Ultrafast w API?
Dla GPT-6 Astra 60 USD za milion tokenów wejścia i 300 USD za milion tokenów wyjścia, sześć razy więcej niż w trybie standardowym.
Które modele obsługują Ultrafast?
Dziś GPT-6 Astra. GPT-6.1 Sol dostanie go w najbliższych dniach, a GPT-5.6 Sol jest w ograniczonym podglądzie dla wybranych firm.
Czy Ultrafast jest w planie Plus?
Nie. Z planów osobistych ma go tylko Pro 500. Kupno kredytów w Plus, Pro 100 czy Pro 200 go nie odblokowuje.
Źródła i data sprawdzenia
OpenAI: DevDay 2026 Recap, Ultrafast mode (dokumentacja API), cennik API, tryby szybkości w Codex, cennik Codex, About ChatGPT Pro tiers, Previewing Ultrafast mode (13.08.2026), Introducing GPT-6.1 Sol; CNBC; Engadget; Every. Kurs 3,857 zł/USD. Sprawdzone 29 września 2026.
Cały tydzień w AI, w jednym mailu
Wybrane premiery, narzędzia i analizy. Raz w tygodniu, prosto do skrzynki.
Zapisz się za darmo →
