OpenAI API, Claude API czy Gemini API? Porównanie dla początkujących
Porównanie trzech głównych API dla początkujących: ceny i darmowy start, różnice w kodzie, koszt polskiego tekstu i test jednego pytania na sześciu modelach z czasem odpowiedzi i kosztem.

👁 115 przeczytań
- Na start bez karty kredytowej najtaniej zaczyna się z Gemini API w Google AI Studio, które oferuje darmowy poziom dla modeli Flash.
- Najtańszy płatny model z dużej trójki to GPT-6 Luna od OpenAI za 0,10 USD za milion tokenów wejścia i 0,50 USD za milion tokenów wyjścia.
- Ten sam polski akapit to 116 tokenów w Gemini 3.8 Flash, 126 w GPT-6 Luna i aż 214 w Claude Sonnet 5.5, co oznacza, że Claude kosztuje około 1,7 raza więcej przy tej samej stawce.
Na start najtaniej i bez karty zaczniesz z Gemini API (darmowy poziom w Google AI Studio). Najtańszy płatny model z dużej trójki to GPT-6 Luna od OpenAI za 0,10 / 0,50 USD za milion tokenów. Claude od Anthropic jest najdroższy w przeliczeniu na polski tekst, bo jego tokenizator dzieli polszczyznę na najwięcej kawałków. Poniżej porównuję trzy API na tych samych pytaniach, z czasem, kosztem i różnicami w kodzie. To część ścieżki API AI od zera.
Stan na 4 października 2026
- OpenAI: GPT-6 Luna 0,10 / 0,50 USD, GPT-6.1 Sol 2 / 10 USD, GPT-6 Astra 10 / 50 USD; bez darmowego poziomu.
- Anthropic: Claude Haiku 4.5 1 / 5 USD, Sonnet 5.5 2 / 10 USD, Opus 5.5 4 / 20 USD, Fable 5.1 10 / 50 USD; niewielkie kredyty na start.
- Google: Gemini 3.8 Flash 0,75 / 3,75 USD (do końca 2026), Flash-Lite od 0,10 / 0,40 USD; darmowy poziom dla modeli Flash.
- Ceny za milion tokenów wejścia / wyjścia, bez VAT.
Porównanie w tabeli
| OpenAI API | Claude API (Anthropic) | Gemini API (Google) | |
|---|---|---|---|
| Gdzie klucz | platform.openai.com | platform.claude.com | aistudio.google.com/apikey |
| Darmowy start | nie | niewielkie kredyty dla nowych kont | tak, darmowy poziom modeli Flash bez karty |
| Najtańszy model | GPT-6 Luna: 0,10 / 0,50 USD | Haiku 4.5: 1 / 5 USD | Gemini 2.5 Flash-Lite: 0,10 / 0,40 USD |
| Model „do wszystkiego” | GPT-6.1 Sol: 2 / 10 USD | Sonnet 5.5: 2 / 10 USD | Gemini 3.8 Flash: 0,75 / 3,75 USD |
| Najmocniejszy dostępny | GPT-6 Astra: 10 / 50 USD | Fable 5.1: 10 / 50 USD | Gemini 3.1 Pro (preview): 2 / 12 USD; Gemini 4 Argon w zamkniętym programie |
| Okno kontekstowe | 1,05 mln tokenów | 1 mln (Haiku 200 tys.) | 1,05 mln |
| Tokeny na mój polski akapit (439 znaków) | 126 (Luna) | 214 (Sonnet 5.5), 159 (Haiku 4.5) | 116 (3.8 Flash) |
| Biblioteka Python | openai | anthropic | google-genai |
| Zmienna z kluczem | OPENAI_API_KEY | ANTHROPIC_API_KEY | GEMINI_API_KEY |
| Twardy limit wydatków | tak, na projekt (od lipca 2026) | tak, na organizację i workspace | limity poziomów rozliczeń |
| Tryb wsadowy | -50% | -50% | -50% |
Mój test: to samo pytanie do sześciu modeli
Wysłałem jedno pytanie po polsku do dwóch modeli każdej firmy (średni i tani), plus DeepSeek dla porównania. Wszystko przez jeden klucz OpenRouter, więc warunki są równe: ta sama sieć, ten sam kod, mierzony czas całej odpowiedzi.

"""To samo pytanie do modeli OpenAI, Anthropic, Google i DeepSeek przez jeden klucz OpenRouter."""
import os, time
from dotenv import load_dotenv
from openai import OpenAI
load_dotenv()
client = OpenAI(base_url="https://openrouter.ai/api/v1", api_key=os.environ["OPENROUTER_API_KEY"])
PYTANIE = "Wyjaśnij jedenastolatkowi w trzech zdaniach, co to jest klucz API."
for model in ("openai/gpt-6.1-sol", "anthropic/claude-sonnet-5.5", "google/gemini-3.8-flash",
"openai/gpt-6-luna", "anthropic/claude-haiku-4.5", "deepseek/deepseek-v4-flash"):
start = time.time()
r = client.chat.completions.create(model=model, messages=[{"role": "user", "content": PYTANIE}], max_tokens=2000)
czas = time.time() - start
u = r.usage
print(f"\n### {model} ({czas:.1f} s, {u.prompt_tokens}+{u.completion_tokens} tokenów, {u.cost:.5f} USD)")
print(r.choices[0].message.content.strip())### openai/gpt-6.1-sol (3.4 s, 29+90 tokenów, 0.00096 USD)
Klucz API to specjalny kod, dzięki któremu aplikacja może korzystać z usług innej aplikacji, na przykład pobierać prognozę pogody. Działa trochę jak przepustka: pokazuje, kto prosi o dostęp i czy ma na to pozwolenie. Trzeba go chronić jak hasło, żeby ktoś obcy nie korzystał z usług na twój koszt.
### anthropic/claude-sonnet-5.5 (4.0 s, 44+188 tokenów, 0.00197 USD)
Klucz API to taki tajny „hasło-bilet”, który program pokazuje innemu programowi, żeby mógł od niego coś dostać, na przykład prognozę pogody albo mapę. Dzięki niemu ten drugi program wie, kto o to prosi i czy ma na to pozwolenie. To trochę jak karta do szatni lub biblioteki: bez niej cię nie obsłużą, a jeśli ktoś ją ukradnie, może udawać ciebie, dlatego nie wolno jej nikomu pokazywać.
### google/gemini-3.8-flash (6.3 s, 21+830 tokenów, 0.00313 USD)
Klucz API to specjalne, tajne hasło, które działa jak cyfrowa przepustka łącząca dwa różne programy lub gry.
Dzięki niemu jedna aplikacja wie, że ta druga ma pozwolenie na pobranie od niej potrzebnych informacji, na przykład mapy czy prognozy pogody.
Można to porównać do biletu w parku rozrywki, który pokazuje obsłudze, że masz prawo wejść na daną atrakcję i z niej skorzystać.
### openai/gpt-6-luna (2.0 s, 29+111 tokenów, 0.00006 USD)
Klucz API to specjalny ciąg znaków, dzięki któremu jedna aplikacja może bezpiecznie korzystać z usług innej, na przykład pobierać prognozę pogody. Działa trochę jak przepustka: usługa rozpoznaje, kto się z nią łączy, i sprawdza, na co mu pozwolić. Trzeba go ukrywać, tak jak hasła, bo ktoś inny mógłby użyć go bez twojej zgody.
### anthropic/claude-haiku-4.5 (2.7 s, 34+138 tokenów, 0.00072 USD)
# Klucz API w trzech zdaniach
Klucz API to specjalny kod, który pozwala twojej aplikacji porozmawiać z inną aplikacją lub serwisem internetowym - tak jak hasło, ale do komunikacji między programami. Dzięki niemu serwis wie, że to ty go prosisz o informacje, i może ci je wysłać. Musisz go chronić jak hasło, bo jeśli ktoś go ukradnie, może udawać, że to ty i używać twojego konta.
### deepseek/deepseek-v4-flash (6.0 s, 29+356 tokenów, 0.00002 USD)
Wyobraź sobie, że klucz API to tajny kod, który pozwala twojej grze lub aplikacji rozmawiać z innym programem w internecie, na przykład poprosić o pogodę. Zamiast loginu i hasła, program używa tego kodu, aby udowodnić, że ma pozwolenie na korzystanie z danych - podobnie jak klucz do domku na drzewie. Dlatego nigdy nie wolno go nikomu podawać, bo ktoś obcy mógłby go użyć do kradzieży informacji lub zrobienia czegoś złego w twoim imieniu.| Model | Czas | Tokeny wyjścia | Koszt | Moja ocena odpowiedzi |
|---|---|---|---|---|
| GPT-6.1 Sol | 3,4 s | 90 | 0,00096 USD | dokładnie 3 zdania, poprawna polszczyzna, dobra analogia z przepustką |
| Claude Sonnet 5.5 | 4,0 s | 188 | 0,00197 USD | najbardziej obrazowa (szatnia, biblioteka), jedno dziwne sformułowanie „hasło-bilet” |
| Gemini 3.8 Flash | 6,3 s | 830 | 0,00313 USD | dobra, ale najdroższa: większość tokenów to myślenie |
| GPT-6 Luna | 2,0 s | 111 | 0,00006 USD | prawie tak dobra jak Sol, za 1/16 ceny |
| Claude Haiku 4.5 | 2,7 s | 138 | 0,00072 USD | poprawna, ale dodała zbędny nagłówek Markdown |
| DeepSeek V4 Flash | 6,0 s | 356 | 0,00002 USD | najtańsza, poprawna, trochę przesadzone „kradzież informacji” |
Wnioski z tego jednego pytania (to nie benchmark, tylko pokaz, jak porównywać):
- Wszystkie sześć modeli pisze poprawnie po polsku. Różnice są w stylu i dyscyplinie formatu, nie w gramatyce.
- Cena za zapytanie różniła się 150 razy (od 0,00002 do 0,00313 USD) przy podobnej jakości odpowiedzi.
- Cennik „za milion tokenów” myli. Gemini 3.8 Flash ma niższą stawkę niż Sonnet 5.5, a wyszedł najdrożej, bo domyślnie myśli i zużył 830 tokenów wyjścia na trzy zdania.
- Szerszy test modeli po polsku na wielu zadaniach znajdziesz w tekście GPT-6 Astra vs Opus 5.5: 9 testów.
Różnice w kodzie
Trzy firmy mają trzy różne formaty API. Najważniejsze różnice, które zobaczysz w pierwszym skrypcie:
- OpenAI poleca Responses API:
client.responses.create(model=..., instructions=..., input=...), tekst woutput_text. Starsze Chat Completions nadal działa i jest standardem rynkowym. - Anthropic:
client.messages.create(model=..., max_tokens=..., system=..., messages=[...]).max_tokensjest obowiązkowy, a odpowiedź to lista bloków (tekst, myślenie, wywołania narzędzi). - Google:
client.models.generate_content(model=..., contents=..., config=...), tekst w.text, instrukcja systemowa wconfig.
Pełne, minimalne skrypty dla każdej firmy są w tekście Klucz API: jak go zdobyć i w paczce promptowy-api-starter (katalog dostawcy/). Uczciwie: uruchomiłem je z fałszywymi kluczami (serwery każdej firmy odpowiedziały błędem autoryzacji, więc kod i biblioteki działają), ale z prawdziwymi kluczami tych trzech firm ich nie testowałem. Ciekawostka z tego testu: na zły klucz OpenAI i Anthropic odpowiadają kodem 401, a Google kodem 400.
Jeśli nie chcesz pisać trzech wersji kodu, użyj pośrednika, który mówi jednym formatem: OpenRouter albo biblioteki obsługujące wiele firm naraz. Tak robiłem we wszystkich testach z tej ścieżki.
Polski: tokeny i jakość
Wszystkie trzy firmy dobrze rozumieją i piszą po polsku. Różnicę widać w rachunku: ten sam polski akapit to 116 tokenów w Gemini 3.8 Flash, 126 w GPT-6 Luna i 214 w Claude Sonnet 5.5. Przy tej samej stawce za milion tokenów (Sonnet 5.5 i GPT-6.1 Sol po 2 / 10 USD) polski tekst w Claude kosztuje więc mniej więcej 1,7 raza więcej. Pełny pomiar na siedmiu modelach jest w tekście Tokeny AI: co to jest i ile kosztują.
Które API wybrać
- Uczysz się i nie chcesz płacić: Gemini API w darmowym poziomie albo darmowe modele na OpenRouter. Przewodnik: Google AI Studio.
- Automatyzacja na dużą skalę, proste zadania: GPT-6 Luna albo Gemini Flash-Lite - grosze za tysiące zapytań.
- Teksty, kod i agenci, gdzie liczy się jakość: Claude Sonnet 5.5 albo GPT-6.1 Sol. Wybierz po teście na swoich przykładach.
- Najtrudniejsze zadania: Claude Opus 5.5, Fable 5.1 albo GPT-6 Astra. Ceny i pułapki: Claude Opus 5.5 w API, GPT-6 Sol i Luna, GPT-6 Astra.
- Nie wiesz jeszcze: zacznij od OpenRouter, porównaj modele na swoich danych, a dopiero potem załóż konto u zwycięzcy.
Poza dużą trójką warto znać tańsze alternatywy: DeepSeek, Mistral (dane w Europie), Kimi i Grok.
Najczęstsze pytania
Które API AI jest najtańsze?
Z dużej trójki: GPT-6 Luna (0,10 / 0,50 USD) i Gemini 2.5 Flash-Lite (0,10 / 0,40 USD). Jeszcze taniej wychodzą DeepSeek poza godzinami szczytu i modele otwarte przez OpenRouter. Za darmo: darmowy poziom Gemini API.
Czy Gemini API jest darmowe?
W darmowym poziomie tak, dla modeli Flash i Flash-Lite, bez karty. Google nie publikuje stałych limitów, a w darmowym poziomie może używać danych do ulepszania usług (z wyjątkami dla użytkowników z EOG). Modele Pro są tylko płatne.
Ile kosztuje Claude API?
Od 1 / 5 USD za milion tokenów (Haiku 4.5) przez 2 / 10 USD (Sonnet 5.5) i 4 / 20 USD (Opus 5.5) do 10 / 50 USD (Fable 5.1). Tryb wsadowy daje 50% zniżki, a odczyt z pamięci podręcznej kosztuje 10% ceny wejścia.
Czy mogę używać jednego kodu do wszystkich trzech?
Tak, przez pośrednika zgodnego z formatem OpenAI, np. OpenRouter. Google i Anthropic udostępniają też własne punkty zgodne z SDK OpenAI, ale z ograniczeniami funkcji.
Które API najlepiej pisze po polsku?
W moich testach różnice w jakości polszczyzny są małe, a większe w stylu i trzymaniu się formatu. Różnica w koszcie polskiego tekstu jest za to wyraźna: Claude zużywa najwięcej tokenów, Gemini najmniej.
Google · Twoje źródłaPromptowy wyżej w Twoim Google - jednym kliknięciemDodaj do preferowanych źródeł →Źródła i data sprawdzenia
Ceny sprawdziłem 4 października 2026. Test uruchomiłem tego samego dnia na Windows 11, Python 3.13.15, openai 3.24.0, przez OpenRouter; koszt całego porównania 0,0069 USD.
- OpenAI - cennik API
- Anthropic - cennik API
- Anthropic - przegląd modeli
- Google - cennik Gemini API
- OpenAI - limity wydatków
- Anthropic - limity
Cały tydzień w AI, w jednym mailu
Wybrane premiery, narzędzia i analizy. Raz w tygodniu, prosto do skrzynki.
Zapisz się za darmo →
