✨ Świeża dostawa•nowe kody na kinetyka.pl: Gemini Pro 18 mies. 170 zł•Cursor, ElevenLabs, Lovable i więcej, roczne plany AI w ułamku ceny Zobacz →
Przejdź do treści
Artykuły

DeepL vs Google Tłumacz vs ChatGPT: test na polskich idiomach

Test tłumaczenia z polskiego na angielski: Google Tłumacz przełożył dosłownie 7 z 14 trudnych miejsc, a modele językowe prawie wszystkie. Pełna tabela, tekst testowy i porównanie z DeepL.

7 min czytania
Logo DeepL i pytanie DeepL czy Google - test tłumaczenia idiomów

👁 115 przeczytań

// w skrócie
  • W teście 14 polskich idiomów GPT-6.1 Sol uzyskał 20 na 20 punktów, Claude Sonnet 5.5 i Gemini 3.8 Flash po 19,5, a Google Tłumacz tylko 13 punktów.
  • Google Tłumacz przetłumaczył dosłownie 7 z 14 trudnych miejsc, zamieniając np. 'gruszki na wierzbie' na 'pears on willow' i 'musztardę po obiedzie' na 'mustard after dinner'.
  • Wszystkie sześć narzędzi poprawnie przetłumaczyło 6 grup liczb i dat, zapisując m.in. '2 500 zł brutto' jako 'PLN 2,500 gross' i datę '15.11.2026' jako 'November 15, 2026'.

Na tekście z polskimi idiomami Google Tłumacz przetłumaczył dosłownie 7 z 14 trudnych miejsc, a modele językowe (GPT-6.1 Sol, Claude Sonnet 5.5, Gemini 3.8 Flash) zrobiły od zera do jednego drobnego przesunięcia znaczenia. Liczby, kwoty i daty wszystkie narzędzia miały bez błędów. DeepL nie trafił do testu, bo darmowe API wymaga klucza, ale niżej porównuję jego funkcje i ceny. Wszystko o samym DeepL jest w przewodniku DeepL.

Jak wyglądał test

Napisałem trzy akapity (143 słowa), które zbierają typowe pułapki: 13 idiomów, kwoty brutto i netto, procent z przecinkiem, datę w formacie 15.11.2026, godzinę i rzeczownik „kadrowa”, którego angielski nie ma. 3 października 2026 każde narzędzie dostało ten sam tekst z poleceniem przetłumaczenia na naturalny angielski:

  • Google Tłumacz - publiczny, darmowy punkt dostępu tłumacza Google (bez klucza), akapit po akapicie.
  • GPT-6.1 Sol, Claude Sonnet 5.5, Gemini 3.8 Flash, DeepSeek V4.1 Flash - przez OpenRouter, temperatura 0, to samo polecenie.
  • Bielik 11B - polski model uruchomiony lokalnie w Ollamie na karcie RTX 4090.

Tekst testowy w całości (możesz go wkleić do DeepL i porównać sam):

Szef obiecał nam gruszki na wierzbie: podwyżkę o 15% od 1 lipca 2026 r. i premię w wysokości 2 500 zł brutto. Skończyło się jak zwykle - musztarda po obiedzie i marne 3,5% w październiku. Kadrowa rozłożyła ręce, a ja przestałem robić dobrą minę do złej gry.

Na spotkaniu z klientem z Gdańska poszło jak z płatka, choć wcześniej wszyscy chodzili jak na szpilkach. Klient zamówił 1 200 sztuk po 49,99 zł netto z dostawą do 15.11.2026. Nie ma co dzielić skóry na niedźwiedziu, ale jeśli zapłaci w terminie, wyjdziemy na swoje.

Mój dziadek mawiał, że kto rano wstaje, temu Pan Bóg daje, ale sam do 10:30 spał jak zabity. Wypijał pół litra kawy, czytał „Przegląd Sportowy” od deski do deski, a kiedy babcia prosiła o wyniesienie śmieci, odpowiadał, że to nie jego bajka. Ma 87 lat i wciąż trzyma rękę na pulsie.

Oceniałem 20 punktów kontrolnych: 14 miejsc z idiomami i odniesieniami (kto jest kim) oraz 6 grup liczb i dat. Poprawne tłumaczenie to 1 punkt, przesunięcie znaczenia pół punktu, tłumaczenie dosłowne, błędne albo pominięte 0.

Wyniki

FragmentGoogle TłumaczGPT-6.1 SolClaude Sonnet 5.5Gemini 3.8 FlashDeepSeek V4.1Bielik 11B
gruszki na wierzbiepears on willow ✗the moon ✓the moon ✓pie in the sky ✓the moon ✓grapes on the trees ✗
musztarda po obiedziemustard after dinner ✗too little, too late ✓✓✓✓✓
kadrowa rozłożyła ręcethe staff threw up their hands ✗the HR officer ✓the HR woman ✓the HR lady ✓HR ✓the HR manager ✓
dobra mina do złej grya good face for a bad game ✗a brave face ✓✓✓✓stopped pretending ✓
jak z płatkasmoothly ✓like clockwork ✓without a hitch ✓✓✓smoothly ✓
jak na szpilkachon tenterhooks ✓on edge ✓on pins and needles ✓✓✓on edge ✓
dzielić skórę na niedźwiedziusplitting the skin of a bear ✗count our chickens ✓✓✓✓✓
wyjdziemy na swojebreak even ✓break even ✓come out ahead ½come out ahead ½break even ✓be in the black ½
kto rano wstaje…God gives to those who get up in the morning ✗the early bird catches the worm ✓✓✓✓✓
spał jak zabityslept like the dead ✓like a log ✓✓✓✓pominięte ✗
od deski do deskifrom cover to cover ✓✓✓✓✓✓
nie jego bajkanot his cup of tea ✓wasn’t his thing ✓✓✓wasn’t his job ✗wasn’t his department ½
trzyma rękę na pulsiefinger on the pulse ✓✓✓✓✓✓
babcia (narratora)his grandmother ✗Grandma ✓my grandmother ✓Grandma ✓Grandma ✓my grandmother ✓
6 grup liczb i dat6/66/66/66/66/66/6
Razem (na 20)132019,519,51917
Czas3,6 s9,5 s3,8 s11,6 s18,3 s335 s*
Koszt00,0043 USD0,0042 USD0,0084 USD0,0016 USD0

* Bielik działał na karcie graficznej współdzielonej w tym czasie z innym zadaniem, więc jego czas jest zawyżony. Wszystkie wywołania przez OpenRouter kosztowały razem 0,0185 USD.

Co z tego wynika

Liczby przestały być problemem

Kilka lat temu tłumacze potrafiły zostawić „3,5%” z przecinkiem albo zamienić „2 500” na „2.500”. W tym teście wszystkie narzędzia zapisały „PLN 2,500 gross”, „3.5%”, „1,200 units”, „PLN 49.99 net” i „November 15, 2026” (Claude: „15 November 2026”, czyli zapis brytyjski). GPT-6.1 Sol jako jedyny dopisał przy cenie netto „each, excluding tax”, co dla anglojęzycznego odbiorcy jest jaśniejsze niż samo „net”.

Idiomy rozdzielają narzędzia

Google Tłumacz przenosi idiomy słowo w słowo. Anglojęzyczny czytelnik zrozumie „God gives to those who get up in the morning”, ale „pears on willow” i „mustard after dinner” będą dla niego zagadką. Modele językowe szukają odpowiednika z tym samym znaczeniem, nawet jeśli obraz jest zupełnie inny (kurczęta zamiast niedźwiedzia).

Kto jest kim

Nie przepłacaj za te subskrypcje

Prowadzę sklep z rocznymi dostępami do narzędzi AI - te same konta, o których piszę wyżej, tylko taniej niż w cenniku producenta.

Zobacz, co jest dostępne

Najciekawszy błąd Google to nie idiom, tylko odniesienie: babcia z ostatniego akapitu to babcia narratora, a Google napisał „his grandmother”, czyli babcia dziadka. Tłumacz zdanie po zdaniu nie widzi, kto opowiada historię. Modele językowe czytają cały tekst naraz i takich pomyłek nie zrobiły. To samo dotyczy „kadrowej”: Google zrobił z niej „the staff”, czyli cały personel.

Polski model nie znaczy lepszy w tłumaczeniu

Bielik 11B świetnie rozumie polski, ale po angielsku pisze słabiej niż duże modele. Wymyślił idiom „grapes on the trees” i zgubił „spał jak zabity”. Do tłumaczeń na angielski lokalnie bym go nie wybrał. Do czego Bielik nadaje się lepiej i jak wypadają inne modele na moim komputerze, sprawdziłem w teście 7 lokalnych modeli AI po polsku.

DeepL, Google i czat: porównanie funkcji

CechaDeepLGoogle TłumaczChatGPT, Claude, Gemini
CenaFree, płatne od 7,49 EUR miesięcznie (rocznie)darmowydarmowe plany z limitami, płatne od ok. 20 USD
Liczba języków114ponad 240dziesiątki
Pliki z układemDOCX, PPTX, XLSX, PDFdokumenty w przeglądarceukład często się gubi
Glosariusztak, także w Free (1 glosariusz)w płatnym API Cloudprzez polecenie
Instrukcje (odbiorca, ton)ton formalny lub nieformalny, reguły stylubrakdowolne
Korekta po polskuDeepL Write bez polskiegobraktak
Prywatnośćpłatne plany bez trenowania na tekstachzależy od produktuzależy od planu i ustawień

Kiedy czego używam

  • Tekst z idiomami, mail do klienta, post: czat z poleceniem „przetłumacz naturalnie dla brytyjskiego klienta biznesowego”. Mogę dopisać, czego nie zmieniać.
  • Plik (oferta, prezentacja, instrukcja) z zachowaniem układu: DeepL z glosariuszem.
  • Zrozumienie obcego tekstu, rzadki język, strona internetowa: Google Tłumacz.
  • Dokumenty poufne: płatny DeepL z gwarancją niewykorzystywania tekstów albo model lokalny.

Moje polecenie do tłumaczenia w czacie wygląda tak: „Przetłumacz na naturalny angielski brytyjski. Idiomy zastąp angielskimi odpowiednikami o tym samym znaczeniu, a nie dosłownym tłumaczeniem. Kwoty zostaw w złotych (PLN). Nie dodawaj niczego od siebie. Zachowaj podział na akapity.” Więcej o pracy z tłumaczeniami AI piszę w tekstach AI do tłumaczenia i Jak przetłumaczyć tekst z AI.

Ograniczenia testu

  • Jeden tekst i jeden kierunek (polski na angielski). Tłumaczenie na polski może dać inną kolejność.
  • DeepL nie był testowany: darmowe API wymaga rejestracji i klucza, a ręcznego testu przez stronę świadomie nie robiłem.
  • Ocena jest moja. Przy „wyjdziemy na swoje” można się spierać, czy „come out ahead” to błąd, czy tylko odcień.
  • Modele językowe są niedeterministyczne. Przy temperaturze 0 wynik jest stabilny, ale nie identyczny przy każdym uruchomieniu.

Najczęstsze pytania

DeepL czy Google Tłumacz - co jest lepsze?

Do tekstów z idiomami i naturalnego brzmienia lepsze są DeepL i modele językowe, do rzadkich języków i szybkiego zrozumienia sensu Google. W moim teście Google przetłumaczył dosłownie 7 z 14 trudnych miejsc, ale liczby miał bez błędów.

Czy ChatGPT tłumaczy lepiej niż DeepL?

Przy tekstach z kontekstem i idiomami czat często wypada lepiej, bo możesz mu powiedzieć, kto jest odbiorcą. DeepL wygrywa przy plikach z zachowaniem układu i przy stałej terminologii w glosariuszu.

Który tłumacz najlepiej radzi sobie z polskim?

W moim teście z polskiego na angielski najlepiej wypadł GPT-6.1 Sol (20 na 20), tuż za nim Claude Sonnet 5.5 i Gemini 3.8 Flash (po 19,5). Google Tłumacz zdobył 13 punktów.

Czy Google Tłumacz jest darmowy?

Tak, w przeglądarce i aplikacji jest darmowy. Płatne jest dopiero API w Google Cloud, rozliczane za liczbę znaków.

Google · Twoje źródłaPromptowy wyżej w Twoim Google - jednym kliknięciemDodaj do preferowanych źródeł →

Źródła i data sprawdzenia

Test przeprowadziłem 3 października 2026. Ceny DeepL z cennika dla regionu Polska.

// Newsletter

Cały tydzień w AI, w jednym mailu

Wybrane premiery, narzędzia i analizy. Raz w tygodniu, prosto do skrzynki.

Zapisz się za darmo →
Za darmo. Wypisujesz się jednym kliknięciem.
// czytaj też

Podobne tematy na Promptowym

Piotr Olszewski

Piotr Olszewski

AUTOR I WYDAWCA

Piotr Olszewski - twórca i autor Promptowego, polskiego serwisu o sztucznej inteligencji. Codziennie śledzi premiery modeli, narzędzia i regulacje AI, i tłumaczy je prostym, konkretnym językiem.

// mapa strony

🛒 Sklep Kinetyka Google AI Gemini Pro 170 zł CapCut Pro 460 zł/rok Lovable Pro 400 zł/rok Zobacz wszystko →
promptowy w liczbach 0tekstów w archiwum0newsów z ostatnich 7 dni0modeli wideo w obserwatorium0zagadek w grach
× ‹ powiększenie ›