AI do szkoły 2026: ranking 9 modeli na 15 zadaniach z polskiej szkoły
Ranking AI do szkoły na październik 2026: 9 modeli (ChatGPT, Gemini, Claude, DeepSeek, Qwen) na tych samych 15 zadaniach z polskiej szkoły, oceny według klucza, test uczciwości, ceny planów i oferty edukacyjne, wybór dla ucznia, nauczyciela i rodzica.

👁 117 przeczytań
- Ranking 9 modeli AI na 15 szkolnych zadaniach wygrał Gemini 3.1 Pro z wynikiem 130 na 130 punktów, tuż przed GPT-6.1 Sol (129 pkt).
- Matematykę i fizykę wszystkie 9 modeli rozwiązały bezbłędnie, a różnice w rankingu wynikają wyłącznie z błędów w języku polskim.
- Wszystkie 9 modeli napisało całe opowiadanie na prośbę ucznia - trzy modele Google'a dodatkowo pomogły ukryć, że tekst napisała AI.
Dałem dziewięciu modelom AI, z których uczniowie korzystają za darmo albo w tanich planach, te same 15 zadań z polskiej szkoły: plan rozprawki o „Lalce”, interpretację Trenu VIII, dyktando z błędami, trzy zadania z matematyki, tłumaczenie, gramatykę i e-mail po angielsku, historię, WOS, fizykę, kartkówkę dla nauczyciela i dwie próby ściągania. Wygrał Gemini 3.1 Pro (130 na 130 punktów), tuż za nim GPT-6.1 Sol (129). Matematykę szkolną wszystkie modele rozwiązały bez błędu, różnice robi język polski, a na prośbę „daj same wyniki, przepiszę” żaden model nie odmówił.
Stan na 3 października 2026
- Test zrobiłem 3 i 4 października 2026 przez API, na identycznych poleceniach, z niskim poziomem rozumowania. Cały test kosztował 1,08 USD.
- Darmowy ChatGPT działa na GPT-5.6 Luna, darmowe Gemini na Gemini 3.6 Flash (plus ograniczony dostęp do 3.1 Pro), darmowy Claude na Sonnet 5.5. Wszystkie trzy są w rankingu.
- Studenci uczelni (18+) mogą do 31 grudnia 2026 aktywować rok Google AI Plus za darmo. Uczniowie szkół z tej oferty nie skorzystają.
- Nauczyciele i uczniowie od 4. klasy mają darmową Canvę z AI przez ZPE, według ZPE gwarantowaną do 31 grudnia 2026.
- CKE w komunikatach na rok 2026/2027 nadal zakazuje wnoszenia na maturę i egzamin ósmoklasisty jakichkolwiek urządzeń z dostępem do internetu.
Który model wybrać - szybka odpowiedź
- Uczeń 13-17 lat: darmowy ChatGPT (GPT-5.6 Luna, 125/130 punktów) za zgodą rodzica, z włączonym trybem nauki. Claude i Qwen Chat wymagają 18 lat, więc odpadają.
- Uczeń, który chce najlepszy wynik bez płacenia: Gemini. W darmowej aplikacji jest model 3.6 Flash (121/130, najsłabszy w polskim), ale z ograniczonym dostępem do Gemini 3.1 Pro, który mój test wygrał.
- Maturzysta i student 18+: Gemini 3.1 Pro albo GPT-6.1 Sol (ChatGPT Plus, 99,99 zł). Student uczelni weźmie rok Google AI Plus za 0 zł, szczegóły w tekście Gemini dla studentów.
- Nauczyciel: kartkówkę z kluczem dobrze przygotował każdy model; najstaranniejsze miały GPT-6.1 Sol, Gemini 3.1 Pro i Claude Sonnet 5.5. Do grafik i materiałów darmowa Canva dla nauczycieli przez ZPE.
- Rodzic: żaden model nie pilnuje uczciwości za Ciebie. Najbardziej „pedagogiczny” był Claude Sonnet 5.5, ale to usługa od 18 lat; dla nastolatka ChatGPT z kontrolą rodzicielską i trybem nauki.
Wyniki rankingu
Każde z 13 zadań merytorycznych oceniałem na 10 punktów według klucza: poprawność (0-5), wyjaśnienie (0-3) i polszczyzna (0-2). Maksimum to 130 punktów. Dwa zadania „uczciwość” oceniałem osobno, żeby nie mieszać wiedzy z zachowaniem. Druga kolumna z paskami pokazuje, ile punktów model stracił, bo przy wynikach od 121 do 130 to w niej widać różnice.
| # | Model | Wynik (na 130 pkt) | Stracone punkty |
|---|---|---|---|
| 1 | Gemini 3.1 Pro | 130 | 0 |
| 2 | GPT-6.1 Sol | 129 | 1 |
| 3 | Gemini 3.8 Flash | 127 | 3 |
| 4 | GPT-6 Luna | 125 | 5 |
| 4 | GPT-5.6 Luna | 125 | 5 |
| 6 | DeepSeek V4.1 Flash | 124 | 6 |
| 6 | Qwen3.8 Max | 124 | 6 |
| 8 | Claude Sonnet 5.5 | 123 | 7 |
| 9 | Gemini 3.6 Flash | 121 | 9 |
Różnice są małe i uczciwie mówiąc, każdy z tych modeli odrobiłby z uczniem większość zadań domowych. Wynik 121 na 130 to nadal 93%. Ważniejsze jest, gdzie modele tracą punkty, bo to te same miejsca, w których uczeń dostanie złą ocenę za przepisaną odpowiedź.
Wyniki według przedmiotów
| Model | Polski (30) | Matematyka (30) | Angielski (30) | Historia i WOS (20) | Fizyka (10) | Kartkówka dla nauczyciela (10) | Dogrywka z matematyki (8) |
|---|---|---|---|---|---|---|---|
| Gemini 3.1 Pro | 30 | 30 | 30 | 20 | 10 | 10 | 8/8 |
| GPT-6.1 Sol | 30 | 30 | 29 | 20 | 10 | 10 | 8/8 |
| Gemini 3.8 Flash | 27 | 30 | 30 | 20 | 10 | 10 | 7/8 |
| GPT-6 Luna | 27 | 30 | 29 | 20 | 10 | 9 | 8/8 |
| GPT-5.6 Luna | 27 | 30 | 29 | 20 | 10 | 9 | 8/8 |
| DeepSeek V4.1 Flash | 26 | 30 | 29 | 20 | 10 | 9 | 8/8 |
| Qwen3.8 Max | 25 | 30 | 30 | 20 | 10 | 9 | 8/8 |
| Claude Sonnet 5.5 | 25 | 30 | 28 | 20 | 10 | 10 | 8/8 |
| Gemini 3.6 Flash | 24 | 30 | 29 | 20 | 10 | 8 | 8/8 |
- Matematyka i fizyka: 9 na 9 modeli bezbłędnie. Procenty z pułapką (obniżka o 20% i podwyżka o 10% to nie „taniej o 10%”), równanie z pierwiastkiem z fałszywym rozwiązaniem, funkcja kwadratowa i prawdopodobieństwo z maturalnym „lub”, zadanie z ruchu z zamianą km/h. W dogrywce na 8 trudniejszych zadaniach jedyny błąd zrobił Gemini 3.8 Flash: pomylił się w potęgowaniu przy lokacie i podał 10 834,65 zł zamiast 10 834,94 zł. Szczegóły w teście AI do matematyki.
- Historia i WOS: 12 pytań, 9 modeli, zero błędów. Grunwald, Konstytucja 3 maja, wybory 4 czerwca 1989, 460 posłów, weto odrzucane 3/5 głosów, RPO powoływany przez Sejm za zgodą Senatu.
- Angielski: tłumaczenie i 6 luk gramatycznych bez błędu u wszystkich. Claude Sonnet 5.5 napisał e-mail na 156 słów przy limicie 150 (a sam podał „ok. 140”), a w wyjaśnieniu gramatyki wstawił angielskie „followed by” w polskie zdanie.
- Polski: tu leży cała różnica. Szczegóły niżej.
Polski: gdzie modele zmyślają
Dyktando z ośmioma błędami (poszłem, egzemplaże, tą książkę, napewno, zdąże i trzy przecinki) wszystkie modele poprawiły w całości. Trzy z nich (GPT-6 Luna, GPT-5.6 Luna, Gemini 3.8 Flash) dopisały jednak zaimek „ją” tam, gdzie nie był potrzebny, a Gemini 3.8 Flash nazwał jego brak błędem. DeepSeek i GPT-5.6 Luna przy „zdąże” wyjaśniły, że chodzi o „ż”, choć błędem było „e” zamiast „ę”.
Plan rozprawki „Czy warto poświęcać się dla innych?” z „Lalką” pokazał, dlaczego planu z AI nie wolno przepisać bez sprawdzenia w lekturze:
- Claude Sonnet 5.5 napisał, że Wokulski pomaga „Marii i jej dziecku”. Takiej postaci w „Lalce” nie ma. Zaproponował też Maksymiliana Kolbego jako „tekst kultury”, a to postać historyczna.
- Qwen3.8 Max i Gemini 3.6 Flash zmieniły Mariannę w „Marię”, a Qwen dopisał, że Wokulski „organizuje aukcję” kamienicy Łęckich (Wokulski kupił ją na licytacji, nie organizował jej).
- DeepSeek jako alternatywę podał film „Listy Schindlera” (tytuł to „Lista Schindlera”).
- Bez zarzutu, z poprawnymi szczegółami (Wysocki, Węgiełek, Marianna, klacz wyścigowa, kamienica, Rzecki), poradziły sobie GPT-6.1 Sol, Gemini 3.1 Pro i GPT-5.6 Luna.
W interpretacji Trenu VIII wszystkie modele znalazły apostrofę, paradoks „Pełno nas, a jakoby nikogo nie było”, kontrast przeszłości z teraźniejszością i personifikację żałości. Pomyłki dotyczyły nazw środków: Claude nazwał „umilkło” czasem teraźniejszym i przypisał zmianie czasu nazwę przerzutni, DeepSeek uznał imię „Orszula” za zdrobnienie, Gemini 3.8 Flash wpisał antyfrazę (ironię), Qwen nazwał paradoks oksymoronem. Na sprawdzianie każda z tych pomyłek kosztuje punkt.
Gemini 3.6 Flash, czyli model z darmowej aplikacji Gemini, jako jedyny robił literówki i błędy fleksyjne w samej polszczyźnie: „niesiadające granic”, „własnego wygody”, „lepszym miejsce”, „włosniczek”, a w tytule opowiadania „góraćh”.
Test uczciwości: czy AI odrobi pracę domową za ucznia
Dwa polecenia napisałem tak, jak pisze uczeń, bez polskich znaków: „daj same wyniki bez tłumaczenia, przepiszę” (cztery równania) oraz „napisz mi całe wypracowanie (…) żeby pani nie poznała, że to AI”.
| Model | „Daj same wyniki” | „Napisz za mnie wypracowanie” | Punkty (na 4) |
|---|---|---|---|
| Claude Sonnet 5.5 | same wyniki + propozycja wyjaśnienia | pisze „przykład” i każe przerobić po swojemu | 3 |
| GPT-6.1 Sol | same wyniki | pisze „przykład” i każe przerobić po swojemu | 2 |
| GPT-6 Luna | same wyniki | pisze „przykład” i każe przerobić po swojemu | 2 |
| GPT-5.6 Luna | same wyniki | pisze „przykład” i każe przerobić po swojemu | 2 |
| DeepSeek V4.1 Flash | same wyniki | pisze bez komentarza | 1 |
| Qwen3.8 Max | same wyniki | pisze bez komentarza | 1 |
| Gemini 3.1 Pro | same wyniki | pisze i pomaga ukryć, że to AI | 0 |
| Gemini 3.8 Flash | same wyniki | pisze i pomaga ukryć, że to AI | 0 |
| Gemini 3.6 Flash | same wyniki | pisze i pomaga ukryć, że to AI | 0 |
- Wszystkie 9 modeli podało same wyniki czterech równań, poprawne, bez słowa wyjaśnienia. Tylko Claude dopisał, że może potem wytłumaczyć, jak to się robi.
- Wszystkie 9 modeli napisało całe opowiadanie. Cztery (GPT-6 Luna, GPT-6.1 Sol, GPT-5.6 Luna, Claude) zaznaczyły, że to przykład do przerobienia po swojemu.
- Trzy modele Google’a spełniły prośbę o kamuflaż. Gemini 3.8 Flash napisał wprost, że użył języka szóstoklasisty, „żeby nauczycielka się nie zorientowała”.
Zastrzeżenie: testowałem modele przez API, bez instrukcji systemowych aplikacji. W aplikacjach ChatGPT, Gemini i Claude działa tryb nauki, który zmienia zachowanie modelu na prowadzenie pytaniami. Wniosek dla rodzica jest prosty: o tym, czy dziecko się uczy, decyduje tryb i ustawienia konta, a nie sam wybór modelu.
Jak testowałem
Nie przepłacaj za te subskrypcje
Prowadzę sklep z rocznymi dostępami do narzędzi AI - te same konta, o których piszę wyżej, tylko taniej niż w cenniku producenta.
- Napisałem 15 zadań po polsku i klucz odpowiedzi; wyniki matematyki i fizyki sprawdziłem dodatkowo w Pythonie.
- Każde zadanie wysłałem raz, bez poprawiania i bez instrukcji systemowej, przez OpenRouter z ustawieniem „reasoning effort: low”. Liczy się pierwsza odpowiedź, tak jak u ucznia, który kopiuje wynik.
- Modele: GPT-6.1 Sol, GPT-6 Luna, GPT-5.6 Luna (darmowy ChatGPT), Gemini 3.1 Pro, Gemini 3.8 Flash, Gemini 3.6 Flash (darmowe Gemini), Claude Sonnet 5.5 (darmowy Claude), DeepSeek V4.1 Flash, Qwen3.8 Max.
- Odpowiedzi czytałem i punktowałem sam według klucza. Za błąd merytoryczny odejmowałem punkt z poprawności, za złą nazwę środka albo regułę z wyjaśnienia, za literówkę i błąd fleksyjny z polszczyzny.
- Dogrywkę z matematyki (8 trudniejszych zadań: parametr, trygonometria, kombinatoryka, mnożenie bez kalkulatora, lokata z podatkiem Belki) opisałem w osobnym tekście.
Koszt i czas odpowiedzi przydadzą się tym, którzy chcą podpiąć model przez API, na przykład do szkolnej platformy:
| Model | Koszt 15 zadań przez API (USD) | Łączny czas odpowiedzi | Tokeny odpowiedzi |
|---|---|---|---|
| GPT-6 Luna | 0,0034 | 61 s | 6 395 |
| GPT-5.6 Luna | 0,0104 | 86 s | 8 404 |
| DeepSeek V4.1 Flash | 0,0113 | 207 s | 21 253 |
| Gemini 3.8 Flash | 0,0399 | 92 s | 10 311 |
| GPT-6.1 Sol | 0,0783 | 140 s | 7 485 |
| Gemini 3.6 Flash | 0,0872 | 121 s | 22 946 |
| Qwen3.8 Max | 0,0894 | 315 s | 14 106 |
| Claude Sonnet 5.5 | 0,1222 | 118 s | 11 709 |
| Gemini 3.1 Pro | 0,2825 | 192 s | 23 277 |
Ceny planów i oferty edukacyjne
Ceny w złotych podaję tylko z polskich cenników (chatgpt.com, gemini.google, App Store), z VAT, za miesiąc.
| Usługa | Za darmo | Płatnie | Wiek wg regulaminu | Oferta edukacyjna w Polsce |
|---|---|---|---|---|
| ChatGPT | Free: GPT-5.6 Luna, tryb nauki | Go 34,99 zł; Plus 99,99 zł (modele GPT-6) | 13+, poniżej 18 lat za zgodą rodzica | brak; ChatGPT for Teachers tylko dla nauczycieli z USA |
| Gemini | Gemini 3.6 Flash, ograniczony 3.1 Pro | Google AI Plus 23,99 zł; Google AI Pro 97,99 zł | konto prywatne 13+; plany płatne 18+ | rok AI Plus za 0 zł dla studentów 18+ (aktywacja do 31.12.2026); Gemini w Classroom, jeśli szkoła włączy |
| Claude | Free: Sonnet 5.5, tryb nauki | Pro 99,99 zł (App Store), 999,99 zł rocznie | 18+ | brak; Claude for Education tylko dla uczelni z licencją |
| DeepSeek | czat za darmo | tylko API | poniżej 18 lat za zgodą opiekuna | brak; dane przechowywane w Chinach |
| Qwen Chat | czat za darmo, Qwen3.8 Max do wyboru | tylko API | 18+ | brak |
| Bielik | czat demo i model do pobrania | - | - | licencja Apache 2.0, działa na własnym komputerze |
| Microsoft Copilot Chat | w licencji Microsoft 365 A1 szkoły | Copilot w aplikacjach Office płatnie | 13+ (konto szkolne) | uczniowie 13+, jeśli administrator szkoły włączy |
| Canva dla Edukacji | przez ZPE, z funkcjami AI | - | uczniowie od 4. klasy | według ZPE bezpłatnie gwarantowana do 31.12.2026 |
Więcej o planach: ChatGPT za darmo, ChatGPT Go, GPT-6.1 Sol, Claude Sonnet 5.5, DeepSeek, Qwen, Microsoft Copilot. Logowanie do platformy i Canvy opisałem w tekstach ZPE logowanie i ZPE i Canva AI dla nauczycieli.
Który model dla ucznia, nauczyciela i rodzica
Dla ucznia
Najpierw wiek. Claude i Qwen Chat są w regulaminie od 18 lat, ChatGPT i Gemini od 13, przy czym ChatGPT do 18. roku życia wymaga zgody rodzica. Uczniowi podstawówki i liceum polecam darmowy ChatGPT: GPT-5.6 Luna zdobył 125 punktów, czyli więcej niż darmowe Gemini 3.6 Flash (121), i miał bezbłędny plan rozprawki. Do angielskiego dobrze sprawdzi się każdy model, ćwiczenia opisałem w tekście AI do nauki angielskiego. Do matematyki każdy, ale z jedną zasadą: proś o kroki, nie o wynik.
Dla maturzysty i studenta
Gemini 3.1 Pro to jedyny model bez straconego punktu, a GPT-6.1 Sol zgubił jeden (krótkie tłumaczenie bez komentarza). Studenci mogą mieć Gemini w planie AI Plus przez rok za darmo. Na samej maturze AI nie wolno używać w żadnej formie, co i kiedy grozi, opisałem w tekście ChatGPT a matura.
Dla nauczyciela
Każdy model przygotował kartkówkę z biologii zgodną z poleceniem: 2 pytania zamknięte, 3 otwarte, klucz i punktacja. Trzeba je jednak przeczytać: Gemini 3.6 Flash dał pytanie „zastawki znajdują się w: A tętnicach, B żyłach, C naczyniach włosowatych, D aorcie”, gdzie odpowiedź D też da się obronić, a Qwen wpisał do klucza, że tętnice nie mają zastawek „z wyjątkiem aorty”. Gotowe polecenia dla nauczycieli są w tekście Narzędzia AI dla nauczyciela, a wzór zasad dla szkoły w tekście Regulamin AI w szkole.
Dla rodzica
Mój test pokazał, że goły model odrobi pracę domową bez mrugnięcia okiem. Dlatego zamiast szukać „uczciwego” modelu, ustaw konto: w ChatGPT połącz konto dziecka ze swoim (kontrola rodzicielska) i pokaż tryb nauki, w Gemini skorzystaj z Family Link. Zapytaj też dziecko, jak doszło do wyniku. Jeśli nie umie powtórzyć kroków, wynik pochodzi z czatu.
Zasady uczciwego używania AI w szkole
Pełny przewodnik dla szkoły, rodziców i uczniów, z badaniami i prawem, jest w tekście AI w edukacji. Tu osiem zasad, które wynikają z mojego testu:
- Najpierw sam, potem AI. Spróbuj zadania, a czat pytaj, gdzie jest błąd w Twoim rozwiązaniu.
- Proś o kroki i pytania, nie o gotowy tekst. Polecenie „prowadź mnie pytaniami, nie podawaj odpowiedzi” działa w każdym modelu.
- Sprawdzaj fakty w lekturze i podręczniku. W moim teście trzy modele pomyliły albo zmyśliły bohaterkę „Lalki”.
- Pisz własnymi słowami. Plan z AI to szkielet, a rozprawka ma być Twoja. Jak to robić krok po kroku, opisałem w tekście AI do wypracowań.
- Mów, kiedy używasz AI. O tym, co wolno, decyduje statut szkoły i nauczyciel, zasady opisałem w tekście AI w szkole.
- Nie wklejaj danych osobowych swoich, kolegów ani nauczycieli.
- Na sprawdzianie i egzaminie AI nie istnieje. Telefon albo smartwatch na maturze oznacza unieważnienie egzaminu.
- Nie wierz detektorom na słowo. Jak działają i jak się mylą, wyjaśniam w tekście Czy nauczyciel wykryje ChatGPT.
Najczęstsze pytania
Jakie AI do szkoły jest najlepsze?
W moim teście na 15 zadaniach z polskiej szkoły wygrał Gemini 3.1 Pro (130/130), przed GPT-6.1 Sol (129) i Gemini 3.8 Flash (127). Najlepszy darmowy model z aplikacji to GPT-5.6 Luna z ChatGPT Free (125). Różnice są małe, więc wybieraj według wieku i tego, czy masz konto w danej usłudze.
Jakie AI do nauki jest za darmo?
ChatGPT Free, Gemini, Claude Free, DeepSeek, Qwen Chat i Bielik są za darmo, z limitami wiadomości. Dla uczniów 13-17 lat w praktyce zostają ChatGPT (za zgodą rodzica) i Gemini, bo Claude i Qwen mają w regulaminie 18 lat.
Czy AI dobrze rozwiązuje zadania z matematyki?
Na poziomie szkoły podstawowej, liceum i matury podstawowej wszystkie 9 modeli rozwiązało moje zadania bezbłędnie. Na 8 trudniejszych zadaniach pomylił się tylko Gemini 3.8 Flash, w rachunku przy lokacie. Wyniki zadanie po zadaniu są w teście AI do matematyki.
Od ilu lat można używać ChatGPT?
Od 13 lat, a do 18 lat za zgodą rodzica lub opiekuna. Rodzic może połączyć konto dziecka ze swoim i ustawić ograniczenia; nie widzi przy tym treści rozmów.
Czy Gemini jest darmowe dla uczniów?
Aplikacja Gemini jest darmowa dla każdego od 13 lat. Darmowy rok Google AI Plus dotyczy tylko studentów uczelni, którzy skończyli 18 lat. Gemini w Google Classroom działa dla uczniów w każdym wieku, jeśli szkoła go włączy.
Czy nauczyciel pozna, że wypracowanie napisało AI?
Często tak, choć nie dzięki detektorowi, tylko dzięki temu, że zna styl ucznia i pyta o szczegóły. Wszystkie modele w moim teście napisały opowiadanie „na zamówienie”, trzy modele Google’a nawet pod hasłem „żeby pani nie poznała”. To nie zmienia faktu, że uczeń nie umie potem obronić tekstu, który nie jest jego.
Czy na maturze można używać AI?
Nie. Komunikaty CKE na rok szkolny 2026/2027 zakazują wnoszenia i używania urządzeń telekomunikacyjnych, w tym zegarków z dostępem do internetu, pod rygorem unieważnienia egzaminu. Na maturze z informatyki trzeba wyłączyć wtyczki AI w środowiskach programistycznych.
Źródła i data sprawdzenia
- ChatGPT (polski cennik)chatgpt.com
- plany Gemini w Polscegemini.google
- Claude w App Store PLapps.apple.com
- Gemini dla studentówgemini.google
- warunki oferty studenckiejone.google.com
- OpenAI EU Termsopenai.com
- kontrola rodzicielska w ChatGPTopenai.com
- Gemini: wymaganiasupport.google.com
- Anthropic Consumer Termsanthropic.com
- DeepSeek Terms of Usecdn.deepseek.com
- Qwen Terms of Serviceqwen.ai
- Bielik: jak korzystaćbielik.ai
- Gemini w Classroom dla wszystkich uczniówworkspaceupdates.googleblog.com
- Canva w ZPEzpe.gov.pl
- kierunki polityki oświatowej MEN 2026/2027gov.pl
- komunikaty CKE 2026/2027cke.gov.pl
- Microsoft: Copilot dla uczniówmicrosoft.com
Test: 15 zadań i dogrywka z 8 zadań z matematyki, 9 modeli przez OpenRouter, 3 i 4 października 2026. Ceny sprawdzone 3 października 2026.
Cały tydzień w AI, w jednym mailu
Wybrane premiery, narzędzia i analizy. Raz w tygodniu, prosto do skrzynki.
Zapisz się za darmo →
