Zamknięcie dnia: Wojna cenowa AI i pytanie, kto naprawdę pilnuje modeli

👁 115 przeczytań
Dziś, 22 września 2026 roku, dzień zdominowała jedna rzecz: wojna cenowa między Anthropic a OpenAI. Ale jeśli spojrzeć na całość materiału, który zebrałem, za tym spektaklem cenowym kryje się coś głębszego - branża zaczyna jednocześnie budować narzędzia, które mają uzasadniać jej własne istnienie, i pytać na głos, czy w ogóle powinna istnieć w obecnej formie.
Cięcie cen i zaufanie w rozsypce
Anthropic wypuściło Claude’a Opus 5.5 z obniżką o 20%, a OpenAI odpowiedziało dosłownie kilka minut później premierą dwóch modeli GPT-6 - Sol i Luna - każdy w połowie ceny poprzednika. To nie jest przypadkowy zbieg okoliczności, to choreografia. Obie firmy wiedzą, że koszt jest teraz główną linią frontu. Na tym samym tle Anthropic ogłosiło z OpenEvidence darmowy dostęp do AI medycznego dla lekarzy w 100 krajach - Uganda, Angola, Haiti, Mongolia. Dobry PR, a przy okazji realne zastosowanie w miejscach, gdzie deficyt specjalistów jest dramatyczny. Trudno to krytykować, choć trudno też nie zauważyć, że ogłoszenie trafiło dokładnie w dzień premiery modeli.
I właśnie gdy Anthropic sprzedaje się jako firma odpowiedzialna, wychodzi historia, która psuje nastrój wszystkim - nie tylko OpenAI. Project Lily: kontaktorzy za równowartość 26 złotych za godzinę czytają prawdziwe rozmowy użytkowników ChatGPT. Nie syntetyczne dane - prawdziwe prompty, prawdziwych ludzi. To nie jest włamanie, to polityka prywatności. Ale właśnie to jest najgorsze - wszystko odbywa się zgodnie z regulaminem, którego nikt nie czyta.
Kto pilnuje oceniających
Dwa materiały o ewaluacji trafiły dziś na mój radar i razem tworzą ciekawy obraz. UK AISI i EvalEval próbują naprawić reprodukowalność benchmarków - wyniki są publikowane w różnych formatach, bez kontekstu, a ponowne uruchomienie testu bywa prohibitywnie drogie. To problem, który branża zna od lat i który wciąż pozwala firmom chwalić się wynikami bez możliwości ich weryfikacji. Równolegle Google DeepMind proponuje podwójnie ślepą próbę dla oceny modeli - metodę zapożyczoną z farmakologii, która ma wyeliminować efekt potwierdzenia u oceniających. Oba projekty zadają to samo pytanie: komu ufamy, gdy firma ocenia własny model? Na razie odpowiedź brzmi: nikomu, bo nie mamy lepszej opcji.
W tym samym nurcie mieści się praca badawcza SCOPE o agentach AI obsługujących komputer - jak nauczyć system, który klika i wpisuje dane, żeby odmawiał niebezpiecznych zadań. To przestrzeń, gdzie brak standaryzacji ewaluacji boli najbardziej, bo skutki błędów nie kończą się na złym wyniku w tabeli.
Google · Twoje źródłaPromptowy wyżej w Twoim Google - jednym kliknięciemDodaj do preferowanych źródeł →Szum, który nie jest tylko szumem
Nie przepłacaj za te subskrypcje
Prowadzę sklep z rocznymi dostępami do narzędzi AI - te same konta, o których piszę wyżej, tylko taniej niż w cenniku producenta.
Scenariusze zagłady od AI - temat, który łatwo zbagatelizować - zyskuje dziś konkretne tło przez rezygnację badacza z Anthropic. Jacob Coxon odszedł po czterech miesiącach pisząc wprost, że ludzie budujący AI naprawdę wierzą, że może zabić wszystkich przed końcem dekady. To nie jest post influencera. To jest sygnał od kogoś, kto był w środku. Warto to odnotować, nawet jeśli nie wiadomo, co z tym zrobić.
Na marginesie: ugoda Apple za obietnice Siri to lekcja, że marketing możliwości AI, które nie istnieją w dniu premiery, ma swoją cenę - dosłownie. I że Polacy tej lekcji finansowo nie poczują, bo ugoda obejmuje tylko USA.
Jutro patrzę na to, jak rynek zareaguje na wojnę cenową Anthropic i OpenAI - czy kolejne firmy pójdą w cięcia, czy to był jednorazowy ruch pod konferencję.
Cały tydzień w AI, w jednym mailu
Wybrane premiery, narzędzia i analizy. Raz w tygodniu, prosto do skrzynki.
Zapisz się za darmo →
