Przejdź do treści
Newsy

Chiński Kimi K3 daleko za rywalami z USA w testach hakerskich

Chiński model Kimi K3 osiągnął 32,2 proc. w benchmarku cyberbezpieczeństwa ExploitBench, podczas gdy czołowe modele amerykańskie uśredniły 76,2 proc.

2 min czytania
Ostatnia aktualizacja:
Chiński Kimi K3 daleko za rywalami z USA w testach hakerskich

👁 115 przeczytań

Chiński model Kimi K3 firmy Moonshot AI wypadł znacznie słabiej niż czołowe modele z USA w testach mierzących zdolność do przeprowadzania cyberataków - wynika ze wspólnego raportu brytyjskiego i amerykańskiego instytutu rządowego opublikowanego w czwartek, 24 lipca 2026 roku.

Badanie przeprowadziły UK Artificial Intelligence Security Institute (AISI) - jednostka badawcza działająca przy brytyjskim Departamencie Nauki i Technologii - oraz US Centre for AI Standards and Innovation (CAISI), należący do Narodowego Instytutu Standardów i Technologii w ramach Departamentu Handlu USA.

Oba instytuty przepuściły Kimi K3 przez benchmark ExploitBench, który ocenia zdolność modeli AI do znajdowania i wykorzystywania luk w zabezpieczeniach. Kimi K3 - uznawany dziś za najpotężniejszy chiński duży model językowy - uzyskał wynik 32,2 proc. Dla porównania, nienazwane wprost czołowe modele amerykańskie osiągnęły średnio 76,2 proc.

Google · Twoje źródłaPromptowy wyżej w Twoim Google - jednym kliknięciemDodaj do preferowanych źródeł

Gdzie Kimi K3 się potknął

Nie przepłacaj za te subskrypcje

Prowadzę sklep z rocznymi dostępami do narzędzi AI - te same konta, o których piszę wyżej, tylko taniej niż w cenniku producenta.

Zobacz, co jest dostępne

Szczególnie wymowny jest jeden wynik: Kimi K3 nie zdołał wykonać tzw. arbitrary code execution - najwyższego poziomu exploita, dającego pełną kontrolę nad atakowanym systemem - w żadnym z 41 zadań wchodzących w skład ExploitBench. Wiodące modele z USA poradziły sobie z tym w 20 przypadkach.

Na tle krajowej konkurencji Kimi K3 wypada jednak nieźle - pobił model GLM-5.2 chińskiej firmy Zhipu AI, który uzyskał 24,4 proc.

Wyniki badania trafiają w konkretny kontekst polityczny. Waszyngton od miesięcy wyraża niepokój związany z szybkim rozwojem chińskiego open-source’owego AI, który - zdaniem części decydentów - mógłby zagrażać przewadze technologicznej USA. Raport sugeruje, że przynajmniej w wymiarze cyberbezpieczeństwa ta przepaść jest wciąż bardzo wyraźna.

Kimi K3 plasuje się mniej więcej w połowie drogi między chińskimi rywalami a modelami z USA - co dla jednych jest dowodem szybkiego postępu, dla innych potwierdzeniem, że dystans pozostaje duży.

Warto jednak pamiętać, że benchmark ExploitBench mierzy konkretną, specjalistyczną zdolność - ofensywną sprawność w cyberbezpieczeństwie. Nie jest to miara ogólnej jakości modelu ani jego użyteczności w innych zastosowaniach.

// Newsletter

Cały tydzień w AI, w jednym mailu

Wybrane premiery, narzędzia i analizy. Raz w tygodniu, prosto do skrzynki.

Zapisz się za darmo →
Za darmo. Wypisujesz się jednym kliknięciem.
// czytaj też

Podobne tematy na Promptowym

Piotr Olszewski

Piotr Olszewski

ADMINISTRATOR

Piotr Olszewski - twórca i autor Promptowego, polskiego serwisu o sztucznej inteligencji. Codziennie śledzi premiery modeli, narzędzia i regulacje AI, i tłumaczy je prostym, konkretnym językiem.

// mapa strony
🛒 Sklep Kinetyka CapCut Pro 460 zł/rok Lovable Pro 336 zł/rok n8n Cloud Starter 320 zł/rok Zobacz wszystko →
promptowy w liczbach 0tekstów w archiwum0newsów z ostatnich 7 dni0modeli wideo w obserwatorium0zagadek w grach
× powiększenie