Chiński Kimi K3 daleko za rywalami z USA w testach hakerskich
Chiński model Kimi K3 osiągnął 32,2 proc. w benchmarku cyberbezpieczeństwa ExploitBench, podczas gdy czołowe modele amerykańskie uśredniły 76,2 proc.

👁 115 przeczytań
Chiński model Kimi K3 firmy Moonshot AI wypadł znacznie słabiej niż czołowe modele z USA w testach mierzących zdolność do przeprowadzania cyberataków - wynika ze wspólnego raportu brytyjskiego i amerykańskiego instytutu rządowego opublikowanego w czwartek, 24 lipca 2026 roku.
Badanie przeprowadziły UK Artificial Intelligence Security Institute (AISI) - jednostka badawcza działająca przy brytyjskim Departamencie Nauki i Technologii - oraz US Centre for AI Standards and Innovation (CAISI), należący do Narodowego Instytutu Standardów i Technologii w ramach Departamentu Handlu USA.
Oba instytuty przepuściły Kimi K3 przez benchmark ExploitBench, który ocenia zdolność modeli AI do znajdowania i wykorzystywania luk w zabezpieczeniach. Kimi K3 - uznawany dziś za najpotężniejszy chiński duży model językowy - uzyskał wynik 32,2 proc. Dla porównania, nienazwane wprost czołowe modele amerykańskie osiągnęły średnio 76,2 proc.
Google · Twoje źródłaPromptowy wyżej w Twoim Google - jednym kliknięciemDodaj do preferowanych źródeł →Gdzie Kimi K3 się potknął
Nie przepłacaj za te subskrypcje
Prowadzę sklep z rocznymi dostępami do narzędzi AI - te same konta, o których piszę wyżej, tylko taniej niż w cenniku producenta.
Szczególnie wymowny jest jeden wynik: Kimi K3 nie zdołał wykonać tzw. arbitrary code execution - najwyższego poziomu exploita, dającego pełną kontrolę nad atakowanym systemem - w żadnym z 41 zadań wchodzących w skład ExploitBench. Wiodące modele z USA poradziły sobie z tym w 20 przypadkach.
Na tle krajowej konkurencji Kimi K3 wypada jednak nieźle - pobił model GLM-5.2 chińskiej firmy Zhipu AI, który uzyskał 24,4 proc.
Wyniki badania trafiają w konkretny kontekst polityczny. Waszyngton od miesięcy wyraża niepokój związany z szybkim rozwojem chińskiego open-source’owego AI, który - zdaniem części decydentów - mógłby zagrażać przewadze technologicznej USA. Raport sugeruje, że przynajmniej w wymiarze cyberbezpieczeństwa ta przepaść jest wciąż bardzo wyraźna.
Kimi K3 plasuje się mniej więcej w połowie drogi między chińskimi rywalami a modelami z USA - co dla jednych jest dowodem szybkiego postępu, dla innych potwierdzeniem, że dystans pozostaje duży.
Warto jednak pamiętać, że benchmark ExploitBench mierzy konkretną, specjalistyczną zdolność - ofensywną sprawność w cyberbezpieczeństwie. Nie jest to miara ogólnej jakości modelu ani jego użyteczności w innych zastosowaniach.
Cały tydzień w AI, w jednym mailu
Wybrane premiery, narzędzia i analizy. Raz w tygodniu, prosto do skrzynki.
Zapisz się za darmo →
Chińska organizacja AI rozrosła się do 38 członków, gdy USA żądają od sojuszników wyboru stronyNewsy
Kryptowalutowa firma Trumpa pomaga sprzedawać chińskie AI, które blokuje jego własny rządNewsy
Chińskie modele AI otwartego kodu zdobywają Europę, choć Bruksela zachowuje ostrożnośćNewsy
