› GPT-6 Astra uzyskał 99,9% na benchmarku ARC-AGI-3, podczas gdy poprzednik GPT-5.6 Sol osiągał zaledwie 7,8%.
› Model zdobył 100% na ExploitBench i wykrył dwa nieznane wcześniej błędy zero-day, przekraczając próg „Critical" w wewnętrznych ramach bezpieczeństwa OpenAI.
› Wskaźnik halucynacji spadł z 12,2% do 4,2%, a model jest już dostępny dla użytkowników ChatGPT Plus, Pro, Business i Enterprise.