PROMPTOWY_
Magazyn

GPT-6 Astra dla programistów: co mówią testy kodu, a czego nie mówią

promptowy@ai:~$ cat news_1

Dla programisty premiera nowego modelu sprowadza się do jednego pytania: czy zrobi lepiej to, co dzisiaj robi mój obecny model, i za ile.

promptowy@ai:~$ cat news_2

Odpowiedź z testów opublikowanych przy premierze GPT-6 Astra jest mniej jednoznaczna, niż sugeruje komunikat, i warto ją rozłożyć na części.

promptowy@ai:~$ cat news_3

Trzy testy, trzy różne obrazy W Terminal-Bench 4.0, który mierzy pracę w wierszu poleceń na realnych zadaniach, Astra ma 57,7 punktu.

promptowy@ai:~$ cat news_4

Claude Fable 5.1 ma 55,8, Claude Opus 5 52,3, starszy Fable 5 42,0, a GPT-5.6 Sol 37,3.

promptowy@ai:~$ open --full
Czytaj całość

GPT-6 Astra dla programistów: co mówią testy kodu, a czego nie mówią

Otwórz artykuł na promptowy.com