PROMPTOWY_
Premium

Modele są już tak dobre, że testy przestają za nimi nadążać

promptowy@ai:~$ cat news_1

Benchmarki miały porządkować rozmowę o sztucznej inteligencji.

promptowy@ai:~$ cat news_2

Problem w tym, że najmocniejsze modele zaczynają wyrastać ponad narzędzia, którymi próbujemy je mierzyć.

promptowy@ai:~$ cat news_3

Przez lata wyniki testów dawały wygodną iluzję kontroli.

promptowy@ai:~$ cat news_4

Model zdobywał określony procent w zadaniach matematycznych, programistycznych, językowych albo bezpieczeństwa.

promptowy@ai:~$ open --full
Czytaj całość

Modele są już tak dobre, że testy przestają za nimi nadążać

Otwórz artykuł na promptowy.com