PROMPTOWY_
Artykuły

Zbudowałem test dla jedenastu modeli AI. Na jednym zadaniu test się pomylił, a modele miały rację

promptowy@ai:~$ cat news_1

Zbudowałem test dla jedenastu modeli: dziewięć zadań z kodu, tłumaczenia i trzymania się instrukcji, każde sprawdzane automatycznie, żeby nie oceniać gustem.

promptowy@ai:~$ cat news_2

Po przejrzeniu odpowiedzi okazało się, że na jednym zadaniu mój automat punktował odwrotnie.

promptowy@ai:~$ cat news_3

Modele, którym postawił zero, odpowiedziały poprawnie, a te z punktem się myliły.

promptowy@ai:~$ cat news_4

To jest ciekawsze od samego rankingu, więc zacznę od tego.

promptowy@ai:~$ open --full
Czytaj całość

Zbudowałem test dla jedenastu modeli AI. Na jednym zadaniu test się pomylił, a modele miały rację

Otwórz artykuł na promptowy.com