PROMPTOWY_
Newsy

Jak zbudować prawa skalowania 10-100x taniej? Nowe podejście z arXiv

promptowy@ai:~$ cat news_1

scaling laws) to empiryczne zależności, które mówią laboratoriom AI, jak zmienia się jakość modelu wraz ze wzrostem liczby parametrów, ilości danych treningowych i budżetu obliczeniowego.

promptowy@ai:~$ cat news_2

Laboratoria używają ich do podejmowania decyzji projektowych przed właściwym treningiem dużych modeli - żeby nie wydawać miliardów dolarów na ślepo.

promptowy@ai:~$ cat news_3

Problem: żeby wyznaczyć prawo, trzeba najpierw dużo potrenować Standardowe podejście polega na wytrenowaniu gęstej siatki konfiguracji - różnych kombinacji hiperparametrów, budżetów tokenów i liczby parametrów.

promptowy@ai:~$ cat news_4

Co gorsza, do samego dopasowania prawa skalowania potrzebna jest tylko tak zwana granica najlepszych strat (best-loss frontier) dla różnych skal obliczeniowych.

promptowy@ai:~$ open --full
Czytaj całość

Jak zbudować prawa skalowania 10-100x taniej? Nowe podejście z arXiv

Otwórz artykuł na promptowy.com