Nowe narzędzie z MIT pomoże optymalizować trening dużych modeli językowych
Naukowcy z MIT opracowali uniwersalny przewodnik po prawach skalowania AI, który ma pomóc w szacowaniu wydajności dużych modeli językowych (LLM) na podstawie mniejszych modeli z tej samej rodziny. Narzędzie ma zoptymalizować proces trenowania LLM i maksymalizować wykorzystanie budżetu.
Read More