LLM

LLM

AbstRaL: nowy krok w stronę abstrakcyjnego rozumowania modeli językowych

Modele językowe często zawodzą w rozwiązywaniu problemów matematycznych i logicznych, gdy zadania są nawet nieznacznie zmodyfikowane. Nowa metoda AbstRaL, opracowana przez naukowców z Apple i EPFL, ma nauczyć sztuczną inteligencję abstrakcyjnego rozumowania, co znacznie zwiększa jej zdolność do rozwiązywania nienapotkanych wcześniej w dokładnie tej samej formie problemów. Pozwala to na bardziej uniwersalne zastosowanie modeli, niezależnie od zmian w danych wejściowych.

Read More
LLM

ReasonFlux-PRM zmienia ocenę rozumowania LLM poprzez analizę przebiegu tego procesu

Tradycyjne metody oceny dużych modeli językowych (LLM) skupiają się głównie na poprawności odpowiedzi końcowych, ignorując proces rozumowania, który do nich prowadzi. Nowe podejście, ReasonFlux-PRM, ma na celu zrewolucjonizowanie tej praktyki, koncentrując się na jakości poszczególnych kroków myślowych, co jest kluczowe dla zaawansowanych modeli generujących złożone ścieżki rozumowania.

Read More
LLMR & D

Baidu udostępnia ERNIE 4.5: ewolucja modeli LLM od 0.3B do 424B parametrów

Baidu, chiński gigant technologiczny, ogłosił udostępnienie swojej najnowszej serii modeli językowych ERNIE 4.5. Pakiet zawiera dziesięć wariantów, od kompaktowych modeli o 0.3 miliarda parametrów do rozbudowanych architektur Mixture-of-Experts (MoE) sięgających 424 miliardów parametrów, oferując globalnej społeczności badawczej i deweloperskiej dostęp do zaawansowanych zdolności analizy i generowania języka.

Read More