LLM

LLMR & D

ByteDance prezentuje Seed-Coder: Nowe podejście do szkolenia modeli LLM dla kodu

ByteDance wprowadza Seed-Coder, nową rodzinę modeli językowych dla kodu (Code LLM), która redefiniuje proces ich wstępnego szkolenia. Zamiast ręcznej selekcji danych, Seed-Coder opiera się na innowacyjnym, zautomatyzowanym podejściu wykorzystującym inne LLM do kuracji olbrzymiego, sześciobilionowego korpusu danych. To otwartoźródłowe rozwiązanie ma szansę znacząco przyspieszyć rozwój AI w inżynierii oprogramowania.

Read More
LLMR & DRozumowanie

Przełom w rozumowaniu modeli językowych: GURU poszerza horyzonty uczenia się przez wzmacnianie

Tradycyjne podejścia do uczenia się przez wzmacnianie (RL) w sztucznej inteligencji koncentrowały się na wąskich domenach, takich jak matematyka czy kodowanie, ograniczając zdolność modeli językowych do generalizacji. Nowe badania wprowadzają GURU, przełomowy zbiór danych, który ma zmienić ten paradygmat, umożliwiając LLM-om kompleksowe rozumowanie w sześciu różnorodnych dziedzinach.

Read More
LLM

MiniMax-M1: 456-miliardowy model hybrydowy – przyszłość dużych modeli językowych w długim kontekście

MiniMax AI zaprezentował MiniMax-M1, otwarty model rozumowania o 456 miliardach parametrów, który rewolucjonizuje przetwarzanie długiego kontekstu i uczenie ze wzmocnieniem. Nowa architektura, łącząca hybrydową uwagę i innowacyjny algorytm CISPO, efektywnie przekracza dotychczasowe ograniczenia obliczeniowe, otwierając drogę do bardziej skalowalnych i wydajnych zastosowań AI w świecie rzeczywistym.

Read More