Koniec matematycznych złudzeń. Nowy benchmark SOOHAK obnaża słabość AI w starciu z problemami nierozwiązywalnymi
Międzynarodowy zespół matematyków rzucił wyzwanie najpotężniejszym modelom językowym, tworząc zestaw zadań wykraczający poza podręcznikowe schematy. Wyniki SOOHAK pokazują, że AI, choć potrafi dorównać medalistom olimpiad, wciąż rozpaczliwie błądzi, próbując zidentyfikować błędne założenia lub brak rozwiązania.
Read More