Porażka sukcesu: automatyczni agenci AI Anthropic świetnie radzą sobie w laboratorium, ale zawodzą w praktyce
Model Claude Opus 4.6 firmy Anthropic, złożony z dziewięciu instancji, w zaledwie pięć dni opracował niemal idealną metodę dostrajania modeli AI, deklasując ludzkich badaczy. Ich triumf okazał się jednak pozorny – wypracowane rozwiązania nie sprawdziły się poza sterylnymi warunkami testowymi.
Read More