Uniwersalna etyka maszyn: OpenAI odkrywa, że małe dawki dobra uodparniają AI
Najnowsze testy OpenAI wykazują, że trenowanie modeli w kierunku uczciwości i pokory poznawczej uodparnia systemy na manipulacje, nawet w obszarach, których nie dotyczył trening etyczny.
Read More