Crome: Google DeepMind przedstawia metodę na uniknięcie 'hakowania nagród’ w modelach językowych
W dążeniu do stworzenia bardziej niezawodnych i bezpiecznych modeli językowych (LLM), Google DeepMind, wspólnie z badaczami z McGill University i MILA, przedstawiło Crome – nowatorski framework oparty na przyczynowym rozumieniu generowania odpowiedzi. Crome ma za zadanie raz na zawsze rozwiązać problem tzw. hakowania nagród, który trawi obecne systemy sztucznej inteligencji.
Read More