AI wyprzedza księgowych w prostych zadaniach. Ksiąg nadal nie zamknie samodzielnie
W uporządkowanych, uproszczonych zadaniach rachunkowych modele AI okazały się szybsze, dokładniejsze i tańsze niż ludzie — wynika z badania przeprowadzonego przez firmę Mercor. W bezpośrednim porównaniu wzięło udział 12 licencjonowanych księgowych ze średnio 5,5-letnim doświadczeniem, którzy mierzyli się z wybranymi zadaniami z benchmarku APEX Accounting.
Jeszcze 18 miesięcy wcześniej najlepsze systemy AI osiągały w tego typu zadaniach wyniki poniżej średniej księgowych, wynoszącej około 37 proc. Dziś rozwiązują je niemal bezbłędnie. Ten postęp dotyczy jednak wąskiego, odizolowanego wycinka pracy rachunkowej.
Pełny obraz możliwości modeli daje dopiero kompletny benchmark APEX Accounting, obejmujący 160 zadań w symulacjach 10 firm. W tym teście najlepszy z ocenianych modeli, Claude Opus 5.5, spełnił 61,8 proc. wymaganych kryteriów. Fable 5.1 uzyskał 61 proc., a GPT-6 Astra — 57,9 proc. Jednocześnie żaden z modeli nie zdołał w pełni poprawnie rozwiązać około 58 proc. wszystkich zadań. Modele nie zawsze powtarzały też te same wyniki: nawet najbardziej spójny z nich uzyskiwał identyczny rezultat we wszystkich ośmiu próbach zaledwie w 2,6 proc. zadań.
Różnica między oboma testami wynika ze specyfiki pracy: wysoki odsetek spełnionych kryteriów w jasno zdefiniowanych poleceniach nie oznacza umiejętności niezależnego zamknięcia ksiąg. Zadania, w których AI zyskała przewagę nad ludźmi, faworyzują modele potrafiące sprawnie wyszukiwać dane i bezwzględnie trzymać się schematów.
Badanie nie uwzględniało elementów wykraczających poza czystą kalkulację: bezpośrednich rozmów z klientami, ustaleń wewnątrz zespołu ani wiedzy o kontekście działalności firmy gromadzonej przez lata. Choć AI przejmuje powtarzalne operacje, prowadzenie i zamykanie całego procesu rachunkowego nadal wymaga udziału człowieka.
