ИИ обходит бухгалтеров в типовых задачах, но пока не может работать без контроля
В структурированных задачах по ведению бухгалтерии модели ИИ справляются быстрее, точнее и дешевле бухгалтеров — показало исследование Mercor.
Главное событие
В структурированных задачах по ведению бухгалтерии модели ИИ справляются быстрее, точнее и дешевле бухгалтеров — показало исследование Mercor. 12 лицензированных специалистов со средним стажем 5,5 года решали упрощённые задания из теста APEX Accounting. Полтора года назад лучшие модели набирали меньше среднего результата бухгалтеров — около 37%. Теперь те же задания они выполняют почти без ошибок.
Что показывают данные
Но на полном тесте результаты скромнее. Он включает 160 заданий для 10 условных компаний; их подготовили более 40 специалистов со средним стажем 11 лет. Среди моделей лидирует Claude Opus 5.5 с 61,8% выполненных критериев, далее идут Fable 5.1 с 61% и GPT-6 Astra с 57,9%. При этом почти 60% заданий ни одна модель не решила полностью: ИИ пока не умеет закрывать отчётный период без контроля.
Есть и важное ограничение: исследование проверяло именно то, что хорошо даётся ИИ, — поиск нужных деталей и точное выполнение инструкций. В нём не оценивали общение с клиентами и коллегами и использование контекста, который накапливается годами. Поэтому бухгалтеров пока рано заменять, хотя их работа может заметно ускориться.