Исследование FRI: AI достиг математического рубежа раньше прогнозов экспертов

В панели из 339 специалистов и отдельной группе суперпрогнозистов золотой уровень IMO ожидали на годы позже, чем он был достигнут. Авторы предупреждают о смещении промежуточного анализа в пользу найденных недооценок.

Кто участвовал в прогнозировании

Forecasting Research Institute (FRI) собирает оценки прогресса AI с середины 2022 года. Первый раунд продольной панели LEAP включал 339 специалистов: 76 компьютерных учёных, 76 представителей индустрии, 68 экономистов и 119 экспертов по политике AI. В выборку вошли профессора ведущих университетов и авторы часто цитируемых работ; отдельно анализировались суперпрогнозисты с подтверждённой точностью предсказаний.

Математический успех опередил ожидания

Самый заметный разрыв касался математических задач. AI достиг уровня золотой медали Международной математической олимпиады в июле 2025 года — на пять лет раньше медианного прогноза экспертов и на десять лет раньше медианного прогноза суперпрогнозистов. Эти оценки были собраны в 2022 году, до запуска ChatGPT. Для уже наступивших контрольных результатов FRI приводит среднюю вероятность 24,6% у экспертов и 9,7% у суперпрогнозистов; для результата IMO — 8,6% и 2,3% соответственно.

Не все прогнозы оказались слишком осторожными

В небольшом контролируемом испытании с языковой моделью и доступом к интернету биологические лабораторные задачи выполнили 5,2% участников, тогда как одни интернет-инструменты дали 6,6%. Рост самостоятельного вождения эксперты также могли переоценить: медианная оценка доли поездок в США в 2027 году составляла 7,3%, против 2,5% в проекции языковой модели. Экономику, занятость и крупные риски AI пока надёжно оценить нельзя.

Top AI experts badly underestimated how fast the field is moving, study finds