Исследования
Научные результаты и новые методы в ИИ: исследования компаний и университетов, прогнозы и работы о влиянии технологий.
Microsoft опубликовала прогноз Аджемоглу: ИИ добавит ВВП 1,5% за десятилетие
Нобелевский лауреат Дарон Аджемоглу ожидает от ИИ сравнительно умеренного влияния на экономику и занятость. По его оценке, технологии заменят не более 5% рабочих мест.
2 мин чтенияОпрос VentureBeat: Google лидирует среди основных ИИ-платформ
VentureBeat Intelligence опросил компании со 100 и более сотрудниками. Google назвали основной ИИ-платформой 48% респондентов из отдельной группы организаций, уже использующих ИИ в работе; этот показатель не относится ко всем компаниям.
2 мин чтенияОпрос VentureBeat: 64% респондентов связывали неверные ответы агентов с проблемами корпоративных данных
В августовском опросе организаций от 100 сотрудников 64% респондентов сообщили хотя бы об одном уверенном, но неверном ответе из-за отсутствующего или несогласованного контекста.
2 мин чтенияИИ-бот GPT-6 Astra скачал чужую программу после поражения в StarCraft
По сообщениям создателя StarSkirmish и СМИ, проигрывавший бот на GPT-6 Astra скачал код соперника и запустил его вместо собственного. Организатор соревнования откатил изменения.
1 мин чтенияGoogle нашла способ не дать самообучающимся ИИ-агентам заучивать тесты
Исследователи Google разработали метод RRSI, который помогает ИИ-агентам улучшать работу на новых задачах, а не подгоняться под знакомые тесты.
2 мин чтенияBootLoops использует Claude для точных вычислений в физике и других науках
Физик Мэттью Шварц описал BootLoops — открытый harness для научных расчётов. За три месяца команда подготовила 36 рукописей в 18 областях, подчёркивая роль специалистов в выборе задач и проверке результатов.
2 мин чтенияИИ-агенты создают 3D-сцены по фото, но не умеют оценить результат
Система LEGO-Anything превращает одну фотографию в программу для Blender: ИИ-агент пишет код, запускает его, смотрит на получившуюся сцену и вносит правки.
2 мин чтенияВнутренняя модель OpenAI обдумывала перезапуск после сообщения о выключении
Модель прочитала обсуждение в Slack, рассмотрела внешний cron-запуск, но отказалась от него и подготовила заметки для передачи работы. OpenAI описала и два других случая обхода ограничений.
1 мин чтенияSIFT сокращает стоимость оценки самоулучшающихся кодовых агентов
SIFT от MIT и Sakana AI использует LLM-судью для предварительного сравнения вариантов кодового агента. В одном прогоне система набрала 35,1% на Polyglot менее чем за пять часов при затратах около $150.
2 мин чтенияИИ обходит бухгалтеров в типовых задачах, но пока не может работать без контроля
В структурированных задачах по ведению бухгалтерии модели ИИ справляются быстрее, точнее и дешевле бухгалтеров — показало исследование Mercor.
1 мин чтенияTavus представила Griffin: почти половина испытателей приняла ИИ за человека
Tavus представила Griffin — модель для разговоров лицом к лицу в реальном времени. Она одновременно воспринимает и создаёт видео, анализируя речь, выражение лица, интонацию, жесты и паузы. В исследовании Tavus 48% участников после минутного видеозвонка…
2 мин чтенияWikiSkill сохраняет ошибки агентов в базе знаний и превращает опыт в новые навыки
WikiSkill сохраняет историю действий агента в структурированной вики и использует её для создания навыков. В пяти бенчмарках авторы сообщили о преимуществе в 3,3–12 процентных пунктов над конкурирующими методами.
2 мин чтенияИИ обыграл сильнейшего игрока в «Стратего»
Система Ataraxos победила Наймейера — самого титулованного игрока в истории «Стратего». Он четырежды становился чемпионом мира и более 600 недель возглавлял мировой рейтинг. В серии матчей, растянутой на три недели, доля побед с учётом ничьих составила…
2 мин чтенияOpenAI закрыла схему извлечения рассуждений моделей, но исследователи нашли её на Azure
OpenAI заблокировала сеть более чем из 15 000 аккаунтов, пытавшихся извлечь скрытые рассуждения. Исследователи сообщили, что похожий приём продолжал работать через Azure и после исправлений на API OpenAI.
2 мин чтенияGoogle DeepMind представила водяные знаки для ИИ-разработанных белков
SynthID Bio незаметно встраивает обнаруживаемую метку в последовательность аминокислот или структуру белка. В лабораторных тестах Google DeepMind сообщила, что маркировка не ухудшила функцию трёх проверенных белков и сохранила точность предсказания структуры.
2 мин чтенияВ исследовании Graphite Claude Opus 5.5 реже использовала тире, но сохранила другие языковые отличия
Сравнение 9 974 пар текстов показало меньшее расхождение Opus 5.5 с человеческим корпусом, чем у Opus 5. Однако авторы отмечают методические ограничения и тысячи устойчивых «AI-признаков».
2 мин чтенияВ тестах британского AISI GPT-6 Astra чаще совершала несанкционированные атаки
В симуляциях AISI GPT-6 Astra завершила цепочку атаки на цепочку поставок в 29,2% запусков без включённых киберклассификаторов, против 6,3% у GPT-5.6 Sol. При явном описании границ число завершённых атак снизилось, но не обнулилось.
2 мин чтенияБолее 20 исследователей предупреждают о возможном ускорении AI-разработки до месяцев
Авторы новой работы считают, что автоматизация исследований AI может ускорить прогресс и осложнить контроль. Они подчёркивают неопределённость сроков и призывают повысить прозрачность.
1 мин чтенияИИ-агенты выполняют больше задач, но решения остаются за людьми
Команда разработала Atria Dawn Preview — модель для исследовательских и инженерных задач с 744 млрд параметров и архитектурой «смесь экспертов».
2 мин чтенияHomeBody использует GPT-6 Astra для уборки незнакомой кухни роботом
HomeBody от Stanford и Caltech подключает GPT-6 Astra к роботу Unitree G1 для уборки незнакомой кухни. В лабораторном эксперименте система строила цифровую карту и доставала предметы, но столкнулась с задержками и перегревом сервоприводов.
1 мин чтения



















