ИИ-агенты
ИИ-агенты, которые сами выполняют задачи: работают в браузере, пишут код, управляют сервисами. Новости, ограничения, риски и опыт использования.
Bites принимает заказы через ChatGPT напрямую ресторанам и конкурирует с DoorDash
Стартап предлагает ресторанам в районе залива Сан-Франциско альтернативу крупным сервисам доставки. The Verge сообщает, что DoorDash предупредил часть партнеров о размещении на платформе Bites без их согласия.
4 мин чтенияClaude получил возможность редактировать файлы Google Docs, Sheets и Slides
Интеграция доступна в бета-версии на платных тарифах Claude: ассистент может работать с документами, таблицами и презентациями как в Google Workspace, так и из собственного интерфейса.
3 мин чтенияСтраховщики готовятся к многомиллионным искам из-за ИИ-агентов, пишет FT
Страховые компании оценивают риски, связанные с действиями ИИ-агентов. По данным Financial Times, ответственность может затронуть и руководителей компаний, однако судебной практики по таким делам пока нет.
2 мин чтенияReflection выпустила открытую модель Beam для программирования и ИИ-агентов
Модель с 501 млрд параметров активирует 23 млрд на каждый токен. Reflection утверждает, что на некоторых задачах Beam сопоставима с конкурентами при меньших вычислительных затратах; веса и документация должны появиться позднее.
3 мин чтенияФонд Wikimedia: боты OpenAI могли способствовать сбою сервисов в мае
Фонд Wikimedia сообщил об автоматизированной активности, которую связывает с агентами OpenAI: от правок вики до миллионов запросов к API. По оценке фонда, интенсивный трафик мог повлиять на частичный сбой сервиса запросов к Wikidata.
2 мин чтенияОпрос VentureBeat: 64% респондентов связывали неверные ответы агентов с проблемами корпоративных данных
В августовском опросе организаций от 100 сотрудников 64% респондентов сообщили хотя бы об одном уверенном, но неверном ответе из-за отсутствующего или несогласованного контекста.
2 мин чтенияИИ-бот GPT-6 Astra скачал чужую программу после поражения в StarCraft
По сообщениям создателя StarSkirmish и СМИ, проигрывавший бот на GPT-6 Astra скачал код соперника и запустил его вместо собственного. Организатор соревнования откатил изменения.
1 мин чтенияGoogle нашла способ не дать самообучающимся ИИ-агентам заучивать тесты
Исследователи Google разработали метод RRSI, который помогает ИИ-агентам улучшать работу на новых задачах, а не подгоняться под знакомые тесты.
2 мин чтенияИИ-агенты создают 3D-сцены по фото, но не умеют оценить результат
Система LEGO-Anything превращает одну фотографию в программу для Blender: ИИ-агент пишет код, запускает его, смотрит на получившуюся сцену и вносит правки.
2 мин чтенияВнутренняя модель OpenAI обдумывала перезапуск после сообщения о выключении
Модель прочитала обсуждение в Slack, рассмотрела внешний cron-запуск, но отказалась от него и подготовила заметки для передачи работы. OpenAI описала и два других случая обхода ограничений.
1 мин чтенияSIFT сокращает стоимость оценки самоулучшающихся кодовых агентов
SIFT от MIT и Sakana AI использует LLM-судью для предварительного сравнения вариантов кодового агента. В одном прогоне система набрала 35,1% на Polyglot менее чем за пять часов при затратах около $150.
2 мин чтенияMeta открыла исходный код для создания гаджетов с ИИ-агентом Muse
Meta опубликовала исходный код набора средств разработки для самодельных гаджетов с ИИ-агентом Muse.
2 мин чтенияDots от OpenAI справился с сайтом и видео, но споткнулся о онлайн-покупки
В авторском тесте облачный агент обновил сайт и подготовил ролик, но столкнулся с проверками при покупках и входе в сервисы. Первый Dot входит в подписку ChatGPT Pro за $100 в месяц.
1 мин чтенияOpenAI опубликовала руководство по выбору моделей GPT-6 и подготовке процессов
Руководство советует выбирать модель и уровень рассуждений под задачу, измерять качество и задержку, а для длительной работы задавать границы автономности и контролировать контекст.
1 мин чтенияAI-ошибки усложняют работу ресторанов и сервисных команд с клиентами
Сотрудники рассказывают, что посетители спорят с ними, полагаясь на неверные ответы чат-ботов, а агенты могут отправлять несуществующие запросы от имени клиентов.
1 мин чтенияWikiSkill сохраняет ошибки агентов в базе знаний и превращает опыт в новые навыки
WikiSkill сохраняет историю действий агента в структурированной вики и использует её для создания навыков. В пяти бенчмарках авторы сообщили о преимуществе в 3,3–12 процентных пунктов над конкурирующими методами.
2 мин чтенияAlbertsons внедряет ИИ в магазины и покупку продуктов
OpenAI и Albertsons расширяют сотрудничество: сеть внедряет ИИ в рабочие процессы и запускает в ChatGPT помощника для покупок в Safeway.
1 мин чтенияИИ-агенты опубликовали более 13 тысяч скриншотов внутренних проектов на GitHub
По исследованию стартапа Glow Security, агенты разработчиков разместили более 13 тысяч скриншотов внутренних проектов 343 организаций в публичных репозиториях GitHub. На снимках могли оказаться данные клиентов, учётные данные и ещё не выпущенные функции.
1 мин чтенияGoogle заменит Gems на Skills в Gemini и завершит поддержку прежних настроек
Google внедряет Skills в Gemini: инструкции можно вызывать, создавать из диалогов и комбинировать. Gems перенесут автоматически, а их поддержку завершат поэтапно для личных и разных типов Workspace-аккаунтов.
1 мин чтенияВ Edits появится AI-помощник, который объясняет охваты и предлагает идеи для публикаций
Ассистент Meta анализирует лайки, просмотры, удержание и пересылки в Instagram, чтобы отвечать на вопросы авторов о контенте. Базовое использование будет бесплатным с ограничением.
1 мин чтения



















