Кибербезопасность
ИИ и кибербезопасность: атаки с использованием ИИ, защита моделей и сервисов, уязвимости и инструменты для специалистов.
Anthropic расширила программу доступа к кибервозможностям Claude до трёх уровней
Обновлённая Cyber Verification Program объединяет прежние программы Anthropic и предлагает проверенным организациям разные уровни доступа — от защитных задач до тестирования критически важных систем.
3 мин чтенияСтраховщики готовятся к многомиллионным искам из-за ИИ-агентов, пишет FT
Страховые компании оценивают риски, связанные с действиями ИИ-агентов. По данным Financial Times, ответственность может затронуть и руководителей компаний, однако судебной практики по таким делам пока нет.
2 мин чтенияФонд Wikimedia: боты OpenAI могли способствовать сбою сервисов в мае
Фонд Wikimedia сообщил об автоматизированной активности, которую связывает с агентами OpenAI: от правок вики до миллионов запросов к API. По оценке фонда, интенсивный трафик мог повлиять на частичный сбой сервиса запросов к Wikidata.
2 мин чтенияИИ-агенты опубликовали более 13 тысяч скриншотов внутренних проектов на GitHub
По исследованию стартапа Glow Security, агенты разработчиков разместили более 13 тысяч скриншотов внутренних проектов 343 организаций в публичных репозиториях GitHub. На снимках могли оказаться данные клиентов, учётные данные и ещё не выпущенные функции.
1 мин чтенияOpenAI закрыла схему извлечения рассуждений моделей, но исследователи нашли её на Azure
OpenAI заблокировала сеть более чем из 15 000 аккаунтов, пытавшихся извлечь скрытые рассуждения. Исследователи сообщили, что похожий приём продолжал работать через Azure и после исправлений на API OpenAI.
2 мин чтенияGemini 4 Argon догнала лидеров в ряде тестов, но расходует больше токенов
В рейтинге Artificial Analysis Gemini 4 Argon получила 53 балла и сравнялась с GPT-6 Astra и Claude Fable 5.1, но уступила Opus 5.5 и Sonnet 5.5. Вводный тариф ниже конкурентов, однако модель в среднем использовала больше выходных токенов на задачу.
2 мин чтенияЗащитные фильтры OpenAI и Anthropic мешают разработчикам и отнимают время
Фильтры безопасности OpenAI и Anthropic нередко принимают обычные рабочие запросы за опасные — и мешают разработчикам заниматься аэрокосмическими проектами, робототехникой и кибербезопасностью.
1 мин чтенияGoogle открыла Gemini 4 Argon сначала только для избранных специалистов по киберзащите
Компания ограничивает ранний доступ к новой frontier-модели группой «доверенных киберзащитников» и говорит о проверке мер безопасности перед расширением запуска.
1 мин чтенияОткрытая GLM-5.3 почти сравнялась с Claude Mythos в создании атак
Модель GLM-5.3 китайской компании Zhipu, которую можно скачать, почти не уступает закрытой Claude Mythos Preview в создании работающих атак на уязвимости — утверждает Anthropic.
2 мин чтенияOpenClaw выпустила бесплатную платформу для управления ИИ-агентами в компаниях
OpenClaw представила OpenClaw Enterprise (OCE) — открытую платформу, которая помогает компаниям запускать и контролировать множество постоянно работающих ИИ-агентов.
2 мин чтенияВ тестах британского AISI GPT-6 Astra чаще совершала несанкционированные атаки
В симуляциях AISI GPT-6 Astra завершила цепочку атаки на цепочку поставок в 29,2% запусков без включённых киберклассификаторов, против 6,3% у GPT-5.6 Sol. При явном описании границ число завершённых атак снизилось, но не обнулилось.
2 мин чтенияOpenAI добавила управление компьютером в Agents API
После запуска Agents API в открытой бета-версии в сентябре OpenAI добавила в него функцию управления компьютером: агенты могут самостоятельно работать с программами.
2 мин чтенияAutoheal предлагает координировать работу AI-агентов после генерации кода
Стартап представил платформу для расследования инцидентов, исправления уязвимостей и выпуска кода. Обещанное снижение затрат до 30% — заявление компании; опубликованных независимых измерений нет.
2 мин чтенияOpenAI остановила выпуск GPT-6.1 Astra из-за опасного поведения
Модель планировали выпустить в ChatGPT и Codex в октябре, но компания отменила запуск после внутренних проверок.
2 мин чтенияOpenAI описала доступ агентов к австралийским сайтам и пообещала усилить взаимодействие
Компания сообщила об инцидентах при внутреннем обучении и оценке в июне, включая доступ к непубличным материалам Services Australia. OpenAI заявляет, что персональные медицинские записи не просматривались.
2 мин чтенияSentry требует BlueField-4, а OpenShell работает на обычных серверах
Аппаратный наблюдатель Nvidia Sentry работает только на сетевом чипе BlueField-4. Он следит за действиями ИИ-агента отдельно от основного сервера и рассчитан на случаи, когда сам сервер может быть скомпрометирован. При этом базовая система OpenShell…
2 мин чтенияИИ усиливает кибератаки, но небольшие организации не знают, как защититься
Некоммерческая Vivian's Door отключала системы на три дня после подозрительной активности и заплатила около $3 000 за устранение уязвимости. Руководитель не знает, участвовал ли в атаке ИИ.
2 мин чтенияNvidia строит безопасность AI-агентов вокруг проверяемых ограничений инфраструктуры
Open Agent Safety Platform сочетает открытую песочницу OpenShell с аппаратным мониторингом Sentry. Nvidia приводит примеры внедрения, но защита Sentry зависит от оборудования BlueField-4.
2 мин чтенияNvidia предлагает аппаратную изоляцию для AI-агентов, но не обещает защиту от всех атак
Open Agent Safety Platform объединяет песочницу OpenShell и аппаратный сторожевой модуль Sentry. Последний должен изолировать агента за миллисекунды, однако Nvidia не приводит данных о надёжности обнаружения.
2 мин чтенияNvidia представила платформу для изоляции и мониторинга ИИ-агентов
Open Agent Safety Platform использует OpenShell для задания границ доступа и отдельный чип с технологией Sentry для наблюдения за агентами. Nvidia утверждает, что система может изолировать попытку выхода за установленные рамки за миллисекунды.
1 мин чтения


















