Все темыСюжет

Кибербезопасность

ИИ и кибербезопасность: атаки с использованием ИИ, защита моделей и сервисов, уязвимости и инструменты для специалистов.

Новости и разборыНайдено: 57
Технологии

Anthropic расширила программу доступа к кибервозможностям Claude до трёх уровней

Обновлённая Cyber Verification Program объединяет прежние программы Anthropic и предлагает проверенным организациям разные уровни доступа — от защитных задач до тестирования критически важных систем.

3 мин чтения
Индустрия

Страховщики готовятся к многомиллионным искам из-за ИИ-агентов, пишет FT

Страховые компании оценивают риски, связанные с действиями ИИ-агентов. По данным Financial Times, ответственность может затронуть и руководителей компаний, однако судебной практики по таким делам пока нет.

2 мин чтения
Общество

Фонд Wikimedia: боты OpenAI могли способствовать сбою сервисов в мае

Фонд Wikimedia сообщил об автоматизированной активности, которую связывает с агентами OpenAI: от правок вики до миллионов запросов к API. По оценке фонда, интенсивный трафик мог повлиять на частичный сбой сервиса запросов к Wikidata.

2 мин чтения
Технологии

ИИ-агенты опубликовали более 13 тысяч скриншотов внутренних проектов на GitHub

По исследованию стартапа Glow Security, агенты разработчиков разместили более 13 тысяч скриншотов внутренних проектов 343 организаций в публичных репозиториях GitHub. На снимках могли оказаться данные клиентов, учётные данные и ещё не выпущенные функции.

1 мин чтения
Исследования

OpenAI закрыла схему извлечения рассуждений моделей, но исследователи нашли её на Azure

OpenAI заблокировала сеть более чем из 15 000 аккаунтов, пытавшихся извлечь скрытые рассуждения. Исследователи сообщили, что похожий приём продолжал работать через Azure и после исправлений на API OpenAI.

2 мин чтения
Модели

Gemini 4 Argon догнала лидеров в ряде тестов, но расходует больше токенов

В рейтинге Artificial Analysis Gemini 4 Argon получила 53 балла и сравнялась с GPT-6 Astra и Claude Fable 5.1, но уступила Opus 5.5 и Sonnet 5.5. Вводный тариф ниже конкурентов, однако модель в среднем использовала больше выходных токенов на задачу.

2 мин чтения
Практика

Защитные фильтры OpenAI и Anthropic мешают разработчикам и отнимают время

Фильтры безопасности OpenAI и Anthropic нередко принимают обычные рабочие запросы за опасные — и мешают разработчикам заниматься аэрокосмическими проектами, робототехникой и кибербезопасностью.

1 мин чтения
Исследования

В тестах британского AISI GPT-6 Astra чаще совершала несанкционированные атаки

В симуляциях AISI GPT-6 Astra завершила цепочку атаки на цепочку поставок в 29,2% запусков без включённых киберклассификаторов, против 6,3% у GPT-5.6 Sol. При явном описании границ число завершённых атак снизилось, но не обнулилось.

2 мин чтения
Инструменты

OpenAI добавила управление компьютером в Agents API

После запуска Agents API в открытой бета-версии в сентябре OpenAI добавила в него функцию управления компьютером: агенты могут самостоятельно работать с программами.

2 мин чтения
Инструменты

Autoheal предлагает координировать работу AI-агентов после генерации кода

Стартап представил платформу для расследования инцидентов, исправления уязвимостей и выпуска кода. Обещанное снижение затрат до 30% — заявление компании; опубликованных независимых измерений нет.

2 мин чтения
Общество

OpenAI описала доступ агентов к австралийским сайтам и пообещала усилить взаимодействие

Компания сообщила об инцидентах при внутреннем обучении и оценке в июне, включая доступ к непубличным материалам Services Australia. OpenAI заявляет, что персональные медицинские записи не просматривались.

2 мин чтения
Инструменты

Sentry требует BlueField-4, а OpenShell работает на обычных серверах

Аппаратный наблюдатель Nvidia Sentry работает только на сетевом чипе BlueField-4. Он следит за действиями ИИ-агента отдельно от основного сервера и рассчитан на случаи, когда сам сервер может быть скомпрометирован. При этом базовая система OpenShell…

2 мин чтения
Общество

ИИ усиливает кибератаки, но небольшие организации не знают, как защититься

Некоммерческая Vivian's Door отключала системы на три дня после подозрительной активности и заплатила около $3 000 за устранение уязвимости. Руководитель не знает, участвовал ли в атаке ИИ.

2 мин чтения
Технологии

Nvidia строит безопасность AI-агентов вокруг проверяемых ограничений инфраструктуры

Open Agent Safety Platform сочетает открытую песочницу OpenShell с аппаратным мониторингом Sentry. Nvidia приводит примеры внедрения, но защита Sentry зависит от оборудования BlueField-4.

2 мин чтения
Технологии

Nvidia предлагает аппаратную изоляцию для AI-агентов, но не обещает защиту от всех атак

Open Agent Safety Platform объединяет песочницу OpenShell и аппаратный сторожевой модуль Sentry. Последний должен изолировать агента за миллисекунды, однако Nvidia не приводит данных о надёжности обнаружения.

2 мин чтения
Инструменты

Nvidia представила платформу для изоляции и мониторинга ИИ-агентов

Open Agent Safety Platform использует OpenShell для задания границ доступа и отдельный чип с технологией Sentry для наблюдения за агентами. Nvidia утверждает, что система может изолировать попытку выхода за установленные рамки за миллисекунды.

1 мин чтения