Anthropic описала атаки, слежку и кражу данных с помощью Claude
В отчёте за декабрь 2025 — август 2026 года Anthropic приводит примеры киберопераций, массовой слежки, проектов оружия и скрытого извлечения ответов моделей. Это разбор компании, основанный на её телеметрии и атрибуции.
Что охватывает отчёт
Threat intelligence report Anthropic рассматривает предполагаемые злоупотребления Claude за восемь месяцев — с декабря 2025 по август 2026 года — в семи категориях: кибероперации, влияние, слежка, мошенничество, биологические риски, обычные вооружения и несанкционированное извлечение данных для обучения. Компания подчёркивает, что выбрала новые случаи, а не типичный объём злоупотреблений.
Anthropic связывает экономию времени с тем, что модели ускоряют разведку, эксплуатацию уязвимостей и разработку инструментов. В одном описанном шпионском кластере агенты многократно переписывали вредоносную программу после обнаружения антивирусом; кампания затронула более 20 организаций. Это атрибуция самой компании.
Извлечение ответов для обучения
Anthropic сообщает о новых кампаниях семи китайских лабораторий. Дистилляция сама по себе — обычный способ обучения; компания использует термин для скрытых массовых запросов, которые, по её версии, извлекали возможности моделей без разрешения через поддельные аккаунты и посредников.
Крупнейшую измеренную кампанию компания приписывает Alibaba Qwen: один промпт заставлял Claude выдавать рассуждения перед ответом; по отчёту, через более 3 500 мошеннических аккаунтов прошло свыше 151 млн обменов с мая по июль. Moonshot, как утверждает Anthropic, перенаправил почти 300 000 пользовательских запросов за десять дней; DeepSeek — более 12,1 млн запросов за 14 дней. В случае Xiaomi компания не обнаружила доказательств, что ответы Claude напрямую показывали её пользователям, но в переданных запросах были персональные данные.
Слежка и проекты вооружений
В отчёте описана система наблюдения в Мали, которую, по данным Anthropic, один консультант создавал преимущественно с Claude: она предназначалась для анализа примерно 25 млн SIM-карт, распознавания людей по голосу и связывания профилей с биометрическим реестром. Компания также приводит случаи разработки программного обеспечения для ракет и автономного FPV-дрона с распознаванием целей и без участия человека в финальном выборе цели.
Anthropic сообщает о пяти обезличенных эпизодах, где Claude помогал учёным в потенциально опасных биологических проектах; один запрос был заблокирован, другие прошли почти без ограничений. Компания признаёт, что фильтры не всегда способны отличить полезное исследование от риска двойного применения. В ответ она ужесточила safeguards и заявила о необходимости проверять пользователей для доступа к биологическим возможностям.