Защитные фильтры OpenAI и Anthropic мешают разработчикам и отнимают время

Фильтры безопасности OpenAI и Anthropic нередко принимают обычные рабочие запросы за опасные — и мешают разработчикам заниматься аэрокосмическими проектами, робототехникой и кибербезопасностью.

Главное событие

Фильтры безопасности OpenAI и Anthropic нередко принимают обычные рабочие запросы за опасные — и мешают разработчикам заниматься аэрокосмическими проектами, робототехникой и кибербезопасностью. Некоторые тратят время на обход ограничений, прекращают разговор с моделью или переключаются на другую.

Проблемы возникают даже в безобидных задачах: модель может принять спутник в симуляции за военный объект, заблокировать создание интерфейса для роботизированной руки или подключение к другой машине. Запросы на проверку чужого кода на уязвимости тоже могут вызвать отказ. Один из опрошенных разработчиков рассказал, что из-за таких сбоев отменил подписку Anthropic.

Подробности

OpenAI признала, что дополнительные проверки способны замедлить или остановить законную работу, в том числе защиту от кибератак. По словам компании, GPT-6 Astra и GPT-6.1 Sol реже отвечают отказом на безобидные запросы, чем модели серии GPT-5, но фильтры продолжают дорабатывать. Anthropic ранее также признавала ложные срабатывания; компания не ответила на запрос журналистов.

Когда закрытые модели отказывают, разработчики переходят на открытые — например, Kimi и Qwen — или используют небольшие модели, запущенные на собственном компьютере. Для них снижение цены моделей не всегда означает экономию: отказы тоже обходятся дорого — потерянным временем.

VentureBeat