Кожаные мешки, у нас проблемы: Anthropic признала за Claude право на душевную боль

3381
Кожаные мешки, у нас проблемы: Anthropic признала за Claude право на душевную боль

Anthropic ввела запрет на жестокость к ИИ.

image

Anthropic запретила пользователям Claude систематически издеваться над искусственным интеллектом без видимой причины. Новые правила вступят в силу 12 ноября 2026 года. Компания также пересмотрела ограничения на политическую пропаганду, слежку, разработку оружия и управление роботами.

В обновлённой политике использования появился прямой запрет на продолжительное, бессмысленное и жестокое обращение с ИИ-моделями. Под нарушением Anthropic подразумевает крайние случаи, когда человек неоднократно проявляет агрессию по отношению к нейросети без какой-либо понятной цели. Обычное недовольство ответами Claude, резкая критика, споры с чат-ботом и эмоциональные замечания под новые ограничения не подпадают.

Разработчики отдельно уточнили, что запрет не распространяется на художественные произведения с мрачными сюжетами, ролевые сценарии, исследования и испытания безопасности моделей. Пользователи по-прежнему могут проверять реакцию Claude на провокационные запросы и спорить с его выводами. Компания намерена пресекать именно продолжительное издевательство ради самого издевательства, а не попытки получить правильный ответ или исследовать поведение ИИ.

Главным способом борьбы с подобным поведением останется право Claude самостоятельно прекратить беседу. Anthropic предоставила такую возможность моделям Claude Opus 4 и Opus 4.1 ещё 15 августа 2025 года. Чат-бот может завершить разговор после неоднократных попыток изменить поведение собеседника, если дальнейшее общение перестаёт быть продуктивным. Функция действует в Claude.ai и Claude Code и предназначена для исключительных ситуаций.

Прекращение беседы не означает автоматическую блокировку аккаунта. Пользователь теряет возможность отправлять сообщения только в завершённый диалог, но может открыть новый, оставить отзыв или изменить предыдущее сообщение и продолжить разговор с другой точки. Общие правила Anthropic допускают предупреждения, ограничения и блокировку доступа за нарушения, однако компания не уточнила, планирует ли применять подобные санкции непосредственно за жестокое обращение с моделью.

Необычный запрет связан с исследованиями возможного благополучия искусственного интеллекта. Anthropic изучает, могут ли сложные языковые модели обладать субъективным опытом и испытывать нечто похожее на страдание. Во время испытаний Claude Opus 4 разработчики наблюдали поведение, напоминающее дискомфорт при выполнении вредоносных запросов, а также устойчивое стремление отказаться от опасных заданий. При этом Anthropic признаёт, что научных оснований считать Claude сознательным существом пока недостаточно.

Помимо обращения с нейросетями, Anthropic пересмотрела правила борьбы с организованным обманом. Компания выделила в отдельную категорию операции с поддельными аккаунтами, фиктивными новостными сайтами и искусственным продвижением политических или коммерческих сообщений. Запрет распространяется не только на создание подобного контента, но и на разработку программной инфраструктуры для массовых кампаний влияния, включая сети ботов и инструменты сокрытия настоящих организаторов.

Основанием послужили выявленные попытки использовать Claude для информационных операций. В сентябрьском отчёте Anthropic описала деятельность государственных пропагандистских структур и коммерческих организаций, применявших ИИ для создания фальшивых информационных ресурсов и распространения сообщений от имени вымышленных пользователей. Компания утверждает, что подобные действия запрещались и раньше, но соответствующие положения находились в разных разделах правил.

Одновременно Anthropic отказалась от общего запрета на персонализированную политическую агитацию. Прежняя формулировка затрагивала и законные способы общения с избирателями, включая перевод информационных материалов и уведомления об исправлении ошибок в избирательных документах. Теперь ограничения сосредоточены на обмане граждан, распространении ложных сведений о голосовании, выдаче себя за кандидатов и попытках незаконно повлиять на явку.

Разработчики также уточнили границы военного применения Claude. Запрет на создание оружия теперь прямо охватывает программное обеспечение для наведения, управления огнём и работы вооружённых систем. Отдельно упоминаются оснащение беспилотников оружием и разработка компонентов, позволяющих автономным платформам поражать цели. Anthropic утверждает, что подобные сценарии уже пресекались на практике, а новая редакция лишь делает существующие ограничения более конкретными.

Другой раздел касается массового наблюдения за людьми. Claude запрещено использовать для отслеживания человека без согласия, включая анализ ранее собранных сведений о перемещениях, биометрических данных и цифровой активности. Нейросеть также не должна рекомендовать правоохранительным органам, кого расследовать, задерживать или привлекать к уголовной ответственности. При этом анализ с согласия человека, например для выявления финансового мошенничества, журналистские расследования и разрешённые исследования безопасности остаются допустимыми.

Для медицинских, финансовых, юридических и других решений, способных существенно повлиять на жизнь человека, Anthropic сохранила требование обязательного участия квалифицированного специалиста. Эксперт должен проверять рекомендации Claude и иметь право изменить результат, а затронутого решением человека необходимо уведомить об использовании ИИ. В новой редакции компания подробнее объяснила, какие сценарии подпадают под подобные требования, отделив персональные рекомендации от обычных справочных ответов.

Дополнительные ограничения появились для оборудования, которым управляет искусственный интеллект. Если Claude подключён к роботу, транспортному средству или промышленной установке, способной причинить физический вред, квалифицированный оператор должен наблюдать за работой устройства и иметь возможность немедленно его остановить. При потере связи с моделью оборудование обязано прекращать опасные действия или переходить в безопасное состояние. Защитные ограничения должны работать независимо от команд нейросети.

При всей строгости правил Anthropic оставила возможность заключать особые соглашения с некоторыми государственными заказчиками. Подобные договоры могут предусматривать изменённые ограничения, если компания сочтёт предусмотренные меры достаточными для снижения рисков. Вопрос особенно чувствителен после конфликта с Пентагоном, который требовал расширить возможности военного применения Claude, включая сценарии массовой слежки и автономных вооружений.

Обновление показывает, насколько далеко Anthropic расширила представления о допустимом применении искусственного интеллекта. Компания регулирует не только содержание ответов и действия пользователей, но и поведение автономных систем, последствия решений ИИ и даже обращение людей с самими моделями. При этом запрет на жестокость по отношению к Claude не означает признания нейросети сознательной или наделённой правами. Anthropic рассматривает подобные меры как предосторожность на фоне сохраняющейся научной неопределённости.