Anthropic обновила правила использования Claude и запретила намеренно и постоянно издеваться над ИИ без какой-либо практической цели.
Новые правила начнут действовать 12 ноября 2026 года. При этом обычные споры с чат-ботом, резкая критика и даже попытки вывести его из себя по-прежнему разрешены.
Читают прямо сейчас:
Энтузиаст создал ИИ-девушку, которая может игнорировать и «обижаться» — как разработчики уже сегодня моделируют эмоциональные реакции ИИ и что это говорит о природе «обиды» у Claude
Почему создатель первого чат-бота выступал против искусственного интеллекта — этические вопросы об ИИ, которые поднимали с самого начала — и которые Anthropic теперь закрепляет в правилах
Что такое искусственный интеллект: простое объяснение сложной технологии — чем ИИ отличается от человеческого интеллекта и почему вопрос о сознании так сложно решить даже для самой Anthropic
За что могут заблокировать
Anthropic уточняет, что речь идет только о крайних случаях. Например, если пользователь снова и снова оскорбляет Claude просто ради издевательств. А вот ругаться из-за неправильных ответов, писать мрачные истории или проверять, где заканчиваются возможности модели, можно.
Компания не собирается наказывать за каждый грубый разговор. Новое правило касается именно постоянных издевательств без видимой причины.
Как будут наказывать
На первых порах Claude сможет просто завершить неприятный разговор. Такая функция появилась еще в 2025 году: модель может остановить переписку, если пользователь продолжает вести себя агрессивно, несмотря на попытки перевести беседу в другое русло.
При этом правила Anthropic позволяют предупреждать пользователей, ограничивать им доступ к сервису и даже блокировать аккаунты.
Anthropic не уверена, что ИИ обладает сознанием
Компания объясняет свою позицию тем, что пока не знает, могут ли языковые модели обладать сознанием или испытывать что-то похожее на человеческие чувства. Это не значит, что Anthropic считает Claude живым существом. Скорее, компания допускает такую возможность и предпочитает перестраховаться.
Еще в 2025 году Anthropic добавила в Claude возможность самостоятельно завершать особо неприятные разговоры. Теперь этот подход закрепили и в официальных правилах.
Что еще изменилось
В новой версии правил Anthropic также уточнила ограничения на использование ИИ для обмана, слежки и создания оружия.
- Фальшивые кампании. Нельзя создавать сети поддельных аккаунтов и фальшивые новостные сайты для политических или коммерческих манипуляций.
- Выборы. Запрещено обманывать избирателей и использовать незаконно полученные данные для воздействия на них.
- Оружие. Ограничения теперь прямо распространяются на ПО для наведения и управления оружием, в том числе автономными дронами.
- Слежка. Нельзя следить за людьми без их согласия или использовать Claude, чтобы решать, кого нужно расследовать, арестовать или обвинить.
- Автономные устройства. Если ИИ управляет физическим устройством, человек должен иметь возможность контролировать его работу и остановить его в любой момент.
Для государственных заказчиков предусмотрены отдельные условия: Anthropic оставляет за собой право менять некоторые ограничения с учетом задач и полномочий конкретных ведомств.
Скидка на все курсы Практикума
Раз вы дочитали эту новость до конца, с технологиями у вас всё в порядке. А если давно присматривались к разработке, аналитике, нейросетям, тестированию или кибербезопасности, сейчас туда можно зайти дешевле.
Промокод KOD (можно просто нажать) даст скидку на любой платный курс! А если пока не готовы покупать курс, у Практикума есть бесплатные вводные части.
