Anthropic будет банить за издевательства над Claude уже с 12 ноября

Верит ли Anthropic в то, что у ИИ есть сознание?

Anthropic будет банить за издевательства над Claude уже с 12 ноября

Anthropic обновила правила использования Claude и запретила намеренно и постоянно издеваться над ИИ без какой-либо практической цели. 

Новые правила начнут действовать 12 ноября 2026 года. При этом обычные споры с чат-ботом, резкая критика и даже попытки вывести его из себя по-прежнему разрешены.

Читают прямо сейчас:

Энтузиаст создал ИИ-девушку, которая может игнорировать и «обижаться» — как разработчики уже сегодня моделируют эмоциональные реакции ИИ и что это говорит о природе «обиды» у Claude

Почему создатель первого чат-бота выступал против искусственного интеллекта — этические вопросы об ИИ, которые поднимали с самого начала — и которые Anthropic теперь закрепляет в правилах

Что такое искусственный интеллект: простое объяснение сложной технологии — чем ИИ отличается от человеческого интеллекта и почему вопрос о сознании так сложно решить даже для самой Anthropic

За что могут заблокировать

Anthropic уточняет, что речь идет только о крайних случаях. Например, если пользователь снова и снова оскорбляет Claude просто ради издевательств. А вот ругаться из-за неправильных ответов, писать мрачные истории или проверять, где заканчиваются возможности модели, можно.

Компания не собирается наказывать за каждый грубый разговор. Новое правило касается именно постоянных издевательств без видимой причины.

Как будут наказывать

На первых порах Claude сможет просто завершить неприятный разговор. Такая функция появилась еще в 2025 году: модель может остановить переписку, если пользователь продолжает вести себя агрессивно, несмотря на попытки перевести беседу в другое русло.

При этом правила Anthropic позволяют предупреждать пользователей, ограничивать им доступ к сервису и даже блокировать аккаунты. 

Anthropic не уверена, что ИИ обладает сознанием

Компания объясняет свою позицию тем, что пока не знает, могут ли языковые модели обладать сознанием или испытывать что-то похожее на человеческие чувства. Это не значит, что Anthropic считает Claude живым существом. Скорее, компания допускает такую возможность и предпочитает перестраховаться.

Еще в 2025 году Anthropic добавила в Claude возможность самостоятельно завершать особо неприятные разговоры. Теперь этот подход закрепили и в официальных правилах.

Что еще изменилось

В новой версии правил Anthropic также уточнила ограничения на использование ИИ для обмана, слежки и создания оружия.

  • Фальшивые кампании. Нельзя создавать сети поддельных аккаунтов и фальшивые новостные сайты для политических или коммерческих манипуляций.
  • Выборы. Запрещено обманывать избирателей и использовать незаконно полученные данные для воздействия на них.
  • Оружие. Ограничения теперь прямо распространяются на ПО для наведения и управления оружием, в том числе автономными дронами.
  • Слежка. Нельзя следить за людьми без их согласия или использовать Claude, чтобы решать, кого нужно расследовать, арестовать или обвинить.
  • Автономные устройства. Если ИИ управляет физическим устройством, человек должен иметь возможность контролировать его работу и остановить его в любой момент.

Для государственных заказчиков предусмотрены отдельные условия: Anthropic оставляет за собой право менять некоторые ограничения с учетом задач и полномочий конкретных ведомств.

Скидка на все курсы Практикума

Раз вы дочитали эту новость до конца, с технологиями у вас всё в порядке. А если давно присматривались к разработке, аналитике, нейросетям, тестированию или кибербезопасности, сейчас туда можно зайти дешевле.

Промокод KOD (можно просто нажать) даст скидку на любой платный курс! А если пока не готовы покупать курс, у Практикума есть бесплатные вводные части.

Соцсети: Юлия Зубарева
Через год — лучше работа, выше зарплата
В «Яндекс Практикуме» становятся разработчиками с нуля. Выберите язык — веб, Python, Java, C++ — и учитесь. Джуны зарабатывают от 80 000 ₽, мидлы — от 150 000 ₽. Дальше — программы трудоустройства и компенсация, если пойдёте в Яндекс.
Через год — лучше работа, выше зарплата Через год — лучше работа, выше зарплата Через год — лучше работа, выше зарплата Через год — лучше работа, выше зарплата
Вам может быть интересно
easy