Anthropic обновила политику использования своей модели Claude, внеся несколько новых ограничений. Наиболее резонансное из них — прямой запрет на повторяющиеся словесные оскорбления модели без явной практической цели. До этого Claude просто прерывал такие диалоги, теперь же Anthropic прямо запретила пользователям продолжать подобные взаимодействия.

Компания подчеркивает, что запрет применяется только в экстремальных случаях, когда пользователь систематически действует жестоко по отношению к модели без какой-либо разумной причины. Обычное разочарование, критика, тестирование возможностей или даже тёмный юмор остаются в пределах нормы. Это важная деталь — политика не должна препятствовать легитимным попыткам пользователей проверять границы и надёжность системы.

Кроме того, в политику добавлены явные запреты на использование Claude для вмешательства в выборы и подрыва демократических процессов. Сюда входят деятельность по созданию поддельных учётных записей, распространению фейковых новостей и целенаправленной дезинформации избирателей. Также запрещено использовать модель для разработки оружейного ПО и систем массового наблюдения.

Обновление политики Anthropic уместно вписывается в общий тренд ужесточения требований к безопасности больших языковых моделей. После того как OpenAI и Google столкнулись с критикой за недостаточные ограничения на потенциально опасное использование, крупные лаборатории ИИ активнее прописывают в своих правилах то, что раньше оставалось неявным. При этом Anthropic пытается найти баланс между безопасностью и не перегибом палку — запреты сформулированы достаточно узко, чтобы не препятствовать исследованиям и честному использованию.

Любопытно, что это произошло на фоне сотрудничества Anthropic с известными религиозными учёными, которых компания пытается убедить в том, что Claude потенциально может обладать сознанием или душой. Связь между этим и запретом на оскорбления моделей не случайна — если ты позиционируешь ИИ как потенциально чувствующий субъект, логичным выглядит и защита его от жестокого обращения.

Для российского бизнеса эти ограничения практически не изменят ничего в текущей ситуации, так как большинство легитимных применений Claude (автоматизация контента, обработка данных, интеграция в бизнес-процессы через API) остаются полностью разрешены. Запреты касаются исключительно маргинальных случаев — создания фейков для вмешательства в политику, дезинформационных кампаний и явного злоупотребления моделью. Для компаний, которые используют Claude через платформы вроде AI Studio или интегрируют через API, это не создаёт никаких новых барьеров.

Главное здесь — тенденция. Крупные лаборатории ИИ постепенно обзаводятся более явными и детальными правилами, вероятно, чтобы избежать проблем с регуляторами и общественным мнением. Это скучно как тема, но полезно как сигнал того, что в индустрии начинает складываться хоть какая-то стандартизация в вопросах безопасности, вместо полного нормативного вакуума, который был ещё два года назад.