Anthropic запустила новый сервис тестирования безопасности ИИ-систем, ориентированный на крипто-проекты и других разработчиков. Суть простая: компания предлагает добровольно протестировать свои продукты и инфраструктуру самыми продвинутыми версиями Claude, включая новую модель Claude Mythos, которая специализируется на поиске уязвимостей и обхода защит. По итогам тестирования компания получает подробный отчёт с описанием найденных проблем.

Идея не новая — красный тим и adversarial testing давно стандартная практика в сфере безопасности. Но здесь интересно другое: Anthropic фактически монетизирует собственные способности своих моделей к поиску уязвимостей, предлагая их как сервис. Это логичный ход для компании, которая активно позиционирует себя как лидер в области safety ИИ — дескать, если мы сами можем найти проблемы в вашей системе, это должно вас подстегнуть к улучшению безопасности.

Почему именно крипто-проекты в фокусе? Потому что это сегмент, где одна уязвимость может стоить миллионы — либо в виде потери средств, либо в виде потери репутации. Плюс в крипто принято доверять не регуляторам, а техническому аудиту и независимой проверке. Anthropic просто предлагает свой аудит как альтернативу классическим security-фирмам, но с опорой на мощь своих моделей.

На практике это может работать. Если Claude Mythos действительно хорошо находит нестандартные атаки и обходы, это имеет смысл для компаний, у которых уже есть классические security-аудиты, но которые хотят перепроверку с другой стороны. Вопрос в цене и в скорости работы — если это стоит дешевле классического аудита и выполняется быстрее, может быть интересно. Если это фактически дороже, то это просто маркетинг новой модели.

Для российских крипто-компаний и блокчейн-разработчиков это может быть полезно, особенно если нет прямого доступа к лучшим западным security-фирмам или если нужна быстрая дополнительная проверка перед лаунчем. Инструменты вроде AI Studio можно использовать для автоматизации анализа отчётов от Anthropic, чтобы быстро выявить критические проблемы и распределить работу по приоритетам между разработчиками. Но прямого стандарта для работы с блокчейном в такого рода сервисах обычно нет — придётся адаптировать под свой стек самостоятельно.

Общий контекст: это часть более широкого тренда, когда ведущие AI-компании начинают монетизировать аспекты своих моделей, которые раньше были просто внутренними инструментами. OpenAI делал подобное с API для использования модели на красных тимах. Anthropic здесь действует похоже. Опасная ли это игра? Нет, если компания действительно находит реальные проблемы и не притворяется, что это панацея. Просто новый канал сбыта для существующей компетенции.