На этой неделе исследователь Anthropic ушёл из компании и выступил с публичным предупреждением: фирма «мчится прямо к самосовершенствующемуся суперинтеллекту и играет в рулетку с нашими жизнями». Необычный момент — в компании это предупреждение не попытались опровергнуть или дистанцироваться от него. Напротив, лид направления alignment (то есть безопасность и контроль ИИ) поддержал сообщение коллеги вместо того, чтобы его оспорить.

Индустрия неоднократно слышала подобные предупреждения от экспертов по безопасности ИИ. Но в данном случае контекст усиливает эффект: Anthropic готовится к IPO. Когда компания планирует выход на публику и привлечение инвестиций, внутренние сигналы об отсутствии контроля над разработками звучат особенно громко. Это не просто академическая дискуссия о рисках — это сообщение приходит изнутри одной из главных лабораторий, конкурирующих с OpenAI.

Такой момент обнажает базовое натяжение, которое вся AI-индустрия игнорирует годы: компании публично утверждают, что работают над безопасностью и контролем суперинтеллекта, но при этом ускоряют разработки всё более мощных моделей и привлекают деньги на масштабирование. Когда сотрудник, разбирающийся в внутренних процессах, говорит, что компания «бежит вперёд и прибивает планы по ходу движения», это ставит конкретный диагноз общей проблеме.

Для инвесторов Anthropic это становится реальным сигналом о возможных рисках управления. IPO значит, что компания должна будет ещё честнее рассказывать о своих приоритетах и рисках. Факт, что лид по alignment не отмежевался от критики, может означать: либо внутри есть реальное беспокойство, которое игнорируется руководством, либо это скоординированный сигнал в поддержку внешнего давления на темп разработок. В любом случае — это не рутинная критика извне, а раздор внутри лаборатории.

На практике для российских компаний, работающих с LLM или разработкой приложений на базе больших моделей, это подтверждает общий риск: выбирать партнёра для инфраструктуры и моделей нужно, учитывая не только технические характеристики, но и прозрачность разработчика относительно его подхода к безопасности и контролю. Компания, которая в критический момент выглядит как «бегущая вперёд без плана», — менее надёжный партнер, чем та, которая готова публично говорить о своих ограничениях и принципах.

Более широко это событие показывает, что дискуссия о безопасности ИИ переходит из философской в организационную. Это не просто теория — это внутреннее недовольство в одной из ключевых лабораторий, оформленное в отставку и публичное заявление. Для индустрии это может стать началом более честного разговора о том, какой темп разработок на самом деле допустим и кто за это отвечает.