Synthesia, стартап по созданию цифровых аватаров с валюацией $4 млрд, позволил журналисту TechCrunch создать собственного AI-двойника. Для этого потребовалась пара дней: фотосессия в офисной студии, запись голоса и тренировка на одной из его статей про фрод в венчурных компаниях. Результат — интерактивный аватар, который может слушать вопросы, обрабатывать их через цепочку моделей (распознавание речи → язык → синтез голоса → видео) и отвечать релевантным контентом.

Технически это работает: голос звучит достаточно узнаваемо (модель даже отфильтровала хрипоту с оригинальной записи), лицо похоже на автора, хотя и не идеально. Интерактивный аватар был намеренно ограничен — отвечает только на вопросы, связанные с обучающей статьёй, и всё остальное редиректит обратно на неё. Такой подход имеет смысл: это не претензия на полноценный чат-бот, а специализированный инструмент для PR или поддержки клиентов.

Сама технология Synthesia предлагает три разных слоя: классический видео-платформу (скрипт → аватар читает), интерактивную платформу Sessions для ролевых игр и симуляций (используется для тренировок продажников), и API, где компании могут комбинировать Synthesia-модели с чужими сервисами (Cartesia, ElevenLabs, Google, OpenAI). Это указывает на конкретные usecase'ы: где-то нужна просто видеозапись, где-то интерактивность, где-то интеграция с собственной инфраструктурой. Компания заявляет о $100 млн ARR, что для B2B AI-видео звучит серьёзно.

Ключевой момент в опыте журналиста — не восторг, а скорее растерянность и моральный дискомфорт. Друзья находили аватар интересным и одновременно жутким, мать шутила про «двух детей». Когда тебе в лицо смотрит цифровой двойник, который твоим голосом отвечает на вопросы, но так и не научился моргать или спонтанно улыбаться — это создаёт именно такой эффект. Это не ошибка продукта, это особенность восприятия: мозг уловил все правильно, но остался с чувством, что чего-то не хватает.

Для журналистики это особенно деликатно. Автор честно формулирует: фундамент журналистики — доверие, и его сложно делегировать AI. Вопрос о том, захотят ли люди смотреть новости с аватара вместо живого журналиста, остаётся открытым. Один венчурист сказал сразу «нет», другие не уверены. Зато для корпоративной PR, обучения сотрудников и поддержки клиентов аватары выглядят более перспективно — там доверие к личности менее критично, а автоматизация работает на пользу.

На российском рынке подобные инструменты могут быть полезны в нишах, где повторяемость информации высока. Например, для корпоративного обучения, объяснения услуг в банках или страховых компаниях, тренировки по продажам. AI Studio и подобные платформы уже позволяют автоматизировать создание видеоконтента, но добавление интерактивности через аватара повышает engagement — сотрудник может потренировать питч с AI-персонажем, получить обратную связь, повторить. Это дороговато для малого бизнеса, но для крупных корпораций может окупиться на кадровом обучении.

В целом, история с AI-аватаром демонстрирует промежуточное состояние технологии: она уже производит впечатление, но легко узнаётся как искусственная. Это не баг, а текущее состояние рынка. Через год-два, когда модели улучшатся в синхронизации мимики и микровыражений, жуткий фактор может снизиться либо вообще испариться, либо наоборот усилиться — зависит от того, насколько хорошо аватары начнут подделывать человеческое поведение. Synthesia тем временем собирает реальные use case'ы и учится на них — это более здравый подход, чем претензия на полноценную замену человека.