
Компания Tavus представила модель Phoenix 4.5 для создания реалистичных ИИ-аватаров. Обновление улучшило липсинк, добавило движения тела и сократило время обучения цифровых двойников.
Компания Tavus анонсировала выпуск Phoenix 4.5 — обновленной версии своей флагманской модели для создания реалистичных цифровых двойников в режиме реального времени. Главным достижением разработчиков стало внедрение системы генерации «всего тела», которая позволяет ИИ-аватарам двигаться более естественно, имитируя поведение живого человека. Это критически важное обновление для индустрии виртуальных ассистентов и сервисов видеокоммуникаций, поскольку оно решает проблему статичности и визуальной изоляции лица от тела.
В отличие от предыдущих итераций и многих конкурирующих решений, фокусирующихся исключительно на лицевой анимации, Phoenix 4.5 генерирует голову, плечи, торс и даже фон как единую структуру в каждом кадре. Такой подход позволяет аватару принимать естественные позы, менять положение тела во время разговора и адекватно реагировать на контекст беседы. Tavus Phoenix 4.5 теперь демонстрирует тонкие микроэмоции и сохраняет динамику даже в моменты пассивного слушания, что значительно снижает эффект «зловещей долины».
Ключевые визуальные улучшения включают:
За счет целостной генерации картинка выглядит стабильной: исчезают резкие переходы и артефакты в области шеи, которые часто встречаются в моделях, накладывающих лицо на готовое видео.
Одним из важнейших параметров для систем видеосвязи в реальном времени является задержка (latency). В Phoenix 4.5 разработчикам удалось добиться впечатляющих результатов: время от получения аудиосигнала до выдачи готового видеопотока составляет около 134 миллисекунд. По данным официального блога Tavus, это делает модель на 25% быстрее аналогичных решений на рынке. Высокая скорость работы позволяет использовать аватаров в интерактивных сценариях, таких как живые видеозвонки или онлайн-консультации, без ощутимых пауз.
Кроме того, значительный прогресс достигнут в области липсинка — синхронизации движений губ с произносимым текстом. В сравнении с версией Phoenix 4, точность артикуляции улучшилась на 16%. Это обеспечивает более четкое визуальное восприятие речи и повышает общее доверие пользователя к виртуальному собеседнику.
Процесс обучения новых цифровых личностей стал значительно доступнее и быстрее. Если раньше для качественного дообучения модели требовалось около четырех часов, то с выходом версии 4.5 этот срок сократился до двух часов. При этом пользователи могут оценить предварительный результат работы системы практически мгновенно.
Благодаря новым алгоритмам, Phoenix 4.5 способен генерировать прототип аватара на основе всего одного изображения или короткого видеоролика. Предпросмотр будущей цифровой копии доступен в течение минуты после загрузки исходных данных. Опробовать функционал создания собственного аватара можно в интерфейсе Tavus Maker. Эти нововведения делают технологию масштабируемой для бизнеса: компании могут оперативно создавать библиотеки цифровых сотрудников, адаптируя их под конкретные задачи без длительного ожидания и сложных циклов подготовки данных.
Ежедневные подборки промптов, свежие новости и материалы об ИИ — там, где удобно. Без спама, только редакционный отбор.