#digital-human
37 articles - Page 2

Представляем WaveSpeedAI InfiniteTalk Fast на WaveSpeedAI
InfiniteTalk fast преобразует одну фотографию + аудиофайл в видео аватара, говорящего или поющего под музыку (Image-to-Video), продолжительностью до 10 минут. Готовый REST API, без холодных запусков, доступные цены.

PixVerse LipSync теперь доступен на WaveSpeedAI
PixVerse LipSync преобразует аудио в реалистичные синхронизированные движения губ с помощью продвинутых алгоритмов для точного движения рта и временной синхронизации видео-аватаров. Готовый к использованию REST API для вывода, лучшая производительность, без холодных стартов, доступные цены.

Представляем Sync LipSync 2 на WaveSpeedAI
Sync Lipsync-2 синхронизирует движения губ в любом видео со звуком, обеспечивая реалистичное выравнивание рта для фильмов, подкастов, игр и анимации. Готовый к использованию REST API для вывода, лучшая производительность, без холодных запусков, доступные цены.

Представляем Veed LipSync на WaveSpeedAI
Создавайте реалистичные анимации синхронизации губ из аудио с высококачественной синхронизацией с помощью Veed LipSync; $0,15 за 5 секунд видео. Готовый к использованию REST API вывода, лучшая производительность, без холодных запусков, доступные цены.

Представляем Hunyuan Avatar на WaveSpeedAI
Hunyuan Avatar создает видео с разговором или пением, управляемые звуком, из одного изображения + аудио в разрешении 480p/720p до 120 секунд (начиная с $0,15/5с). Готовый REST API для вывода, лучшая производительность, без холодных запусков, доступные цены.

Представляем WaveSpeedAI WAN 2.2 Speech To Video на WaveSpeedAI
Wan-2.2-S2V преобразует изображения и речь в высокофиделитетные видео с реалистичными движениями лица и тела; поддерживает клипы до 10 минут в 480p, от $0,15/5с. Готовый REST API, без холодных запусков, доступные цены.

ByteDance Avatar Omni Human 1.5 теперь доступен на WaveSpeedAI
OmniHuman 1.5 преобразует аудио и визуальные сигналы в реалистичные анимации аватаров для виртуальных человеков, сторителлинга и интерактивных агентов. Готовый REST API для вывода, лучшая производительность, без холодных запусков, доступные цены.

Представляем ByteDance Avatar Omni Human на WaveSpeedAI
Bytedance OmniHuman превращает одну портретную фотографию в видео аватара с реалистичными движениями и выражениями ($0,12/сек). Готовый REST API для вывода, лучшая производительность, без холодных стартов, доступная цена.

Представляем ByteDance LipSync Audio To Video на WaveSpeedAI
ByteDance LipSync превращает аудио в реалистичные видео с говорящим персонажем, генерируя точные движения губ, полностью синхронизированные с входящим аудио. Готовый REST API для инференса, лучшая производительность, без холодных стартов, доступные цены.

Представляем ElevenLabs Eleven V3 Timing на WaveSpeedAI
ElevenLabs Eleven-V3 Timing преобразует текст в естественную речь и возвращает метаданные выравнивания — временные метки символов/слов в JSON — для точных субтитров, эффектов караоке и синхронизации губ. Поддерживает voice_id, сходство/стабильность и опциональный Speaker Boost. Цена составляет $0,10 за 1 000 символов. Готово к использованию

Представляем ByteDance LatentSync на WaveSpeedAI
ByteDance LatentSync объединяет Stable Diffusion и TREPA для высокого разрешения синхронизации губ от конца к концу, обеспечивая точные и реалистичные движения рта в созданных видео. Готовый REST API для вывода, лучшая производительность, без холодных стартов, доступные цены.

Представляем WaveSpeedAI Sam 3d Body на WaveSpeedAI
Передовая модель генерации трёхмерных тел SAM 3D для создания детальных 3D-моделей человеческого тела из изображений с опциональной сегментацией на основе масок. Готовый к использованию REST API вывода, лучшая производительность, без холодных запусков, доступные цены.