#announcement
409 articles - Page 29

Представляем MiniMax Speech 2.5 Turbo Preview на WaveSpeedAI
MiniMax Speech 2.5 Turbo Preview: HD синтез речи с многоязычной поддержкой, точное воспроизведение голоса на 40 языках. $0,04/1000 символов. Готовый REST API для вывода, лучшая производительность, без холодных запусков, доступная цена.

Представляем OpenAI Whisper на WaveSpeedAI
Whisper Large v3 для преобразования речи в текст: мгновенные, точные многоязычные транскрипции с автоматическим определением языка и пунктуацией. Загрузите аудио для получения транскрипций. Готовый REST API, без холодных стартов, доступные цены.

Представляем OpenAI GPT Image 1.5 Text-to-Image на WaveSpeedAI
GPT Image 1.5 text to image - это быстрый и экономичный генератор текста в изображение от OpenAI, работающий с использованием руководства GPT-5. Создавайте фотореалистичные снимки, рендеры продуктов, концепт-арт и стилизованную графику из естественно-языковых подсказок (при необходимости обусловленные изображением). Поддерживает пользовательские соотношения сторон, seed

Представляем Runway Upscale V1 на WaveSpeedAI
RunwayML Upscale V1 масштабирует видео до 4K с помощью простой загрузки файла, стоимость $0,02/сек для быстрого и высококачественного масштабирования. Готовый к использованию REST API для вывода, лучшая производительность, без холодных запусков, доступные цены.

Представляем Ace Step Prompt To Audio на WaveSpeedAI
ACE-Step Prompt-to-Audio создает музику из простых подсказок, автоматически генерируя теги жанра и текст для быстрого создания песен. Готовый к использованию REST API вывода, лучшая производительность, без холодных запусков, доступная цена.

Представляем Content Moderator Image на WaveSpeedAI
Image Content Moderator обеспечивает автоматическую модерацию изображений для обнаружения и пометки изображений, нарушающих политику или содержащих неприемлемый контент. Готовый к использованию REST API для вывода, лучшая производительность, отсутствие холодных запусков, доступное ценообразование.

Представляем Minicpm V Image на WaveSpeedAI
MiniCPM-V 4.5 — это последняя и самая мощная модель MiniCPM-V для точного понимания и анализа изображений с помощью ИИ в различных визуальных задачах. Готовый к использованию REST API для вывода, лучшая производительность, без холодных запусков, доступные цены.

Представляем Minicpm V Video на WaveSpeedAI
MiniCPM-V 4.5 — последняя и самая мощная модель MiniCPM-V для понимания и анализа видео с помощью искусственного интеллекта. Готовый REST API для вывода, лучшая производительность, отсутствие холодных запусков, доступные цены.

Представляем WAN 2.2 Image To Image на WaveSpeedAI
WAN 2.2 (14B) - это модель для редактирования изображений с преобразованием изображения в изображение, обеспечивающая высокое разрешение, фотореалистичные результаты с исключительной точностью и верностью. Готовое REST API для вывода, лучшая производительность, без холодных запусков, доступная цена.

Alibaba Qwen3 TTS Flash теперь доступен на WaveSpeedAI
Alibaba Qwen3 TTS Flash: низколатентный синтез речи для английского и китайского языков с несколькими голосами, идеален для диалогов в реальном времени. Готовый REST API для вывода, лучшая производительность, без холодных стартов, доступная цена.

Представляем ByteDance LatentSync на WaveSpeedAI
ByteDance LatentSync объединяет Stable Diffusion и TREPA для высокого разрешения синхронизации губ от конца к концу, обеспечивая точные и реалистичные движения рта в созданных видео. Готовый REST API для вывода, лучшая производительность, без холодных стартов, доступные цены.

Представляем Sam 3d Body на WaveSpeedAI
Передовая модель генерации трёхмерных тел SAM 3D для создания детальных 3D-моделей человеческого тела из изображений с опциональной сегментацией на основе масок. Готовый к использованию REST API вывода, лучшая производительность, без холодных запусков, доступные цены.