
Molmo2 Video Captioner теперь доступен на WaveSpeedAI
Molmo2-4B Video Captioner: Генерируйте подробные и точные субтитры для видео с настраиваемыми уровнями детализации (низкий, средний, высокий). Модель открытого исходного кода для анализа видео.

Molmo2 Video Content Moderator теперь доступен на WaveSpeedAI
Molmo2-4B Video Content Moderator анализирует видеоконтент на предмет безопасности, уместности и соответствия политике. Обнаруживает насилие, обнаженность, кровавые сцены и другой вредоносный видеоконтент

Представляем Molmo2 Video Qa на WaveSpeedAI
Molmo2-4B Video QA: Отвечайте на вопросы о содержании видео с временным пониманием. Открытая модель зрения и языка. Готовый REST API, без холодного запуска,

Представляем Molmo2 Video Understanding на WaveSpeedAI
Molmo2-4B Video Understanding: Анализируйте видео со специализированными задачами (общий анализ, резюме, анализ, подсчет, описание сцены). Модель визуального понимания с открытым исходным кодом

OpenAI Whisper с видео теперь доступен на WaveSpeedAI
OpenAI Whisper Large v3 (Video-to-Text) обеспечивает высокоточную многоязычную транскрипцию напрямую из видеофайлов с автоматическим определением языка и дополнительными опциями

PaddleOCR теперь доступен на WaveSpeedAI
PaddleOCR-VL — это компактная модель обработки зрения размером 0,9B параметров для анализа документов, поддерживающая 109 языков с распознаванием текста, таблиц, формул и диаграмм

Представляем Qwen Image 2512 LoRA Trainer на WaveSpeedAI
Qwen-Image-2512 LoRA Trainer позволяет обучать пользовательские LoRA модели в 10 раз быстрее с обучением стилей, персонажей и объектов. От концепции к модели за минуты, а не часы

Qwen Image Text-to-Image 2512 LoRA теперь доступна на WaveSpeedAI
Qwen-Image-2512 LoRA — это улучшенная 20B MMDiT модель преобразования текста в изображение с поддержкой LoRA для быстрой кастомизации и уточненной генерации изображений. Готов к использованию REST интерфейс

Представляем Video Background Remover на WaveSpeedAI
WaveSpeed Video Background Remover заменяет или удаляет фон видео с помощью пользовательского изображения. Загрузите или вставьте ссылку на ваше видео, затем предоставьте фоновое изображение

Z Image Turbo Controlnet теперь доступен на WaveSpeedAI
Z-Image-Turbo ControlNet генерирует изображения с направлением по сигналам структурного управления (глубина, canny edge, поза) для точного контроля композиции. Готовый REST интерфейс

xAI Grok 2 Image теперь доступен на WaveSpeedAI
Grok 2 Image — это последняя модель генерации изображений от xAI, которая превращает простые текстовые промпты в четкие, фотореалистичные визуальные эффекты за считанные секунды. От снимков продуктов до социальных

Z AI Glm Image Edit теперь доступна на WaveSpeedAI
GLM-Image Edit — это мощная модель редактирования изображений, которая трансформирует изображения на основе текстовых подсказок. Готовый к использованию REST API для вывода, лучшая производительность, без со