
Molmo2 Video Captioner agora disponível em WaveSpeedAI
Molmo2-4B Video Captioner: Gere legendas detalhadas e precisas para vídeos com níveis de detalhe personalizáveis (baixo, médio, alto). Modelo de visão-linguagem de código aberto

Introduzindo Molmo2 Video Content Moderator on WaveSpeedAI
Molmo2-4B Video Content Moderator analisa conteúdo de vídeo para segurança, adequação e conformidade com políticas. Detecta violência, nudez, gore e outros conteúdos prejudiciais

Apresentando Molmo2 Video QA no WaveSpeedAI
Molmo2-4B Video QA: Responda perguntas sobre conteúdo de vídeo com compreensão temporal. Modelo de visão-linguagem de código aberto. API REST pronta para usar, sem cold starts,

Apresentando Molmo2 Video Understanding no WaveSpeedAI
Molmo2-4B Video Understanding: Analise vídeos com tarefas especializadas (geral, resumo, análise, contagem, descrição de cena). Modelo visão-linguagem de código aberto

Apresentando Openai Whisper With Video on WaveSpeedAI
OpenAI Whisper Large v3 (Video-to-Text) oferece transcrição multilíngue de alta precisão diretamente de arquivos de vídeo, com detecção automática de idioma e opções

Apresentando Paddle Ocr no WaveSpeedAI
PaddleOCR-VL é um modelo compacto de visão-linguagem com 0,9B de parâmetros para análise de documentos, suportando 109 idiomas com reconhecimento de texto, tabelas, fórmulas e gráficos

Apresentando Qwen Image 2512 LoRA Trainer no WaveSpeedAI
Qwen-Image-2512 LoRA Trainer permite treinar modelos LoRA personalizados 10x mais rápido com treinamento de estilo, personagem e objeto. Do conceito ao modelo em minutos, não horas

Apresentando Qwen Image Text-to-Image 2512 LoRA no WaveSpeedAI
Qwen-Image-2512 LoRA é um modelo MMDiT texto-para-imagem de 20B aprimorado com suporte a LoRA para customização rápida e geração refinada de imagens. REST pronto para uso

Apresentando Video Background Remover no WaveSpeedAI
WaveSpeed Video Background Remover substitui ou remove fundos de vídeo com uma imagem personalizada. Faça upload ou cole um link do seu vídeo e forneça uma imagem de fundo

Apresentando Z Image Turbo Controlnet no WaveSpeedAI
Z-Image-Turbo ControlNet gera imagens orientadas por sinais de controle estrutural (profundidade, borda canny, pose) para controle de composição preciso. Inferência REST pronta para uso

Apresentando xAI Grok 2 Image no WaveSpeedAI
Grok 2 Image é o mais recente modelo de geração de imagens da xAI que transforma prompts de texto simples em visuais nítidos e fotorrealistas em segundos. De fotos de produtos a redes sociais

Apresentando Z AI Glm Image Edit no WaveSpeedAI
GLM-Image Edit é um poderoso modelo de edição de imagem para imagem que transforma imagens com base em prompts de texto. API REST de inferência pronta para usar, melhor desempenho, sem co