A alternativa ao Together AI
LLMs abertos e de fronteira.
E todos os modelos de mídia.
Claude, GPT, Gemini, DeepSeek e Kimi rápidos e acessíveis em uma API compatível com OpenAI, além de 1.062 modelos de imagem, vídeo, áudio e 3D prontos para chamar. Uma chave, pagamento por uso, nenhuma GPU para reservar.
Abre o playground com sua mensagem. Entre na sua conta para executá-la.
Por que desenvolvedores trocam o Together AI
Rápido.
Inferência ultrarrápida em todos os modelos. Suas imagens e vídeos ficam prontos rápido, no estúdio e pela API.
Acessível.
Imagens a partir de $0.024 e vídeos a partir de $0.05 por execução. Pague só pelo que você gerar, sem assinatura e sem mensalidade.
- Modelos de mídia
- 1,062+
- Modelos de linguagem
- 111+
- Criadores de modelos
- 43
- Horas de GPU para reservar
- 0
Mídia em primeiro lugar, não um complemento
Seedance, Kling, Veo, Nano Banana, GPT Image, ElevenLabs, Tripo e mais, cada um com seu próprio endpoint, esquema de entrada, exemplos e um preço fixo por execução.
Together AI: Uma plataforma construída em torno de modelos de linguagem de código aberto, com uma seleção de modelos de imagem, vídeo e áudio em sua API serverless.
LLMs de fronteira e abertos com uma chave
Claude, GPT e Gemini ao lado de DeepSeek, Kimi, Qwen e GLM, em uma API compatível com OpenAI cobrada do mesmo saldo das suas chamadas de mídia.
Together AI: Uma API compatível com OpenAI focada em modelos de código aberto.
Nada para reservar ou manter ativo
Todo modelo já está hospedado e pronto. Pague por token ou por resultado, sem endpoints para dimensionar e sem cobrança por hora correndo.
Together AI: APIs serverless, além de endpoints dedicados e clusters de GPU cobrados por hora de GPU para capacidade reservada.
Studios para todo o seu time
Designers e profissionais de marketing ganham geradores de imagem, vídeo, áudio e 3D, ferramentas de edição e um editor de vídeo com IA no navegador, na mesma conta da sua API.
Together AI: Uma plataforma para desenvolvedores com um playground web.
API de LLM
Compatível na hora
Chat completions e Responses compatíveis com OpenAI, além de um endpoint Messages compatível com Anthropic. Troque a URL base e pronto.
API de mídia
Imagem, vídeo, áudio e 3D
Envie JSON, receba um id de predição e depois consulte o resultado ou receba um webhook. Um único formato de requisição para todos os modelos.
Treinamento
Treinadores de LoRA
Treine LoRAs para modelos populares de imagem e vídeo e execute-os nos endpoints LoRA correspondentes.
Agentes
Pronto para agentes
Uma CLI, um Agent Skill e um servidor MCP dão aos agentes de programação acesso a todos os modelos de mídia, com guias de configuração para Codex, Claude Code e outros.
API de mídia
Endpoints de mídia populares
Preços ao vivo por execução. Abra um para ver o esquema e os exemplos, ou teste no navegador.
Modelos de linguagem
Converse com qualquer LLM
Troque a URL base. Mantenha seu cliente OpenAI. Modelos fechados e abertos com uma chave.
POSThttps://llm.wavespeed.ai/v1/chat/completions
curl https://llm.wavespeed.ai/v1/chat/completions \
-H "Authorization: Bearer $WAVESPEED_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "openai/gpt-6-astra",
"messages": [{"role": "user", "content": "Hello!"}]
}'import os
from openai import OpenAI
client = OpenAI(base_url="https://llm.wavespeed.ai/v1", api_key=os.environ["WAVESPEED_API_KEY"])
reply = client.chat.completions.create(
model="openai/gpt-6-astra",
messages=[{"role": "user", "content": "Hello!"}],
)
print(reply.choices[0].message.content)import OpenAI from 'openai'
const client = new OpenAI({ baseURL: 'https://llm.wavespeed.ai/v1', apiKey: process.env.WAVESPEED_API_KEY })
const reply = await client.chat.completions.create({
model: 'openai/gpt-6-astra',
messages: [{ role: 'user', content: 'Hello!' }],
})
console.log(reply.choices[0].message.content)Modelos de mídia
Gere imagens e vídeos
A mesma chave chama todos os modelos de mídia: envie a requisição e depois consulte o resultado ou receba um webhook.
POSThttps://api.wavespeed.ai/api/v3/bytedance/seedream-v5.0-pro
curl -X POST "https://api.wavespeed.ai/api/v3/bytedance/seedream-v5.0-pro" \
-H "Authorization: Bearer $WAVESPEED_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"prompt": "A glass teapot on a sunlit windowsill, soft morning light",
"aspect_ratio": "4:3",
"resolution": "2k"
}'
# → {"data": {"id": "<prediction id>", ...}}
curl "https://api.wavespeed.ai/api/v3/predictions/<prediction id>/result" \
-H "Authorization: Bearer $WAVESPEED_API_KEY"import os, time, requests
headers = {"Authorization": f"Bearer {os.environ['WAVESPEED_API_KEY']}"}
task = requests.post("https://api.wavespeed.ai/api/v3/bytedance/seedream-v5.0-pro", headers=headers, json={
"prompt": "A glass teapot on a sunlit windowsill, soft morning light",
"aspect_ratio": "4:3",
"resolution": "2k"
}).json()["data"]
while True:
result = requests.get(f"https://api.wavespeed.ai/api/v3/predictions/{task['id']}/result", headers=headers).json()["data"]
if result["status"] == "completed":
print(result["outputs"])
break
if result["status"] == "failed":
raise RuntimeError(result.get("error"))
time.sleep(2)const headers = { Authorization: `Bearer ${process.env.WAVESPEED_API_KEY}`, 'Content-Type': 'application/json' }
const { data: task } = await fetch('https://api.wavespeed.ai/api/v3/bytedance/seedream-v5.0-pro', {
method: 'POST',
headers,
body: JSON.stringify({
"prompt": "A glass teapot on a sunlit windowsill, soft morning light",
"aspect_ratio": "4:3",
"resolution": "2k"
}),
}).then((r) => r.json())
while (true) {
const { data: result } = await fetch(`https://api.wavespeed.ai/api/v3/predictions/${task.id}/result`, { headers }).then((r) => r.json())
if (result.status === 'completed') { console.log(result.outputs); break }
if (result.status === 'failed') throw new Error(result.error)
await new Promise((r) => setTimeout(r, 2000))
}WaveSpeedAI vs Together AI
| WaveSpeedAI | Together AI | |
|---|---|---|
| Modelos de linguagem | API compatível com OpenAI e Anthropic para modelos fechados e abertos | API compatível com OpenAI focada em modelos de código aberto |
| Imagem, vídeo, áudio e 3D | Um endpoint dedicado para cada modelo de imagem, vídeo, áudio e 3D, além de estúdios no navegador | Modelos de imagem, vídeo e áudio em sua API serverless |
| Cobrança | Pagamento por uso: por token para LLMs, um preço fixo por execução para mídia, sem mensalidade | Créditos pré-pagos; modelos serverless cobrados por token, imagem ou vídeo; capacidade dedicada por hora de GPU |
| Infraestrutura de GPU | Nada para gerenciar: todo modelo é totalmente hospedado | Endpoints dedicados e clusters de GPU, cobrados por hora |
| Modelos personalizados | Treinadores de LoRA para modelos populares de imagem e vídeo | Fine-tuning de modelos de código aberto, cobrado por token de treinamento |
| No navegador | Estúdios de imagem, vídeo, áudio e 3D, além de um playground de LLM | Um playground web |
Perguntas frequentes
O WaveSpeedAI é uma boa alternativa ao Together AI?
Se você trabalha com modelos de linguagem e também precisa de imagens, vídeo, áudio ou 3D, sim. Uma única chave de API cobre uma API de LLM compatível com OpenAI com modelos fechados e abertos, além de endpoints de mídia prontos para chamar, tudo com pagamento por uso e nada para implantar.
Posso continuar usando o SDK da OpenAI?
Sim. Aponte o SDK da OpenAI para https://llm.wavespeed.ai/v1 com sua chave de API do WaveSpeedAI e informe o id do modelo. Endpoints compatíveis com Anthropic e de Responses estão disponíveis para ferramentas que precisam deles.
Como gero imagens ou vídeos?
Faça um POST de JSON para https://api.wavespeed.ai/api/v3/<model> com sua chave de API. Um id de predição volta na hora. Consulte o endpoint de resultado, ou passe um webhook e nós chamamos você.
Como é a cobrança?
Pagamento por uso a partir de um único saldo. Modelos de linguagem são cobrados por token; modelos de mídia pelo preço fixo por execução exibido em cada página de modelo. Sem mensalidade e sem horas de GPU.
Posso treinar modelos personalizados?
Sim, para imagens e vídeo. Os treinadores de LoRA cobrem modelos populares de imagem e vídeo, e os endpoints LoRA executam o que você treinou.
Posso testar de graça?
Sim. Contas novas elegíveis recebem $1 em créditos grátis para começar a construir, sem precisar de cartão de crédito. Alguns modelos premium podem não estar disponíveis com os créditos de teste.
Uma chave para todos os modelos.
$1 em créditos grátis para contas novas elegíveis. Sem cartão.






