개발자들이 Together AI에서 옮겨 오는 이유
빠릅니다.
모든 모델에서 초고속 추론. 스튜디오에서도, API로도 이미지와 동영상이 빠르게 완성됩니다.
합리적입니다.
이미지는 1회 $0.024부터, 동영상은 1회 $0.05부터. 생성한 만큼만 결제하세요. 구독도, 월 요금도 없습니다.
- 미디어 모델
- 1,062+
- 언어 모델
- 111+
- 모델 제작사
- 43
- 예약할 GPU 시간
- 0
미디어는 부가 기능이 아닌 핵심
Seedance, Kling, Veo, Nano Banana, GPT Image, ElevenLabs, Tripo 등 각 모델마다 전용 엔드포인트, 입력 스키마, 예시, 실행당 명시된 가격이 있습니다.
Together AI: 오픈소스 언어 모델을 중심으로 구축된 플랫폼으로, 서버리스 API에서 일부 이미지·비디오·오디오 모델을 제공합니다.
최첨단·오픈 LLM을 키 하나로
Claude, GPT, Gemini와 DeepSeek, Kimi, Qwen, GLM을 미디어 호출과 같은 잔액에서 과금되는 OpenAI 호환 API로.
Together AI: 오픈소스 모델 중심의 OpenAI 호환 API.
예약할 것도, 켜 둘 것도 없음
모든 모델이 호스팅되어 바로 준비되어 있습니다. 토큰 또는 출력 단위로 결제하며, 엔드포인트 크기를 정하거나 시간당 요금이 쌓일 일이 없습니다.
Together AI: 서버리스 API와 함께, 예약 용량에 대해 GPU 시간당 과금되는 전용 엔드포인트와 GPU 클러스터.
팀 전체를 위한 스튜디오
디자이너와 마케터는 브라우저에서 이미지, 비디오, 오디오, 3D 생성기와 편집 도구, AI 비디오 편집기를 API와 같은 계정으로 사용합니다.
Together AI: 웹 플레이그라운드를 갖춘 개발자 플랫폼.
LLM API
그대로 교체 가능
OpenAI 호환 Chat Completions와 Responses, 그리고 Anthropic 호환 Messages 엔드포인트까지. 베이스 URL만 바꾸면 끝입니다.
미디어 API
이미지·비디오·오디오·3D
JSON을 보내면 예측 id가 돌아오고, 결과를 폴링하거나 웹훅으로 받으면 됩니다. 모든 모델에 하나의 요청 형식.
학습
LoRA 트레이너
인기 이미지·비디오 모델용 LoRA를 학습하고, 대응하는 LoRA 엔드포인트에서 실행하세요.
에이전트
에이전트 준비 완료
CLI, Agent Skill, MCP 서버로 코딩 에이전트가 모든 미디어 모델을 사용할 수 있으며, Codex, Claude Code 등의 설정 가이드도 제공합니다.
언어 모델
어떤 LLM과도 대화
베이스 URL만 바꾸세요. OpenAI 클라이언트는 그대로. 클로즈드·오픈 모델을 키 하나로.
POSThttps://llm.wavespeed.ai/v1/chat/completions
curl https://llm.wavespeed.ai/v1/chat/completions \
-H "Authorization: Bearer $WAVESPEED_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "openai/gpt-6-astra",
"messages": [{"role": "user", "content": "Hello!"}]
}'import os
from openai import OpenAI
client = OpenAI(base_url="https://llm.wavespeed.ai/v1", api_key=os.environ["WAVESPEED_API_KEY"])
reply = client.chat.completions.create(
model="openai/gpt-6-astra",
messages=[{"role": "user", "content": "Hello!"}],
)
print(reply.choices[0].message.content)import OpenAI from 'openai'
const client = new OpenAI({ baseURL: 'https://llm.wavespeed.ai/v1', apiKey: process.env.WAVESPEED_API_KEY })
const reply = await client.chat.completions.create({
model: 'openai/gpt-6-astra',
messages: [{ role: 'user', content: 'Hello!' }],
})
console.log(reply.choices[0].message.content)미디어 모델
이미지와 비디오 생성
같은 키로 모든 미디어 모델을 호출합니다. 요청을 보낸 뒤 결과를 폴링하거나 웹훅으로 받으세요.
POSThttps://api.wavespeed.ai/api/v3/bytedance/seedream-v5.0-pro
curl -X POST "https://api.wavespeed.ai/api/v3/bytedance/seedream-v5.0-pro" \
-H "Authorization: Bearer $WAVESPEED_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"prompt": "A glass teapot on a sunlit windowsill, soft morning light",
"aspect_ratio": "4:3",
"resolution": "2k"
}'
# → {"data": {"id": "<prediction id>", ...}}
curl "https://api.wavespeed.ai/api/v3/predictions/<prediction id>/result" \
-H "Authorization: Bearer $WAVESPEED_API_KEY"import os, time, requests
headers = {"Authorization": f"Bearer {os.environ['WAVESPEED_API_KEY']}"}
task = requests.post("https://api.wavespeed.ai/api/v3/bytedance/seedream-v5.0-pro", headers=headers, json={
"prompt": "A glass teapot on a sunlit windowsill, soft morning light",
"aspect_ratio": "4:3",
"resolution": "2k"
}).json()["data"]
while True:
result = requests.get(f"https://api.wavespeed.ai/api/v3/predictions/{task['id']}/result", headers=headers).json()["data"]
if result["status"] == "completed":
print(result["outputs"])
break
if result["status"] == "failed":
raise RuntimeError(result.get("error"))
time.sleep(2)const headers = { Authorization: `Bearer ${process.env.WAVESPEED_API_KEY}`, 'Content-Type': 'application/json' }
const { data: task } = await fetch('https://api.wavespeed.ai/api/v3/bytedance/seedream-v5.0-pro', {
method: 'POST',
headers,
body: JSON.stringify({
"prompt": "A glass teapot on a sunlit windowsill, soft morning light",
"aspect_ratio": "4:3",
"resolution": "2k"
}),
}).then((r) => r.json())
while (true) {
const { data: result } = await fetch(`https://api.wavespeed.ai/api/v3/predictions/${task.id}/result`, { headers }).then((r) => r.json())
if (result.status === 'completed') { console.log(result.outputs); break }
if (result.status === 'failed') throw new Error(result.error)
await new Promise((r) => setTimeout(r, 2000))
}WaveSpeedAI vs Together AI
| WaveSpeedAI | Together AI | |
|---|---|---|
| 언어 모델 | 클로즈드·오픈 모델을 위한 OpenAI·Anthropic 호환 API | 오픈소스 모델 중심의 OpenAI 호환 API |
| 이미지·비디오·오디오·3D | 모든 이미지·비디오·오디오·3D 모델에 전용 엔드포인트, 그리고 브라우저 스튜디오 | 서버리스 API의 이미지·비디오·오디오 모델 |
| 결제 방식 | 사용한 만큼 결제: LLM은 토큰당, 미디어는 실행당 명시 가격, 월 요금 없음 | 선불 크레딧, 서버리스 모델은 토큰·이미지·비디오 단위 과금, 전용 용량은 GPU 시간당 |
| GPU 인프라 | 관리할 것 없음: 모든 모델이 완전 호스팅 | 시간 단위로 과금되는 전용 엔드포인트와 GPU 클러스터 |
| 커스텀 모델 | 인기 이미지·비디오 모델용 LoRA 트레이너 | 학습 토큰당 과금되는 오픈소스 모델 파인튜닝 |
| 브라우저에서 | 이미지·비디오·오디오·3D 스튜디오와 LLM 플레이그라운드 | 웹 플레이그라운드 |
자주 묻는 질문
WaveSpeedAI는 좋은 Together AI 대안인가요?
언어 모델로 개발하면서 이미지, 비디오, 오디오, 3D도 필요하다면 그렇습니다. API 키 하나로 클로즈드·오픈 모델을 제공하는 OpenAI 호환 LLM API와 바로 호출 가능한 미디어 엔드포인트를 모두 쓸 수 있으며, 전부 사용한 만큼 결제하고 배포할 것이 없습니다.
OpenAI SDK를 계속 쓸 수 있나요?
네. OpenAI SDK를 WaveSpeedAI API 키와 함께 https://llm.wavespeed.ai/v1로 지정하고 모델 id를 넘기면 됩니다. 필요한 도구를 위해 Anthropic 호환 엔드포인트와 Responses 엔드포인트도 제공합니다.
이미지나 비디오는 어떻게 생성하나요?
API 키와 함께 https://api.wavespeed.ai/api/v3/<model>에 JSON을 POST하세요. 즉시 prediction id가 돌아옵니다. 결과 엔드포인트를 폴링하거나 웹훅을 넘기면 저희가 알려 드립니다.
요금은 어떻게 청구되나요?
하나의 잔액에서 사용한 만큼 결제합니다. 언어 모델은 토큰당, 미디어 모델은 각 모델 페이지에 표시된 실행당 가격으로 과금됩니다. 월 요금도 GPU 시간도 없습니다.
커스텀 모델을 학습할 수 있나요?
네, 이미지와 비디오용으로 가능합니다. LoRA 트레이너가 인기 이미지·비디오 모델을 지원하고, LoRA 엔드포인트에서 학습한 결과를 실행할 수 있습니다.
무료로 사용해 볼 수 있나요?
네. 조건을 충족하는 신규 계정은 $1 무료 크레딧을 받아 신용카드 없이 바로 개발을 시작할 수 있습니다. 일부 프리미엄 모델은 체험 크레딧으로 이용하지 못할 수 있습니다.






