WaveSpeedAI

在 OpenCode 里用 WaveSpeed 技能生成图像与视频

OpenCode 会从 .claude/skills 加载技能——而 wavespeed skill install 写入的正是这里。一条命令,agent 就能搜索模型目录、读取输入 schema、运行任意图像/视频/音频/3D 模型。

By WaveSpeedAI2 min read

OpenCode 从多个目录解析 agent 技能,.claude/skills 就在其中——项目级和全局都算。这让 WaveSpeed 的接入变成真正的一行命令,因为 wavespeed CLI 的技能恰好装在那里:

npm install -g @wavespeed/cli
wavespeed login            # 打开 wavespeed.ai 的密钥页面并校验粘贴
wavespeed skill install    # 写入 .claude/skills/wavespeed/SKILL.md——OpenCode 直接识别

不需要插件、不需要 MCP server、不需要 OpenCode 专属打包。这份技能与 Claude Code、Cursor、Codex 用的是同一个文件。

agent 拿它做什么

wavespeed.ai 上的每个模型都是一条 wavespeed run <model-id> 命令。技能教「查找 → 检查 → 运行」模式:

# 1. 在实时目录里查找模型
wavespeed models "seedream"
wavespeed models --type image-to-video --popular

# 2. 检查它的真实输入 schema(逐模型实时拉取)
wavespeed run bytedance/seedream-v5.0-pro -h

# 3. 运行,用 JSON 读结果
wavespeed run bytedance/seedream-v5.0-pro \
  -p "a cyberpunk skyline at golden hour" \
  -i aspect_ratio="16:9" -i resolution="2k" --json

顺序很关键:靠猜参数名的 agent 会把运行次数烧在校验错误上,技能把 schema 变成循环的一部分。

本地文件走 @path 标记——一步完成上传并替换成托管 URL:

# 编辑本地图片
wavespeed run bytedance/seedream-v5.0-pro/edit \
  -p "replace the background with a sunlit kitchen" \
  -i images='["@./input.jpg"]' --json

# 让本地静态图动起来
wavespeed run bytedance/seedance-2.5/image-to-video \
  -p "subtle parallax, gentle wind" -i image=@./hero.jpg --json

花费控制

wavespeed price bytedance/seedream-v5.0-pro -i resolution=2k   # 报价,不扣费
wavespeed balance

很多模型按输入计费——音频时长、帧数。不带这些输入询价,公式会坍缩到模型的基础价(区间下限);命令会列出它没看到的输入(--json 里的 unpriced_inputs)。实际扣费金额以运行为准。

  • 裸路径不会上传。 -i image=./photo.jpg 发出去的是字符串本身。要写 @./photo.jpg
  • 不要编造模型 ID——先用 wavespeed modelswavespeed schema <id> 确认。
  • 运行永远带 --json,让 agent 程序化读取 outputs[0]
  • 项目默认值和别名放在 wavespeed.jsonwavespeed init 生成)。

相关链接

分享