在 OpenCode 里用 WaveSpeed 技能生成图像与视频
OpenCode 会从 .claude/skills 加载技能——而 wavespeed skill install 写入的正是这里。一条命令,agent 就能搜索模型目录、读取输入 schema、运行任意图像/视频/音频/3D 模型。
By WaveSpeedAI2 min read
OpenCode 从多个目录解析 agent 技能,.claude/skills 就在其中——项目级和全局都算。这让 WaveSpeed 的接入变成真正的一行命令,因为 wavespeed CLI 的技能恰好装在那里:
npm install -g @wavespeed/cli
wavespeed login # 打开 wavespeed.ai 的密钥页面并校验粘贴
wavespeed skill install # 写入 .claude/skills/wavespeed/SKILL.md——OpenCode 直接识别
不需要插件、不需要 MCP server、不需要 OpenCode 专属打包。这份技能与 Claude Code、Cursor、Codex 用的是同一个文件。
agent 拿它做什么
wavespeed.ai 上的每个模型都是一条 wavespeed run <model-id> 命令。技能教「查找 → 检查 → 运行」模式:
# 1. 在实时目录里查找模型
wavespeed models "seedream"
wavespeed models --type image-to-video --popular
# 2. 检查它的真实输入 schema(逐模型实时拉取)
wavespeed run bytedance/seedream-v5.0-pro -h
# 3. 运行,用 JSON 读结果
wavespeed run bytedance/seedream-v5.0-pro \
-p "a cyberpunk skyline at golden hour" \
-i aspect_ratio="16:9" -i resolution="2k" --json
顺序很关键:靠猜参数名的 agent 会把运行次数烧在校验错误上,技能把 schema 变成循环的一部分。
本地文件走 @path 标记——一步完成上传并替换成托管 URL:
# 编辑本地图片
wavespeed run bytedance/seedream-v5.0-pro/edit \
-p "replace the background with a sunlit kitchen" \
-i images='["@./input.jpg"]' --json
# 让本地静态图动起来
wavespeed run bytedance/seedance-2.5/image-to-video \
-p "subtle parallax, gentle wind" -i image=@./hero.jpg --json
花费控制
wavespeed price bytedance/seedream-v5.0-pro -i resolution=2k # 报价,不扣费
wavespeed balance
很多模型按输入计费——音频时长、帧数。不带这些输入询价,公式会坍缩到模型的基础价(区间下限);命令会列出它没看到的输入(--json 里的 unpriced_inputs)。实际扣费金额以运行为准。
坑
- 裸路径不会上传。
-i image=./photo.jpg发出去的是字符串本身。要写@./photo.jpg。 - 不要编造模型 ID——先用
wavespeed models或wavespeed schema <id>确认。 - 运行永远带
--json,让 agent 程序化读取outputs[0]。 - 项目默认值和别名放在
wavespeed.json(wavespeed init生成)。
相关链接
- CLI(MIT):WaveSpeedAI/wavespeed-cli ·
@wavespeed/cli - 模型目录:wavespeed.ai/models
- 其他 agent:DeepSeek Harness · Gemini CLI · Claude Code 插件 · MCP server
