#video-generation
407 articles

在 Claude Code 里用 WaveSpeed 技能生成图像与视频
给 Claude Code 接入 AI 媒体生成的三种方式——一条命令装技能、插件市场、MCP server——以及 agent 拿它们做什么、哪里有坑。

在 Cline 里用 WaveSpeed MCP Server 生成图像与视频
给 Cline 加上 WaveSpeed MCP server,agent 获得七个工具:实时目录搜索、逐模型 schema 自省、带本地文件上传的生成、以及花钱前的价格报价。

在 DeepSeek Harness 里用 WaveSpeed 技能生成图像与视频
实用配置指南:在 DeepSeek Harness(dsh)中安装 WaveSpeed 技能,让 agent 搜索模型目录、读取输入 schema、运行任意图像/视频/音频/3D 模型——每次运行前还能先查价格。

在 Gemini CLI 里用 WaveSpeed 扩展生成图像与视频
在 Gemini CLI 中安装 WaveSpeed 扩展,agent 就能搜索实时模型目录、读取输入 schema、运行任意图像/视频/音频/3D 模型——每次运行前还能先查价格。

在 OpenCode 里用 WaveSpeed 技能生成图像与视频
OpenCode 会从 .claude/skills 加载技能——而 wavespeed skill install 写入的正是这里。一条命令,agent 就能搜索模型目录、读取输入 schema、运行任意图像/视频/音频/3D 模型。

Gemini Omni Flash vs Seedance 2.0 vs Kling 3.0:多模态创作最佳AI视频模型对比
对Gemini Omni Flash、Seedance 2.0和Kling 3.0在多模态视频生成、编辑、分镜、音频及生产API工作流方面的实用对比分析。

Kling 3.0 Omni详解:多镜头分镜、原生音频及其超越Veo之处
对Kling 3.0 Omni的实用解析,涵盖分镜头脚本、原生音频、图像与视频生成,以及开发者如何将其与Veo、Seedance和Runway进行比较。

Seedance 2.0 技术解析:为何音视频生成正成为默认标准
对 Seedance 2.0 的实用技术解析,涵盖原生音视频生成、生产工作流,以及为何同步音效正成为 AI 视频的基本门槛。

Agnes-Video-V2.0 以 $0.30/分钟登场:Artificial Analysis 排行榜上的价格颠覆者
Agnes AI 的 V2.0 视频模型本周发布,支持原生音视频同步生成,定价仅 $0.30/分钟——比 Seedance 2.0 便宜约 28 倍。它在 Artificial Analysis 的 Elo 排名中跻身前 10,但仍远落后于前三名领跑者。以下是对其市场定位的客观解读。

Gemini Omni Flash 正式发布:10秒多模态视频、SynthID水印,音频编辑功能暂未开放
谷歌在I/O 2026上发布了Gemini Omni Flash——一个能够跨文本、图像、音频和视频进行推理的单一模型,可生成带同步音频的连贯视频输出。本文详解已发布功能、尚未开放的功能,以及它与Veo的区别。

Seedance 2.1 与 Seedance 2.0 Mini 即将到来:画质提升,价格更低
字节跳动正在准备两个全新的 Seedance 版本:Seedance 2.1 据报道生成质量提升约 20%,而全新的 Mini 版本定价将远低于当前 Seedance 价格,同时性能超越 Seedance 2.0 Fast。

Gemini Omni 演示视频泄露——谷歌全新视频模型究竟能做什么
在最初的UI字符串泄露八天后,首批Gemini Omni样本视频浮出水面。其对话驱动编辑能力表现强劲,但在原始画质方面落后于Seedance 2.0,且每段视频消耗约43%的AI Pro每日配额。这是I/O 2026开幕前一周的客观评测。