#video-generation
411 articles - Page 32

Kling O1视频模型即将到来——视觉创作的全面跃升
专为创作者、电影制作人和设计师打造,Kling O1在智能性、一致性和可编辑性方面实现了重大突破,覆盖完整的视频工作流程。这款下一代多模态视频引擎为所有视频从业者带来更流畅、更直观、高度可控的创作体验。

Kling Omni Video O1 Video Edit 现已登陆WaveSpeedAI
WaveSpeedAI荣幸宣布推出Kling Video Edit,由快手突破性的多模态视频模型Kling Omni Video O1驱动。使用Video Edit,您可以通过简单的自然语言指令修改视频。

Kling Reference-to-Video 现已登陆WaveSpeedAI
Kling Reference-to-Video允许您基于主体参考图像或视频生成全新的视频内容,同时在所有帧中保持一致的外观、身份和场景逻辑。

LTX-2 超越Sora 2,定义20秒AI视频时代
当我们还在为Sora 2将AI视频延长到12秒而惊叹时,LTX-2已经再次突破这个界限——直接将视频生成推进到20秒。

Nano Banana Pro vs Wan 2.5 Image Edit:编辑精修遇见完整生成能力
探索谷歌的 Nano Banana Pro(Gemini 3.0 Pro Image)和 Wan 2.5 Image Edit 如何结合生成和精准编辑来简化创意工作流程。

Seedance 1.5 Pro:迈向原生音视频生成的重大步伐
随着生成式视频进入真实生产阶段,仅有视觉效果已不再足够。现代工作流程日益要求视频和音频一起生成——原生且同步。ByteDance 的下一代原生音视频协同生成模型 Seedance 1.5 Pro 现已在 WaveSpeedAI 上线。

停止训练,开始创作:在WaveSpeedAI上使用LoRA
什么是LoRA?可以把它看作一种轻量级微调方法:与其重新训练整个模型,你只需向现有模型添加一个小的'快速适应'层来锁定你自己的风格——更快、更便宜。

WaveSpeedAI:多模态AIGC平台释放无限创意
多模态AIGC平台释放无限创意

AI视频的下一步:认识WAN 2.5
过去几年,AI视频生成经历了几波创新浪潮——首先是更流畅的动作,然后是更高的视觉清晰度。

通过WaveSpeedAI上的阿里巴巴WAN 2.6解锁下一代视频创作
现已在WaveSpeedAI上推出,阿里巴巴的WAN 2.6模型为创作者提供更强的叙事能力、更智能的参考驱动生成和更长、更富表现力的输出。我们重点介绍了定义WAN 2.6的三个核心功能。

Veo 3.1 现已在 WaveSpeedAI 上可用
全球多模态推理加速平台 WaveSpeedAI 今日宣布推出 Veo 3.1——谷歌最新的视频和音频生成模型——现已通过 WaveSpeedAI API 访问。

Veo 3.1:OpenAI Sora 2 的竞争对手即将到来
Veo 3 开启了AI视频生成的新篇章——当有声视频成为可能而非想象