InfiniteTalk:无限对话,最大程度逼真现已登陆WaveSpeedAI
veogoogle

InfiniteTalk:无限对话,最大程度逼真现已登陆WaveSpeedAI

目前,大多数 AI 视频工具只能生成无声视频。虽然谷歌的 Veo 3 已将唇音同步技术带入主流,但现有解决方案仍缺乏对扩展交互式对话的真正支持。

1 min read
Nano Banana Pro — AI视觉智能新标准现已登陆WaveSpeedAI
nano-bananagoogle

Nano Banana Pro — AI视觉智能新标准现已登陆WaveSpeedAI

Discover how Google’s Nano Banana Pro (Gemini 3.0 Pro Image) transforms visual creation with advanced remastering, style translation, and multimodal creative intelligence.

1 min read
WAN 2.2:更快、更智能、更精确的 AI 生成模型现已登陆WaveSpeedAI
wanalibaba

WAN 2.2:更快、更智能、更精确的 AI 生成模型现已登陆WaveSpeedAI

介绍万 2.2:更快、更智能、更精确的 AI 生成模型

1 min read
Ovi:超快速开源模型重新定义 AI 视频生成现已登陆WaveSpeedAI
veogoogle

Ovi:超快速开源模型重新定义 AI 视频生成现已登陆WaveSpeedAI

最近,具有声音的 AI 视频层出不穷。面对声称能生成同步视频和声音的新 AI 模型激增,您是否感到应接不暇?

1 min read
Kling 2.6:体验「所见即所闻」视频生成现已登陆WaveSpeedAI
klingkuaishou

Kling 2.6:体验「所见即所闻」视频生成现已登陆WaveSpeedAI

WaveSpeedAI荣幸宣布Kling 2.6正式上线,这是一次突破性升级,重新定义了创作者制作AI驱动视频的方式。首次实现视频、语音、音效和环境音频在单次处理中同时生成。

1 min read
Kling O1 Series——统一图像与视频创作的新标准现已登陆WaveSpeedAI
klingkuaishou

Kling O1 Series——统一图像与视频创作的新标准现已登陆WaveSpeedAI

Kling O1 Series在WaveSpeedAI正式推出,引入Kling Image O1和Kling Video O1的下一代多模态图像和视频创作功能。以无与伦比的一致性、控制力和创意能力,直接在浏览器中创建、编辑和转换视觉内容。

2 min read
Kling O1视频模型即将到来——视觉创作的全面跃升
wanalibaba

Kling O1视频模型即将到来——视觉创作的全面跃升

专为创作者、电影制作人和设计师打造,Kling O1在智能性、一致性和可编辑性方面实现了重大突破,覆盖完整的视频工作流程。这款下一代多模态视频引擎为所有视频从业者带来更流畅、更直观、高度可控的创作体验。

1 min read
Kling Omni Video O1 Video Edit 现已登陆WaveSpeedAI
wanalibaba

Kling Omni Video O1 Video Edit 现已登陆WaveSpeedAI

WaveSpeedAI荣幸宣布推出Kling Video Edit,由快手突破性的多模态视频模型Kling Omni Video O1驱动。使用Video Edit,您可以通过简单的自然语言指令修改视频。

2 min read
Kling Reference-to-Video 现已登陆WaveSpeedAI
klingkuaishou

Kling Reference-to-Video 现已登陆WaveSpeedAI

Kling Reference-to-Video允许您基于主体参考图像或视频生成全新的视频内容,同时在所有帧中保持一致的外观、身份和场景逻辑。

1 min read
LTX-2 超越Sora 2,定义20秒AI视频时代
soraopenai

LTX-2 超越Sora 2,定义20秒AI视频时代

当我们还在为Sora 2将AI视频延长到12秒而惊叹时,LTX-2已经再次突破这个界限——直接将视频生成推进到20秒。

1 min read
LongCat Avatar现已登陆WaveSpeedAI:超逼真唇形同步头像视频,最长2分钟
avatardigital-human

LongCat Avatar现已登陆WaveSpeedAI:超逼真唇形同步头像视频,最长2分钟

LongCat Avatar能将单张照片和音频轨道转化为超逼真的唇形同步说话或唱歌头像视频,具有自然的动态效果和一致的身份认同——每次生成最长可达2分钟。

1 min read
Nano Banana 2 泄露:一窥谷歌下一代AI图像模型
nano-bananagoogle

Nano Banana 2 泄露:一窥谷歌下一代AI图像模型

几个月前,Nano Banana因创建具有收藏品风格美学的超逼真AI人物而为人所知。

3 min read