Wan3.0上线千问AI平台:通义万相全能视频生成模型开放

AI资讯18小时前发布 文明旁观者
9 00

AI深识站24日消息今天,阿里巴巴通义万相团队研发的Wan3.0视频生成大模型正式接入千问AI平台(Qwen AI Platform),标志着国产AI视频生成进入”All-in-One”统一模型时代。从千问创作PC端到千问APP,Wan3.0以”稳定、真实、有质感”三大核心优势,为内容创作者和企业用户带来全新的视频生产体验。

Wan3.0上线千问AI平台:通义万相全能视频生成模型开放

从”多模型分立”到”All-in-One”统一模型

Wan3.0是通义万相系列的第三代核心版本,最大的架构变革在于将此前分散的文生视频、图生视频、参考生成和视频编辑等能力,统一整合到单一模型中。用户不再需要在一个模型生成、另一个模型编辑之间来回切换,而是可以在同一个工作流内完成从创意到成片的全部环节。

这种”一个模型多种玩法”的设计,不仅简化了创作流程,更关键的是保证了跨环节的风格一致性和角色连贯性。对于品牌内容、系列短视频等需要多镜头叙事的场景,Wan3.0的全能参考能力让”角色跨镜头保持一致”从奢望变成了标配。


稳定:生产级角色一致性与长视频生成

在视频生成领域,”稳定”是最难攻克的指标之一。Wan3.0通过全能参考机制,最高支持20个素材同时参考,涵盖图片、视频、音频、文档、网页等全模态输入。无论是角色形象、道具样式、声音特征还是空间关系,模型均能在像素级精度上保持稳定复刻。

单段视频生成时长从过去的数秒延长至30秒,配合原生1080P输出,意味着创作者可以一次性完成一个完整叙事片段的生成,而非反复拼接短片段。在全能参考任务中,角色、道具、声音、空间关系、风格等细粒度维度均可稳定保持,真正面向生产力场景提升了交付确定性。


真实:像素级复刻与”千人千面”人像

Wan3.0在画面真实感上实现了显著跃升。生成视频中的人像力求”千人千面”,更敏锐地刻画五官与皮肤细节,人物情绪表达自然克制,微表情与肢体动作彼此联动。无论是现实场景还是数字化信息,模型都力求精准复刻与呈现。

音画同步是另一大亮点。Wan3.0实现了原生音画同步输出,声音质感与画面运动高度匹配,创造出更强的视听冲击力。从人物对话到环境音效,声音不再是后期贴上去的”配件”,而是与画面一体生成的有机组成部分。


有质感:从文档到视频的全模态创作

Wan3.0首次实现了对Word、Excel、PPT、PDF及Markdown等文档格式的直接支持,将”万物皆可生视频”从口号变为现实。用户只需上传一份方案文档,模型即可自动提取关键信息、梳理叙事逻辑,生成结构化的演示视频。

这一能力对办公场景和知识传播具有颠覆性意义。财报数据可以自动转化为动态图表视频,产品方案可以一键生成演示大片,教学课件可以从静态文档变为动态讲解。数字化信息的画面审美也同步提升,图表、数据与界面内容同样拥有专业质感。

视频编辑能力同样大幅升级。Wan3.0支持通过自然语言指令修改画面、剧情与台词,也可以基于参考素材进行精准编辑。选中视频中的特定时间段,只重新生成该段内容,无需从头再来,极大提升了迭代效率。


千问AI平台全链路接入

作为阿里云模型即服务(MaaS)的核心平台,千问AI平台已完成对Wan3.0的全链路接入。用户可通过千问创作PC端直接使用,千问APP也已面向部分用户灰度开放。同时,阿里云百炼、万镜一刻、万相官网、IF STUDIO、堆友等平台同步开启公测。

在API层面,Wan3.0提供480P/720P/1080P三档分辨率选择,价格分别为0.3元/秒、0.6元/秒和1.2元/秒,API接口近期将向所有用户全面开放。千问AI平台还配套提供Context Cache缓存、结构化输出、函数调用等企业级功能,方便开发者将视频生成能力集成至自有应用。


最后想说

Wan3.0在千问AI平台的正式上线,不仅是通义万相系列的一次版本迭代,更是AI视频生成从”玩具”走向”生产力工具”的关键节点。稳定的全能参考、真实的音画质感、全模态的文档生视频能力,三者叠加,让Wan3.0成为当前国产视频生成模型中最具工程落地价值的选择之一。对于内容创作者、营销团队和企业用户而言,这或许是一个值得将Wan3.0纳入主力工作流的时刻。

© 版权声明
为这篇文章评分
10.0/ 10
2 人评价
点击⭐️进行评分

相关文章

暂无评论

none
暂无评论...