阿里Wan3.0视频模型低调公测:30秒长视频价格砍半,附10个实测案例

Ai138 8

阿里Wan3.0视频模型在千问创作端低调公测,支持30秒长视频、多模态参考及文档读取,定价仅为友商一半。本文通过10个实测案例,展示其在粒子MV、液态金属、微短剧等场景的真实表现,并介绍Agent Team多智能体协作新功能。

阿里Wan3.0视频模型低调公测:30秒长视频价格砍半,附10个实测案例

阿里 Wan3.0 视频模型低调上线,30 秒长视频价格砍半

昨晚刷手机,看到阿里在千问创作端(c.qianwen.com)悄悄公测了新一代视频生成模型 Wan3.0。没有大张旗鼓的发布会,但消息传开后,圈子里已经炸了。

跟朋友要了个内测资格,连夜跑了二十多个测试案例,挑出 10 个有代表性的分享给大家。先说结论:这个模型在长视频生成多模态参考、指令遵循这几个维度上,确实有两把刷子。

价格直接打到友商一半

先看最敏感的部分——定价。

Wan3.0 的收费标准是:480P 每秒 0.3 元,720P 每秒 0.6 元,1080P 每秒 1.2 元。换算下来,大概是同类产品 Runway Gen-3 的 40% 到 50%。

而且它支持生成 30 秒的完整视频,目前市面上能做到这个时长的模型屈指可数。更关键的是,Wan3.0 不只是支持文本、图片、视频、音乐这四种基础模态,还能直接读取网页链接和 Word 文档。这意味着你丢给它一个产品说明文档,它就能直接生成对应的视频内容。

十个实测案例,看看真实水平

为了不吹不黑,每个案例只跑一次正式生成,不反复抽卡。以下是我挑出来的几个代表性场景。

霓虹粒子城市 MV:视觉冲击力拉满

提示词要求生成一支 30 秒的赛博朋克电子音乐 MV,洋红与青蓝主色调,粒子构成的奔跑者,最后变成霓虹凤凰穿越云层。

实际效果:粒子到凤凰再到城市远景的转换非常连贯,没有硬切,光影和材质质感都在线。视觉冲击力我给 9 分,提示词遵循度 9 分,连续性和运镜 8.5 分。在抽象视觉和长距离空间运动上,Wan3.0 的表现确实让人意外。

液态金属芭蕾:复杂指令完成度高

这个案例要求舞者与液态金属共舞,金属要经历液态、丝带、薄片、圆环四种状态转换,全程单镜头拍摄。

结果:舞者动作连贯稳定,金属状态转换自然,最终银环清晰呈现。整个视频有超现实高级艺术短片的感觉。唯一的小瑕疵是金属丝带在个别帧的物理反馈稍显生硬,但整体完成度已经很高。

深夜便利店微短剧:情绪表达到位

这个案例考验的是人物一致性和情感表达。要求同一男主和女店员贯穿全片,女店员多给一串鱼丸,说一句”今天也辛苦了”。

结果:男女主角的外貌特征、服装细节全程保持一致,雨夜冷暖光对比处理得很好,男主克制表演和结尾便利店远景都成立。那句台词也准确生成了。唯一遗憾的是”多给一串鱼丸”这个动作细节没有特别突出,但整体情绪表达已经相当到位。

香水瓶里的沙漠风暴:产品稳定性出色

用一张参考图锁定无品牌香水瓶,要求瓶内出现微缩沙漠、沙尘涡旋、金色气泡的完整叙事。

Wan3.0 在单图产品稳定性上表现不错:瓶型、玻璃质感、瓶盖和琥珀色液体贯穿 30 秒都保持稳定,还能把”瓶内沙漠—沙尘涡旋—金色气泡”做成完整广告叙事。指令遵循能力确实强。

火星快递品牌片:四张分镜准确扩成完整叙事

这个案例给了四张参考分镜,要求生成一支火星快递品牌片,锁定同一快递员、同一快递车、同一岩石生物。

结果:四张分镜被准确扩成了一支结构完整的 30 秒品牌短片,人物、包裹、岩石生物和色彩标识都保持稳定。唯一不足是最后一个镜头中,头盔反射里的青绿色三角形看起来像是印上去的,反射效果不够自然。

折纸鲸穿过纸上城市:多参考分镜控制力强

要求按四张参考分镜生成折纸定格动画,锁定同一只靛蓝色折纸鲸和同一座纸上城市。

这条测试说明 Wan3.0 对”多参考分镜+单一视觉”的控制有明显提升:同一只折纸鲸、同一座纸城和同一条蓝纸河能够连续跨越 30 秒,金色胸鳍与三栋地标也没有漂移。

末班地铁的第二个自己:首尾帧控制惊艳

这个案例要求首帧和尾帧严格锚定,女主在地铁车厢里看到自己的倒影延迟半秒动作,最后倒影站起来说”轮到我了”。

Wan3.0 的首尾帧控制力确实强:不仅复现了开场的空地铁与车窗倒影,还能在 30 秒内保持同一人物、同一服装和同一车厢轴线,最后把”反射站起来、本体仍在座位旁”的关键尾帧稳定落地。分身逻辑和长镜头连续性都很强。

电商后台 AI 商品助手功能发布片:文档参考实用

这个案例用了一张电商后台设计稿和一份功能说明 TXT,要求生成 30 秒的产品发布演示视频。

结果:五个阶段几乎完全准确,主标题、四步流程、任务状态都保留了。虽然小字和拖放细节会有点小漂移,但作为产品概念片已经有很高的可用度。这个”全能参考”能力对做产品演示的人来说非常实用。

机械腕表城市机芯:工业设计参考扩成概念片

三张参考图(正面、背面、爆炸结构图)被真正组织成了”外观展示—轴向拆解—机芯城市—回装复原”的 30 秒连续广告。产品身份、机械结构和橙色光轨都能前后对应。

已经能把静态工业设计参考扩成高完成度概念片了,这对做产品广告的团队来说是个好消息。

黑洞吞噬恒星科普视频:PDF 参考直接生成

Wan3.0 能够读取科普 PDF 和确定性结构图,把黑洞潮汐瓦解压成四阶段、带中文标签与旁白的解释动画,结构清晰。适合做科普视频的片段。

Agent Team 模式:多智能体协作创作

这次千问创作端还上线了一个新功能叫 Agent Team 模式。简单说,就是可以拉多个专业 Agent 协同创作,根据不同的创作需求,自动组建由编剧、导演、美术、视频师、剪辑师等组成的 AI 团队。

每个 Agent 各司其职,模拟真实内容团队的分工方式,让复杂的视频创作从”一个模型单点生成”升级为”多个专家共同完成”。目前这个功能还需要邀请码。

总结:性价比是最大杀器

跑完这二十多个案例,我的感受是:Wan3.0 在真实物理世界、光影、运动、表情等方面的表现可圈可点,人物一致性和稳定性都不错,BGM 和配音也能同步生成。

缺点也有:视频里的小字还是容易崩,个别细节的物理反馈偶尔会出错。但拿来做漫剧、短剧完全没有问题。

最大的优势还是那个:30 秒 1080P 音画同步视频,价格只有友商的一半。市场上出现越多强大的 AI 视频模型,对我们普通用户就越有利。厂商之间良性竞争,价格才会越来越便宜。

手机端用户也可以在千问 App 的 AI 生视频功能里选择 Wan3.0 体验,已经开启公测了,可以看看有没有灰度到。

蛙蛙写作