智能AI
morning
Wan3.0发布,AI视频迎来“6毛”斩杀线?
摘要
近一个月来,视频模型的赛道格外热闹。 一方面,各大厂商密集发布最新模型。7月31日,MiniMax H3和Seedance 2.5同日发布。前者支持15秒2K原生音视频和多模态统一输入;后者将单次生成提升至30秒,并强化多模态参考和时间戳编辑。 8月24日,阿里Wan 3.0结束公测并正式上线。截至8月27日,Wan 3.0位列Artificial Analysis有声文生视频和有声视频编辑双榜全...
Wan
7月31日
MiniMax
生产级基准线
数据来源
Artificial
Analysis
近一个月排名
近一个月来
视频模型的赛道格外热闹
2026-08-28
1 阅读
约10分钟阅读
虎嗅
字号:
近一个月来,视频模型的赛道格外热闹。 一方面,各大厂商密集发布最新模型。7月31日,MiniMax H3和Seedance 2.5同日发布。前者支持15秒2K原生音视频和多模态统一输入;后者将单次生成提升至30秒,并强化多模态参考和时间戳编辑。 8月24日,阿里Wan 3.0结束公测并正式上线。截至8月27日,Wan 3.0位列Artificial Analysis有声文生视频和有声视频编辑双榜全球第一,最长支持30秒生成,并将文字、图片、视频、音频、文件和网页统一纳入视频创作流程。 可以看到,AI视频模型正迎来性能的井喷潮,升级方向也高度一致:视频更长、音画一体、参考素材更多、修改更加精准,生成结果越来越接近实拍质感。 这轮发布潮并非偶然。短剧、广告、教育和企业内容等市场正在形成稳定需求,视频模型也在时长、控制和一致性上集体提升。技术开始接住更复杂的任务,足够大的市场则容纳了更多技术路线和产品选择。 另一方面,优质模型的加速供给,也正在催化市场价格体系的趋同。 7月31日,MiniMax H3发布,768P分辨率每秒价格低于主流模型二分之一,0.5元/秒。之后,Wan 3.0公测,720P价格维持在上一版模型Wan2.7的水平——0.6元/秒,Seedance 2.0 fast价格限时折扣,也来到了0.6元/秒。 AI视频由此更大规模地进入生产流程,行业也需要一套不同于“Demo时代”的评价标准。以Wan 3.0为代表的模型涌现,似乎正逐渐成为AI视频领域新一条斩杀线,划出了一条“生产级基准线”,搅动行业格局的变化。 AI视频“一家独大”格局松动 AI视频行业长期处在供给决定需求的状态,导致价格很高。据说,有创作团队为了避开高峰,把白天的生成任务挪到深夜提交,工作时间开始围着模型的算力窗口调整。 这种情况如今有了很大改善,由少数供给决定市场规模的格局开始松动。优质模型第一次集中以更低价格争夺开发者、创作者平台和企业客户。 H3以最高2K、原生音频、开放权重路线 和较低成本进入市场;Wan 3.0正式上线当天,LibTV、Flova AI、TapNow、Poll o.ai等企业也同步公布接入或使用情况。市场欢迎的不只是一个新模型,更是同等能力区间内新增的选择。 优质供给的增加很快反馈在价格上: Wan 3.0将720P标准API价格定在0.6元/秒,H3也把不同分辨率下的调用成本压到主流模型的一半甚至三分之一。 与此同时,全球视频模型的能力格局也在变化。 在Artificial Analysis有声文生视频和视频编辑榜单前列,中国厂商推出的模型已经占据多数席位。国内模型的角色正从追赶者变成全球AI视频API市场的重要供给方。 (视频编辑排行榜,数据来源:Artificial Analysis,近一个月排名) (文生视频模型排行榜,数据来源:Artificial Analysis,近一个月排名) 这轮变化里,排在Artificial Analysis榜首的Wan 3.0具有一定的标志性。它把能力推到生产级,同时将720P API价格维持在上一版模型的水平,这让市场看到,优质AI视频不必继续与高价格、低供给绑定。 买方与供应商的关系也在重建。市场出现了WeToken这样的视频模型API聚合平台,他们处在基础模型厂商与内容团队之间,一头采购模型API,一头承接企业的创作任务,再根据场景、预算和服务情况调度模型。过去,客户围绕一个强势模型设计工作流;现在,多模型路由开始成为越来越多平台的基础能力。 这是因为对企业来说,多一个优质模型并不只是多一个选项。接入某款模型后,团队还要围绕它建立提示词、审核、后期和交付流程。一旦业务完全绑定于单一供应商,价格调整、接口排队或服务波动都会传导至整条生产线。 因此,市场天然需要多个头部模型相互补位,也需要更稳定的多模型供应体系。 Wan 3.0划出了一条怎样的“生产级基准线”? 如果说DeepSeek为文本大模型划出了一条性能与成本的“斩杀线”,Wan 3.0带给AI视频行业的,则是一把面向真实生产的标尺。一款模型能否进入企业工作流,至少要看四项指标:效果上限、结果稳定性、成片经济性和工程服务能力。 效果上限首先体现在真实感,这是最难、也最容易被感知的指标。最新的Seedance 2.5和Wan 3.0都将其作为本轮升级的重点。 WeToken技术负责人Lu Zhao认为,许多AI视频之所以一眼就能被识别,往往是因为人物过于“塑料”,微表情和动作不自然。视频越长、人物越多,需要模型持续维持的时空关系越复杂,真实感也越难保持。 所以,当模型精准还原真实世界后,市场感到欣慰。广州筷子信息科技有限公司CTO陈龙认为,Wan3.0让商品、人物保持稳定,口播自然,接近真实广告拍摄水平。“这意味着我们能帮客户更快、更高效地出爆款,加速商业价值的传播与转化。” 视频来源:三代科技 进入生产线,模型还要接受真实项目的检验。Lu Zhao的团队会用同一份Brief和参考图同时测试多个模型,比较第一次生成的可用程度、达到交付标准所需的轮次,以及客户修改、人力和时间成本。 在这套以交付为目标的测试中,不同模型已经呈现出各自的长项:复杂动作、大场面、打斗和特效镜头,Seedance整体表现更稳;人物对话、中近景特写和剧情推进等场景,团队会更多使用Wan 3.0,后者在角色一致性、人物表情和皮肤质感方面表现突出。按照镜头类型分配模型,已经开始进入实际生产流程。 到了生产流程,稳定则成为基本要求。稳定性可以拆成一组具体问题:人物跨镜头会不会漂移,人与道具的空间关系能否保持,30秒视频进入后半段是否崩坏,同一套提示词批量生成时能维持多高的成功率。比如,在短剧与影视业, 井英科技CTO王健提到, Wan 3.0成片细腻稳定、可用率高。巨日禄联合创始人斯宇认为,Wan3.0在视听质感与稳定性全面升级,这些稳定性指标,最终都指向了规模化生产。 视频来源:LibTV 规模化生产后,模型的稳定性直接关联成片的账本。一个单次价格较低、却要生成十次才能获得可用结果的模型,综合成本可能高于一个尝试三次便能完成任务的模型。 除了稳定,优质模型和创作者平台还在突出性价比。模型你追我赶,限时优惠不止一家,8月7日,Seedance 2.5 API上线后,Seedance 2.0 fast限时75折;8月24日,Wan 3.0正式上线后限时七折,在各大创作者平台,优惠力度还能更大。 性价比有了,规模化调用构成最后一道检验。阿里云官方文档显示,Wan 3.0 API目前覆盖华北、新加坡、日本、德国和美国等区域,各区域每分钟请求上限为300次。对于平台和企业,API吞吐、接入效率、服务稳定性和客户支持,同样会影响模型选型。 Wan 3.0划出的“生产级基准线”,由第一梯队的效果、稳定的出片率、可计算的成片成本和规模化服务能力共同构成。它让行业判断一款视频模型能否进入生产,有了一把更加具体的尺子。 AI视频跳出内容生产 第一梯队模型陆续增加以后,竞争激烈,但整体市场反而在扩大:优质模型的出现降低了调用成本和使用门槛,加速了行业应用的落地。 首先是海外市场正在不断扩大。据WeToken提供的数据,其ARR已经突破1亿元,
这篇文章对您有帮助吗?
订阅66必读
每日精选科技资讯,直达你的邮箱