返回全部动态

阿里云栖大会发布全模态模型矩阵,陆川5天AI复原明代灾难现场

原标题:陆川手搓历史现场,王珞丹熬夜抽卡,阿里全模态开始兜底生产

量子位模型发布质量 55

AI 摘要

在2026云栖大会上,阿里云集中发布全模态模型矩阵,包括Qwen3.8-Max、Qwen3.8-Flash、Qwen3.8-Omni、Qwen-Image-3.1、Happy Shrimp 1.1、HappyOyster 2.0 Preview、Qwen-Audio-3.1、Qwen3.8-LiveTranslate等,并预告下一代视频模型将于11月发布。导演陆川团队用阿里视频生成模型5天完成400年前明代灾难现场短片,演员王珞丹分享AI创作中抽卡到凌晨的经历。阿里方面判断三年内将出现原生全模态统一生成模型,并提出Agentic Video方向,让AI从生成单个镜头走向理解完整叙事。

以上摘要由 AI 生成,可能存在误差。事实请以原文为准。

正文节选

陆川手搓历史现场,王珞丹熬夜抽卡,阿里全模态开始兜底生产 阿里:三年之内会出现一个原生的全模态统一生成模型,未来体验将不再受限于模态边界。 田晏林 发自 凹非寺 量子位 | 公众号 QbitAI 5天。 不用搭景,不用等演员,导演陆川和团队,直接用AI把一场发生在400年前的明代灾难现场,搓出来了! 宫廷、火药库,还有史料中烟云如黑灵芝的大爆炸。按照传统影视工业的做法,这样的场景复原往往需要数月时间和千万级投入。 但这次,他们只用了5天! 来,话不多说,先看短片。 怎么样?够猛吧? 人物的脸、皮肤、神态已经相当逼真,几个明代人物也不再是过去那种一眼AI的塑料感。 再看爆炸。烟尘、碎片、火光一起往外冲,这种最容易穿帮的复杂场面,也都稳稳接住了。 要按传统影视工业的路子来,过去光是一场爆炸戏,就要耗费19天。 这次,陆川团队把史料里的文字一点点翻译成现代视觉概念,前后大约做了四轮提示词优化,再参考真实爆炸影像去校准。 最后,阿里视频生成模型对烟尘、碎片这些复杂画面的还原,准确度已经达到团队预期的95%以上。 现在的AI已经进化到不只是给导演吐几段素材而已了。 从史料搜集、画面制作到主题讨论


发布时间:2026-09-22 23:59
抓取时间:2026-09-23 01:25
来源机构:量子位
阅读原文qbitai.com