阿里发布Wan3.0视频生成模型,支持30秒多模态输入
原标题:Alibaba's Wan3.0 generates AI videos up to 30 seconds long from text, images, and documents
AI 摘要
阿里巴巴发布了视频生成模型 Wan3.0 的测试版,支持从文本、图片、PDF、网页和 PowerPoint 生成最长 30 秒的视频,长度是前代 Wan2.5 的两倍。该模型能同时处理文本、图像、视频和音频,并旨在减少 AI 生成视频中的视觉漂移和失真。Wan3.0 通过 wan.video 网站、阿里云 Model Studio 和 Qwen Cloud API 提供,分为标准版和 Prime 版,定价按分辨率计费。阿里巴巴计划将该模型用于电影制作、短视频创作、营销培训以及自动驾驶和机器人训练模拟,同时公司正加大 AI 投资,尽管近期利润下滑。
正文节选
Alibaba's Wan3.0 generates AI videos up to 30 seconds long from text, images, and documents Alibaba's video generation model Wan3.0 is now available in beta. It produces videos up to 30 seconds long and accepts text, PDFs, web pages, and PowerPoint files as input. That doubles the video length compared to its predecessor, Wan2.5. The model also recommends the best video length based on the user's prompt and includes an extension tool to make existing videos longer. Wan3.0 processes text, images,