在一个片段中讲更多故事
生成最长 30 秒的连续视频,让动作、镜头、对白和场景变化能够更自然地展开。
把提示词和参考素材转化成更长、更连贯的 AI 视频。Wan 3.0 支持最长 30 秒原生片段,并可使用文字、图片、视频、音频、网页和文档控制下一段视频的故事、画面、动作与声音。
把图片生成动态视频
上传目标帧以引导视频生成
描述越具体,生成效果通常越稳定。
生成数量
2-10 个批量生成仅会员可用。
示例画廊
看看 图生视频 可以创作什么
新一代多模态视频创作
Wan 3.0 是阿里巴巴面向专业创作流程推出的新一代 AI 视频模型,适合不满足于短循环画面的创作者。它把更长的原生视频、更丰富的参考输入、视觉连续性、自然多语言语音和细致场景控制整合到一个多模态工作流中。
生成最长 30 秒的连续视频,让动作、镜头、对白和场景变化能够更自然地展开。
结合文字、图片、视频、音频、网页、PDF 和演示文稿,为模型提供更明确的创意与信息背景。
通过参考素材控制人物外观、产品细节、声音、空间布局、界面、动作和视觉风格。
从单个创意发展到更长的参考驱动视频,无需把创作方向拆散到互不连接的工具中
在一次较长生成中完成产品展示、故事段落、教学片段或营销场景,减少拼接大量短片的需要。
选择最适合解释创意的素材,从视觉参考或音频,到网页、PDF 与演示文稿都可以提供背景。
Wan 3.0 旨在减少视觉漂移,让人物、产品、道具、布局和风格随着场景发展保持更稳定。
把音频加入创作说明,围绕自然多语言语音、声音连续性、环境氛围和情绪表达规划视频。
让视频长度与提示词内容相匹配,并在故事、动作或说明需要更多时间时继续延展优质结果。
通过三个清楚的步骤,从创作说明进入视频生成
根据已有素材和目标结果,选择文生视频、图生视频、参考视频生成或视频编辑。
描述主体、动作、镜头、光线、情绪和声音,再上传需要控制具体细节的图片、视频、音频或其他源素材。
检查当前模型、分辨率、画面比例、时长和积分预估,然后生成视频,并通过调整提示词或参考素材继续优化。
用更实用的方式开发需要时长、背景和一致性的视频概念
让开场、动作、转场和结尾有足够时间存在于同一个连贯片段中。
同时加入视觉、音频、文档和网页参考,无需在多个工具中重复重建同一套创意方向。
Wan 3.0 可利用参考背景,更准确地遵循产品外观、人物特征、空间关系、声音和风格。
修改提示词、替换参考素材或调整输出设置,从同一个创意探索新的营销、场景和格式版本。
为营销、故事、教育和产品沟通创作视频概念
把营销简报、品牌素材、产品图片和音频方向转化成长视频概念,用于新品发布、付费广告和社交活动。
让产品图片动起来、展示关键细节、构建生活方式场景,并在不为每个概念组织传统拍摄的情况下探索多种视觉方向。
使用 Wan 3.0 规划动作、镜头、表情、氛围和剧情发展更清楚的场景,适配横屏或竖屏内容。
把网页、文档或演示文稿中的信息转化成视觉说明,用于新员工培训、教程、产品教育和内部沟通。
围绕提示词、参考素材、画面连贯性与生成效果的实用解答
你可以从文字或图片开始生成视频,也可以加入图片和视频作为参考,编辑已上传片段,或继续延展现有视频。具体可用模式和参数以生成器控件为准。
先说明主体与场景,再补充动作、镜头运动、光线、色彩和节奏。需要连续叙事时,固定人物特征、服装、环境和镜头语言,通常比堆砌形容词更有效。
用清晰图片定义人物或视觉风格,用参考视频表达动作、节奏或运镜。素材之间保持主体和风格一致,并遵循上传区域显示的数量与格式限制。
在每次生成中重复核心人物特征、服装、场景、时间和色调,尽量复用同一组参考素材,并逐次只调整一个主要变量。
AI 视频生成带有随机性,参考素材质量、提示词清晰度、运动复杂度和所选参数都会影响结果。先生成简洁版本,再逐步增加镜头或动作细节,更容易找到稳定方向。