《HappyHorse 1.1:更强动态表现力、更高生成一致性、更优视觉质感》
《HappyHorse 1.0 创作指南》
《在「短剧Lab」上使用万相2.7》
《万相使用指南》
视频生成,更可控、更全能的视频创作大模型。更多元的可控生成方式、更精准的叙事和表演响应、模型基础能力全面升级,带来覆盖创作全链路、真正能导擅演的视频创作套件。

多模态输入可控创作,WAN2.7模型支持以文本、图像、视频、音频四种模态输入作为控制条件,从剧情、风格、表演、形象、声音等视频内容全维度进行精准控制,辅助创作者实现不同创意的组合调度。
——现已支持九宫格图生视频,请使用多参生视频的模式生成。
详情请参考:《在「短剧Lab」上使用万相2.7》
支持通过主体或资产的方式添加参考图(含本地上传),万相2.7模型支持上传参考视频、音频。
主体适用于多故事板创作,需要保持人物/场景一致性的场景;资产适用于创作与生产过程中可被保存、复用、引用和管理的内容。
| 模型 | 参考图支持的最大张数 |
|---|---|
| HappyHorse 1.0 | 9张 |
| 万相 2.7 | 5张 |
| 万相 2.6-flash | 5张 |
撰写用以生成视频的提示词,上传参考图后可通过”@“键来指定AI的参考图,使AI对多个参考图的区分和描述理解更加清晰。
可选择声音配置、编解码、提示词扩写、反向提示词、分辨率、比例、时长、生成数量等详细参数,选择后提交生成任务等待生成结果。
| 参数 | 详解 |
|---|---|
| 声音配置 | 支持声音关闭,自动配音;对生成视频声音有要求,想立即生成的可使用自动配音方式,模型会根据生成的视频自动配音。 |
| 编解码 | 支持视频数据的压缩存储与还原播放的技术标准。支持H264、H265、H265Pro |
| 提示词扩写 | 对撰写的提示词进行理解并扩写 |
| 反向提示词 | 在反向提示词框中编写的提示词,生视频模型执行任务时会严禁生成这些内容 |
| 提示词辅助 | 对于不熟悉提示词写法的用户,可使用系统提供的推荐标签进行组合参考,标签覆盖:景别、视角、构图、光线、镜头特效、运镜、视觉风格、氛围/情绪等维度。提示词的丰富程度决定了最终生成视频的效果好坏 |
| 智能多分镜 | 开启智能多分镜功能后,AI会识别创意描述中输入文字描述词,对视频的运镜,镜头做出切换 |
| 分辨率 | 设置生成视频的清晰度,支持720P、1080P、1080特惠版(HappyHorse)、2K、4K |
| 比例 | 支持常见的16:9、4:3、9:16、3:4视频比例 |
| 时长 | 当前模型支持的生成时长,各个模型参数不一,已实际显示界面为准 |
| 生成数量 | 生成结果的数量,可设置1~4张 |


通过文本描述生成视频。创作者只需输入文字提示词,描述期望的画面内容、风格和动态效果,即可生成对应的视频片段。适用于从零开始构思创意、快速验证想法等场景。
撰写用以生成视频的提示词。生成效果大幅受文字描述词影响,可反复根据结果调整文字描述词,实现优化视频的效果。
可选择声音配置、编解码、提示词扩写、反向提示词、分辨率、比例、时长、生成数量等详细参数,选择后提交生成任务等待生成结果。

以一张静态图片作为参考输入,生成与图片内容风格一致的动态视频。适用于将静态设计稿、插画、摄影作品等赋予动态效果的场景。
支持通过主体或资产的方式添加参考图(含本地上传),图生视频为I2V模型,仅支持单图参考,多图请使用多参生视频。
通过上传首帧素材以及创意描述的方式生成对应视频,部分模型支持上传尾帧素材。首帧素材对视频生成的效果影响较大,支持本地上传与从资产库中选择。
支持png/jpg/bmp/jpeg/webp格式,文件大小不超过10MB。
撰写用以生成视频的提示词。生成效果大幅受文字描述词以及原图清晰度影响,可反复根据结果调整文字描述词,实现优化视频的效果。
可选择声音配置、编解码、提示词扩写、反向提示词、分辨率、比例、时长、生成数量等详细参数,选择后提交生成任务等待生成结果。

支持对已有视频进行智能编辑,无需从零生成,在原片基础上实现精准修改。支持上传参考图进行视频编辑。输入最长5分钟视频,可修改其中2-8秒局部片段。
详情请参考:《在「短剧Lab」上使用万相2.7》
支持通过资产的方式添加参考视频和参考图(含本地上传,最多支持1个视频与多张参考图片,已各个模型实际支持数量为准),输入最长5分钟视频,可修改其中2-8秒局部片段。
撰写用以修改视频的提示词。生成效果大幅受文字描述词以及原视频影响,可反复根据结果调整文字描述词,实现优化视频的效果。
可选择声音配置、编解码、提示词扩写、反向提示词、分辨率、比例、时长、生成数量等详细参数,选择后提交生成任务等待生成结果。

生成具备影院级光影、色彩与细节表现或独特风格的图片。图片生成能力支持文生图、图生图与 AI 溶图三项生成方式。

支持通过自然语言描述直接生成视频画面。无需预设素材,即可将文字创意快速转化为动态视觉内容。适用于创意启发、概念设计及无素材基础的冷启动创作场景。
撰写用以生成图片的提示词。生成效果大幅受文字描述词影响,可反复根据结果调整文字描述词,实现优化图片的效果。
可选择反向提示词、分辨率、比例、生成数量等详细参数,选择后提交生成任务等待生成结果。

支持以单张图片作为视觉基准,引导生成高度相关的视频内容。通过提取原图的构图、色彩和角色信息,实现从静态图向动态效果的精准转化。适用于对画面可控性要求较高、需保持视觉风格连贯或进行动作延展的场景。
支持通过主体或资产的方式添加参考图(含本地上传),支持多图参考。
支持png/jpg/bmp/jpeg/webp格式,文件大小不超过10MB。
撰写用以生成图片的提示词。生成效果大幅受文字描述词以及原图清晰度影响,可反复根据结果调整文字描述词,实现优化图片的效果。
可选择反向提示词、分辨率、比例、生成数量等详细参数,选择后提交生产任务等待生成结果。

支持将多张图像或特定视觉元素进行智能融合。AI自动统一不同素材间的光影、色调、透视与边缘细节,实现自然无缝的视觉合成效果。适用于将特定角色/物体精准植入新背景、多素材拼接创作以及需要消除素材违和感的复杂合成场景。
支持通过主体或资产的方式添加参考图(含本地上传),支持多图参考与超级编辑器。
支持png/jpg/bmp/jpeg/webp格式,文件大小不超过10MB。
撰写用以生成图片的提示词,对添加的参考图做出溶图需求的描述。生成效果大幅受文字描述词以及原图清晰度影响,可反复根据结果调整文字描述词,实现优化图片的效果。
可选择指定占位、分辨率、比例、生成数量等详细参数,选择后提交生成任务等待生成结果。

支持超级编辑器:可对上传的角色/场景/其他图片进行编辑,支持裁剪、绘制、自由视角、画质提升。
裁剪:对上传的图片进行裁切。
绘制:包含画笔、矩形、圆形、橡皮擦功能;支持调节画笔与橡皮擦大小程度,当前可选择五种颜色。
自由视角:改变图片的视角,支持调整左右、俯仰、前后三个参数。
画质提示:提升图片的画质,使场景/人物等更加细致。
灯光:支持对图片进行多角度打光,可自定义灯光颜色、灯光角度、灯光强度,提升图片的视觉质量和光影结构。
在创意描述中输入文字描述词,即想要生成的内容,生成效果大幅受文字描述词影响,可反复根据结果调整文字描述词,实现优化视频的效果。
用户在创作过程中,可以通过简单的绘制,通过提示词描述,让AI快速的进行图片优化。
| 描述词 | 输入图 | 输出图 |
|---|---|---|
| 蓝色矩形处,生成一只正在面向镜头的柴犬 | ![]() | ![]() |
| 将红色线条替换成白色气流 | ![]() | ![]() |
| 将图中红色线条的火柴人替换为 穿着华丽的 正在舞台中间翩翩起舞的 舞女 | ![]() | ![]() |
开启指定站位功能后,用户可以进入到如图所示编辑界面,角色会变成纯色方块,可随意更改大小并在场景中拖拽,编辑好位置后输入站位提示词(重要)。让模型更好的溶图。
站位描述词为必填项,尽量描述清晰,如角色的位置,做出的某个动作等,描述的越详细,溶图效果越好。
开启指定站位功能需设置场景,以及至少一张角色或其他图片;开启后,在编辑状态下无法更改场景和角色,需要关闭编辑页面再进行更改。
| 输出结果 | 提示词 |
|---|---|
![]() | 角色1:坐在沙发上,看向电视的方向 角色2:背对镜头,摆出跳舞的姿势![]() |
![]() | 角色1:红衣服角色站在地面,身体朝向右侧,眼神看向右侧,摆出出拳的姿势 角色2:绿衣服角色朝向左侧,同时眼睛看向左侧,抬腿做出踢腿的姿势![]() |
指定站位新增火柴人参考功能,可在众多火柴人姿势中选择并指定角色的姿势/动作。选择后角色会按指定的姿势和场景进行溶图。

描述词和其他选项确认后选择图片的规格,如:分辨率、比例等,点击生成图片,即刻开始生成图片。

溶图后进行图生视频是减少抽卡次数,提升精准度及清晰度的重要手段,例如通过融图增加特效,通过融图做尾帧,通过融图增加画面内容。
人物/角色在场景中,拿着具体什么物品做什么动作,或描述物品/效果出现的位置。
一个人物:人物/角色在场景中所处相对位置,表达的情绪/表情活动是怎样的,在做什么动作,额外可对场景增加提示词描述改变场景状态,如景别、视角、构图、镜头类型、光线、风格等维度。
两个人物:描述两个人物在场景中所处的相对位置,在场景中做什么互动。
规避涉政、涉军、疑似相似政治人物、残疾人歧视的提示词和图片元素。
规避暴力、血腥、爆炸、毒品、虐待、恐怖主义相关提示词和图片元素。
规避涉黄、裸露、未成年性暗示的提示词和图片元素。
规避商标、品牌标志、知名动漫IP、他人知识版权形象的提示词和图片元素。
规避在世的艺术家如宫崎骏、新海诚的提示词,可改为吉卜力、明亮的现代日式动漫风格等非敏感词。