218 lines
6.6 KiB
JSON
218 lines
6.6 KiB
JSON
{
|
||
"model": "wan2.6-r2v-flash",
|
||
"input": {
|
||
"prompt": "Character2 坐在靠窗的椅子上,手持 character3,在 character4 旁演奏一首舒缓的美国乡村民谣。Character1 对Character2开口说道:“听起来不错”",
|
||
"negative_prompt": "",
|
||
"reference_urls": [
|
||
"https://help-static-aliyun-doc.aliyuncs.com/file-manage-files/zh-CN/20260129/hfugmr/wan-r2v-role1.mp4",
|
||
"https://help-static-aliyun-doc.aliyuncs.com/file-manage-files/zh-CN/20260129/qigswt/wan-r2v-role2.mp4",
|
||
"https://help-static-aliyun-doc.aliyuncs.com/file-manage-files/zh-CN/20260129/qpzxps/wan-r2v-object4.png",
|
||
"https://help-static-aliyun-doc.aliyuncs.com/file-manage-files/zh-CN/20260129/wfjikw/wan-r2v-backgroud5.png"
|
||
]
|
||
},
|
||
"parameters": {
|
||
"size": "1280*720",
|
||
"duration": 10,
|
||
"audio": true,
|
||
"shot_type": "multi",
|
||
"watermark": true,
|
||
"seed": 2147483647
|
||
}
|
||
}
|
||
|
||
//model string (必选)
|
||
//
|
||
//模型名称。模型列表与价格详见模型价格。
|
||
//
|
||
//示例值:wan2.6-r2v-flash。
|
||
//
|
||
//input object (必选)
|
||
//
|
||
//输入的基本信息,如提示词等。
|
||
//
|
||
//属性
|
||
//
|
||
//prompt string (必选)
|
||
//
|
||
//文本提示词。用来描述生成视频中期望包含的元素和视觉特点。
|
||
//
|
||
//支持中英文,每个汉字、字母、标点占一个字符,超过部分会自动截断。
|
||
//
|
||
//wan2.6-r2v-flash:长度不超过1500个字符。
|
||
//
|
||
//wan2.6-r2v:长度不超过1500个字符。
|
||
//
|
||
//角色引用说明:通过“character1、character2”这类标识引用参考角色,每个参考(视频或图像)仅包含单一角色。模型仅通过此方式识别参考中的角色。
|
||
//
|
||
//示例值:character1在沙发上开心地看电影。
|
||
//
|
||
//提示词的使用技巧请参见文生视频/图生视频Prompt指南。
|
||
//
|
||
//negative_prompt string (可选)
|
||
//
|
||
//反向提示词,用来描述不希望在视频画面中出现的内容,可以对视频画面进行限制。
|
||
//
|
||
//支持中英文,长度不超过500个字符,超过部分会自动截断。
|
||
//
|
||
//示例值:低分辨率、错误、最差质量、低质量、残缺、多余的手指、比例不良等。
|
||
//
|
||
//reference_urls array[string] (必选)
|
||
//
|
||
//重要
|
||
//reference_urls直接影响费用,计费规则请参见计费与限流。
|
||
//
|
||
//上传的参考文件 URL 数组,支持传入视频和图像。用于提取角色形象与音色(如有),以生成符合参考特征的视频。
|
||
//
|
||
//每个 URL 可指向 一张图像 或 一段视频:
|
||
//
|
||
//图像数量:0~5。
|
||
//
|
||
//视频数量:0~3。
|
||
//
|
||
//总数限制:图像 + 视频 ≤ 5。
|
||
//
|
||
//传入多个参考文件时,按照数组顺序定义角色的顺序。即第 1 个 URL 对应 character1,第 2 个对应 character2,以此类推。
|
||
//
|
||
//每个参考文件仅包含一个主体角色。例如 character1 为小女孩,character2 为闹钟。
|
||
//
|
||
//支持输入的格式:
|
||
//
|
||
//公网URL:
|
||
//
|
||
//支持 HTTP 或 HTTPS 协议。
|
||
//
|
||
//示例值:https://cdn.translate.alibaba.com/xxx.png。
|
||
//
|
||
//临时URL:
|
||
//
|
||
//支持OSS协议,必须通过上传文件获取临时 URL。
|
||
//
|
||
//示例值:oss://dashscope-instant/xxx/xxx.png。
|
||
//
|
||
//参考视频要求:
|
||
//
|
||
//格式:MP4、MOV。
|
||
//
|
||
//时长:1s~30s。
|
||
//
|
||
//视频大小:不超过100MB。
|
||
//
|
||
//参考图像要求:
|
||
//
|
||
//格式:JPEG、JPG、PNG(不支持透明通道)、BMP、WEBP。
|
||
//
|
||
//分辨率:宽高均需在[240,8000]像素之间。
|
||
//
|
||
//图像大小:不超过20MB。
|
||
//
|
||
//示例值:["https://help-static-aliyun-doc.aliyuncs.com/file-manage-files/xxx.mp4", "https://help-static-aliyun-doc.aliyuncs.com/file-manage-files/xxx.jpg"]。
|
||
//
|
||
//已废弃字段
|
||
//
|
||
//parameters object (可选)
|
||
//
|
||
//图像处理参数。如设置视频分辨率、开启prompt智能改写、添加水印等。
|
||
//
|
||
//属性
|
||
//
|
||
//size string (可选)
|
||
//
|
||
//重要
|
||
//size直接影响费用,费用 = 单价(基于分辨率)× 时长(秒)。同一模型:1080P > 720P ,请在调用前确认模型价格。
|
||
//
|
||
//size必须设置为具体数值(如 1280*720),而不是 1:1或720P。
|
||
//
|
||
//指定生成的视频分辨率,格式为宽*高。该参数的默认值和可用枚举值依赖于 model 参数,规则如下:
|
||
//
|
||
//wan2.6-r2v-flash:默认值为 1920*1080(1080P)。可选分辨率:720P、1080P对应的所有分辨率。
|
||
//
|
||
//wan2.6-r2v:默认值为 1920*1080(1080P)。可选分辨率:720P、1080P对应的所有分辨率。
|
||
//
|
||
//720P档位:可选的视频分辨率及其对应的视频宽高比为:
|
||
//
|
||
//1280*720:16:9。
|
||
//
|
||
//720*1280:9:16。
|
||
//
|
||
//960*960:1:1。
|
||
//
|
||
//1088*832:4:3。
|
||
//
|
||
//832*1088:3:4。
|
||
//
|
||
//1080P档位:可选的视频分辨率及其对应的视频宽高比为:
|
||
//
|
||
//1920*1080: 16:9。
|
||
//
|
||
//1080*1920: 9:16。
|
||
//
|
||
//1440*1440: 1:1。
|
||
//
|
||
//1632*1248: 4:3。
|
||
//
|
||
//1248*1632: 3:4。
|
||
//
|
||
//duration integer (可选)
|
||
//
|
||
//重要
|
||
//duration直接影响费用。费用 = 单价(基于分辨率)× 时长(秒),请在调用前确认模型价格。
|
||
//
|
||
//生成视频的时长,单位为秒。
|
||
//
|
||
//wan2.6-r2v-flash:取值为[2, 10]之间的整数。默认值为5。
|
||
//
|
||
//wan2.6-r2v:取值为[2, 10]之间的整数。默认值为5。
|
||
//
|
||
//示例值:5。
|
||
//
|
||
//shot_type string (可选)
|
||
//
|
||
//指定生成视频的镜头类型,即视频是由一个连续镜头还是多个切换镜头组成。
|
||
//
|
||
//参数优先级:shot_type > prompt。例如,若 shot_type设置为"single",即使 prompt 中包含“生成多镜头视频”,模型仍会输出单镜头视频。
|
||
//
|
||
//可选值:
|
||
//
|
||
//single:默认值,输出单镜头视频
|
||
//
|
||
//multi:输出多镜头视频。
|
||
//
|
||
//示例值:single。
|
||
//
|
||
//说明
|
||
//当希望严格控制视频的叙事结构(如产品展示用单镜头、故事短片用多镜头),可通过此参数指定。
|
||
//
|
||
//audio boolean (可选)
|
||
//
|
||
//重要
|
||
//audio直接影响费用,有声视频与无声视频价格不同,请在调用前确认模型价格。
|
||
//
|
||
//支持模型:wan2.6-r2v-flash。
|
||
//
|
||
//是否生成有声视频。
|
||
//
|
||
//可选值:
|
||
//
|
||
//true:默认值,输出有声视频。
|
||
//
|
||
//false:输出无声视频。
|
||
//
|
||
//示例值:true。
|
||
//
|
||
//watermark boolean (可选)
|
||
//
|
||
//是否添加水印标识,水印位于视频右下角,文案固定为“AI生成”。
|
||
//
|
||
//false:默认值,不添加水印。
|
||
//
|
||
//true:添加水印。
|
||
//
|
||
//示例值:false。
|
||
//
|
||
//seed integer (可选)
|
||
//
|
||
//随机数种子,取值范围为[0, 2147483647]。
|
||
//
|
||
//未指定时,系统自动生成随机种子。若需提升生成结果的可复现性,建议固定seed值。
|
||
//
|
||
//请注意,由于模型生成具有概率性,即使使用相同 seed,也不能保证每次生成结果完全一致。 |