# 即梦接口文档 ## 接口列表 ### /volcengine/jimeng/getDataByTask02 获取数据接口 - 请求参数 - taskId < string > 任务ID【选填】与workId二选一 - workId < string > ImagineWork数据id【选填】与taskId二选一 - routerName < string > 对应接口名称【必填】首次获取资源必填 - 可选:getClothesV2、getImgByImg、getImgV4、getText2ImgV3、getText2ImgV31、getImg2ImgV3、getImgV4_pod、getImgV4_goods、getInpaint、getSuperResolution、getVideoV3_720p、getVideoV3_1080p、getVideoV3_Pro、getActor、getActorV2 - logo_info < object > 水印信息【选填】 - add_logo:< Boolean > 是否添加水印【选填】 - 默认:False - position:< Int > 水印的位置【选填】 - 0-右下角 (默认) - 1-左下角 - 2-左上角 - 3-右上角 - language:< Int > 语言【选填】 - 0-中文(默认) - 1-英文 - opacity:< Float > 不透明度【选填】 - [0,1],1表示完全不透明,默认1 - logo_text_content:< String > 水印内容【选填】 - 响应示例 - 成功: - {"code": 200,"data": {tip:'生成成功',isFinish:true}} - 根据workId查询ImagineWork表的images或videos字段 - 失败:对应报错提示 ### /volcengine/jimeng/getClothesV2 图片换装V2 - 请求参数 - model < string > 模特图URL【必填】 - upper < string > 上装图URL【选填】与bottom至少提供一个 - bottom < string > 下装图URL【选填】与upper至少提供一个 - inference_config < object > 推理配置参数【选填】 - do_sr < boolean > 是否对结果进行超分处理【选填】默认false - seed < number > 随机种子参数【选填】默认-1 - keep_head < boolean > 是否保持模特原图的头【选填】默认true - keep_hand < boolean > 是否保持模特原图的手【选填】默认false - keep_foot < boolean > 是否保持模特原图的足【选填】默认false - num_steps < number > 模型推理步数【选填】默认16,范围[8,50] - keep_upper < boolean > 是否保持模特原图的上装【选填】默认false - keep_lower < boolean > 是否保持模特原图的下装【选填】默认false - tight_mask < string > 模特图遮挡区域范围【选填】默认"loose",支持["tight","loose","bbox"] - p_bbox_iou_ratio < number > 多人时bbox相交比例【选填】默认0.3,范围[0,1.0] - p_bbox_expand_ratio < number > bbox扩大比例【选填】默认1.1,范围[1.0,1.5] - max_process_side_length < number > 最大边长【选填】默认1920,范围[1080,4096] - 响应示例 - 成功: - {"code": 200, "data": {"workId": "ImagineWork表记录Id"}} - 失败:对应报错提示 ### /volcengine/jimeng/getImgByImg 图生图 - 请求参数 - image_urls < string > 图片url【选填二选一】 - binary_data_base64 < string > 图片base64【选填二选一】 - prompt < string > 图像的提示语【必填】 - scale < string > 文本描述影响程度【必填】范围[0.0,1.0],默认0.5 - width < string > 图像宽【选填】范围[512,2016],默认512 - height < string > 图像高【选填】范围[512,2016],默认512 ### /volcengine/jimeng/getImgV4 图片生成4.0 - 请求参数 - image_urls < array of string > 图片文件URL【选填】支持输入0至10张图 - prompt < string > 提示词【必填】 - sizeDate < object > 图片尺寸数据【选填】不传则使用上游默认 - 字段:size,width,height,min_ratio,max_ratio ``` 生成图片的面积,默认值:4194304,即2048*2048,生成2K分辨率图像; 取值范围:[1024*1024, 4096*4096],可生成1K到4K分辨率图像; 建议生成2k以上的图片,过小分辨率图片较大概率出现人脸效果不佳、文字异常等效果问题;若2K图片出图效果也不符合预期,可尝试输出更高分辨率图片 1、生成图像宽高,默认该字段不传; 2、宽高乘积在[1024*1024, 4096*4096],且宽高比在[min_ratio, max_ratio]之间 注意: 需同时传width和height才会生效 推荐可选的宽高: 1K 1024x1024 (1:1) 2K 2048x2048 (1:1) 2304x1728(4:3) 2496x1664 (3:2) 2560x1440 (16:9) 3024x1296 (21:9) 4K 4096x4096 (1:1) 4694x3520(4:3) 4992x3328 (3:2) 5404x3040 (16:9) 6198x2656 (21:9) ``` - scale < float > 文本影响程度【选填】范围[0,1],默认0.5 - force_single < float > 是否强制生成单图【选填】默认false - 响应示例 - 成功: - {"code": 200, "data": {"workId": "ImagineWork表记录Id"}} - 失败:对应报错提示 ### /volcengine/jimeng/getText2ImgV3 即梦文生图3.0 - 请求参数 - prompt < string > 提示词【必填】建议<=120字符,最长不超过800字符 - use_pre_llm < boolean > 是否开启文本扩写【选填】默认true - sizeDate < object > 图片尺寸数据【选填】默认{width:1328,height:1328} - width < number > 图片宽【选填】 - height < number > 图片高【选填】 ``` 约束:宽高比在1:3到3:1之间,宽高乘积在[512*512, 2048*2048]之间 推荐比例: 标清1K:1328*1328(1:1)、1472*1104(4:3)、1584*1056(3:2)、1664*936(16:9)、2016*864(21:9) 高清2K:2048*2048(1:1)、2304*1728(4:3)、2496*1664(3:2)、2560*1440(16:9)、3024*1296(21:9) ``` - 响应示例 - 成功: - {"code": 200, "data": {"workId": "ImagineWork表记录Id"}} - 失败:对应报错提示 ### /volcengine/jimeng/getText2ImgV31 即梦文生图3.1 - 请求参数 - prompt < string > 提示词【必填】建议<=120字符,最长不超过800字符 - use_pre_llm < boolean > 是否开启文本扩写【选填】默认true - sizeDate < object > 图片尺寸数据【选填】默认{width:1328,height:1328} - width < number > 图片宽【选填】 - height < number > 图片高【选填】 ``` 约束:宽高比在1:3到3:1之间,宽高乘积在[512*512, 2048*2048]之间 推荐比例: 标清1K:1328*1328(1:1)、1472*1104(4:3)、1584*1056(3:2)、1664*936(16:9)、2016*864(21:9) 高清2K:2048*2048(1:1)、2304*1728(4:3)、2496*1664(3:2)、2560*1440(16:9)、3024*1296(21:9) ``` - 响应示例 - 成功: - {"code": 200, "data": {"workId": "ImagineWork表记录Id"}} - 失败:对应报错提示 ### /volcengine/jimeng/getImg2ImgV3 即梦图生图3.0智能参考 - 请求参数 - image_url < string > 图片文件URL【必填】需输入1张图片 - prompt < string > 提示词【必填】建议<=120字符,最长不超过800字符 - scale < number > 文本描述影响程度【选填】范围[0,1],默认0.5 - sizeDate < object > 图片尺寸数据【选填】默认{width:1328,height:1328} - width < number > 图片宽【选填】 - height < number > 图片高【选填】 ``` 1、生成图像宽高,系统默认生成1328 * 1328的图像; 2、支持自定义生成图像宽高,宽高比在1:3到3:1之间,宽高乘积在[512*512, 2048*2048]之间;推荐可选的宽高比为: 标清1K 1328 * 1328(1:1) 1472 * 1104 (4:3) 1584 * 1056(3:2) 1664 * 936(16:9) 2016 * 864(21:9) 高清2K 2048 * 2048(1:1) 2304 * 1728 (4:3) 2496 * 1664(3:2) 2560 * 1440(16:9) 3024 * 1296(21:9) 注意: 需同时传width和height才会生效; ``` - 响应示例 - 成功: - {"code": 200, "data": {"workId": "ImagineWork表记录Id"}} - 失败:对应报错提示 ### /volcengine/jimeng/getImgV4_pod 图片生成4.0-素材提取(POD按需定制) - 请求参数 - image_url < string > 图片文件URL【必填】 - instruction < number > 编辑指令【选填】默认1,取值:1|2|3|4 - 1:提取图案:提取产品的图案,生成一张平面图展示其图案,去除产品本身。 - 2:提取包装:提取产品的包装图案,生成一张平面图展示其图案,去除产品本身。 - 3:提取logo:提取产品的logo,生成一张平面图展示其logo,去除产品本身。 - 4:提取纹理:提取产品的纹理,生成一张平面图平铺展示其纹理,去除产品本身。 - prompt < string > 提示词【选填】 - lora_weight < number > lora权重【选填】范围[0,1],默认1.000 - sizeDate < object > 图片尺寸数据【选填】默认{width:2048,height:2048} - width < number > 图片宽【选填】范围见下 - height < number > 图片高【选填】范围见下 - 固定搭配:(1024,1024)、(2048,2048)、(2304,1728)、(2496,1664)、(2560,1440)、(3024,1296)、(4096,4096)、(4694,3520)、(4992,3328)、(5404,3040)、(6198,2656) - 响应示例 - 成功: - {"code": 200, "data": {"workId": "ImagineWork表记录Id"}} - 失败:对应报错提示 ### /volcengine/jimeng/getImgV4_goods 图片生成4.0-商品提取 - 请求参数 - image_url < string > 图片文件URL【必填】 - instruction < number > 编辑指令【选填】默认1,取值1|2|3|4|5|6 - 1: '提取全身衣服:提取出图片中的衣服、帽子、鞋子和包,生成一张平铺图,背景为纯白色。' - 2: '提取鞋子:提取出图片中的一双鞋子,生成一张正45度图,背景为纯白色。' - 3: '提取包包:提取出图片中的完整的包包和包带,正视图,背景为纯白色。' - 4: '提取沙发:提取出图片中的完整的沙发,生成一张正视图,背景为纯白色。' - 5: '提取日用品:提取出图片中的日用品,生成一张正视图,背景为纯白色。' - 6: '提取饰品:提取出图片中的饰品,生成一张正视图,背景为纯白色。' - sizeDate < object > 图片尺寸数据【选填】默认{width:2048,height:2048} - width < number > 图片宽【选填】范围见下 - height < number > 图片高【选填】范围见下 - 固定搭配:(1024,1024)、(2048,2048)、(2304,1728)、(2496,1664)、(2560,1440)、(3024,1296)、(4096,4096)、(4694,3520)、(4992,3328)、(5404,3040)、(6198,2656) - prompt < string > 提示词【选填】 - 响应示例 - 成功: - {"code": 200, "data": {"workId": "ImagineWork表记录Id"}} - 失败:对应报错提示 ### /volcengine/jimeng/getInpaint 交互编辑(局部重绘/消除笔) - 请求参数 - image_urls < array > 图片文件URL【必填】需输入2张图片 - prompt < string > 提示词【必填】 - 消除场景输入“删除”,文字内容修改放在“”内提升准确率 - 响应示例 - 成功: - {"code": 200, "data": {"workId": "ImagineWork表记录Id"}} - 失败:对应报错提示 ### /volcengine/jimeng/getSuperResolution 智能超清 - 请求参数 - image_urls < array > 图片文件URL【必填】需输入1张图片 - resolution < string > 图片分辨率【选填】默认4k,取值'4k'|'8k' - scale < number > 细节生成程度【选填】默认50,范围[0,100] - 响应示例 - 成功: - {"code": 200, "data": {"workId": "ImagineWork表记录Id"}} - 失败:对应报错提示 ### /volcengine/jimeng/getVideoV3_720p 视频生成3.0(720p) - 请求参数 - prompt < string > 提示词【必填】 - frames < number > 帧数【选填】范围[121,241],默认121 - method < string > 生成方式【必填】取值 1|2|3|4 - 1:文生视频 - 2:图生视频-首帧 - 3:图生视频-首尾帧 - 4:图生视频-运镜 - config < object > 其他配置参数【选填】 - 1:文生视频 - prompt < string > 提示词【必填】建议<=400字 - 最长不超过800字,过长可能效果异常或不生效 - frames < int > 总帧数【选填】范围[121,241],默认121 - 帧数=24*n+1,支持5s、10s - aspect_ratio < string > 长宽比【选填】默认"16:9" - 取值:"16:9","4:3","1:1","3:4","9:16","21:9" - 2:图生视频-首帧 - prompt < string > 提示词【必填】建议<=400字 - 最长不超过800字,过长可能效果异常或不生效 - frames < int > 总帧数【选填】范围[121,241],默认121 - 帧数=24*n+1,支持5s、10s - image_urls < array of string > 图片文件URL【必填】仅支持1张 - 图片长边与短边比例在3以内 - 3:图生视频-首尾帧 - image_urls < array of string > 图片文件URL【必填】需输入2张 - 图片长边与短边比例在3以内 - 尾帧图片需与首帧图片比例相同 - prompt < string > 提示词【必填】建议<=400字 - 最长不超过800字,过长可能效果异常或不生效 - frames < int > 总帧数【选填】范围[121,241],默认121 - 帧数=24*n+1,支持5s、10s - 4:图生视频-运镜 - image_urls < array of string > 图片文件URL【必填】仅支持1张 - 图片长边与短边比例在3以内 - prompt < string > 提示词【必填】建议<=400字 - 最长不超过800字,过长可能效果异常或不生效 - template_id < string > 运镜模板ID【必填】 - hitchcock_dolly_in: 希区柯克推进 - hitchcock_dolly_out: 希区柯克拉远 - robo_arm: 机械臂 - dynamic_orbit: 动感环绕 - central_orbit: 中心环绕 - crane_push: 起重机 - quick_pull_back: 超级拉远 - counterclockwise_swivel: 逆时针回旋 - clockwise_swivel: 顺时针回旋 - handheld: 手持运镜 - rapid_push_pull: 快速推拉 - camera_strength < string > 强度【必填】 - weak: 弱 - medium: 中 - strong: 强 - frames < int > 总帧数【选填】范围[121,241],默认121 - 帧数=24*n+1,支持5s、10s - 响应示例 - 成功: - {"code": 200, "data": {"workId": "ImagineWork表记录Id"}} - 失败:对应报错提示 ### /volcengine/jimeng/getVideoV3_1080p 视频生成3.0(1080p) - 请求参数 - prompt < string > 提示词【必填】 - frames < number > 帧数【选填】范围[121,241],默认121 - method < string > 生成方式【必填】取值 1|2|3 - 1:文生视频 - 2:图生视频-首帧 - 3:图生视频-首尾帧 - config < object > 其他配置参数【选填】 - 1:文生视频 - prompt < string > 提示词【必填】建议<=400字 - 最长不超过800字,过长可能效果异常或不生效 - frames < int > 总帧数【选填】范围[121,241],默认121 - 帧数=24*n+1,支持5s、10s - aspect_ratio < string > 长宽比【选填】默认"16:9" - 取值:"16:9","4:3","1:1","3:4","9:16","21:9" - 2:图生视频-首帧 - prompt < string > 提示词【必填】建议<=400字 - 最长不超过800字,过长可能效果异常或不生效 - frames < int > 总帧数【选填】范围[121,241],默认121 - 帧数=24*n+1,支持5s、10s - image_urls < array of string > 图片文件URL【必填】仅支持1张 - 图片长边与短边比例在3以内 - 3:图生视频-首尾帧 - prompt < string > 提示词【必填】建议<=400字 - 最长不超过800字,过长可能效果异常或不生效 - frames < int > 总帧数【选填】范围[121,241],默认121 - 帧数=24*n+1,支持5s、10s - image_urls < array of string > 图片文件URL【必填】需输入2张 - 图片长边与短边比例在3以内 - 尾帧图片需与首帧图片比例相同 - 响应示例 - 成功: - {"code": 200, "data": {"workId": "ImagineWork表记录Id"}} - 失败:对应报错提示 ### /volcengine/jimeng/getVideoV3_Pro 即梦视频生成3.0Pro - 请求参数 - prompt < string > 提示词【选填】文生视频必填 - 图生视频可不传 - image_url < string > 首帧图片URL【选填】图生视频必填 - image_urls < array | string > 首帧图片URL【选填】允许传数组或单值 - frames < number > 帧数【选填】范围[121,241],默认121 - aspect_ratio < number > 比例编号【选填】取值1|2|3|4|5|6 - 123456分别对应:16:9、4:3、1:1、3:4、9:16、21:9 - 响应示例 - 成功: - {"code": 200, "data": {"workId": "ImagineWork表记录Id"}} - 失败:对应报错提示 ### /volcengine/jimeng/getActor 动作模仿 - 请求参数 - video_url < string > 视频url【必填】 - image_url < string > 图片url【必填】 - 响应示例 - 成功: - {"code": 200, "data": {"workId": "ImagineWork表记录Id"}} - 失败:对应报错提示 ### /volcengine/jimeng/getActorV2 动作模仿2.0 - 请求参数 - image_url < string > 图片url【必填】 - video_url < string > 视频url【必填】 - cut_result_first_second_switch < boolean > 是否裁剪结果视频第1秒【选填】默认true - callback_url < string > 回调接口URL【选填】 - 响应示例 - 成功: - {"code": 200, "data": {"workId": "ImagineWork表记录Id"}} - 失败:对应报错提示 ### /volcengine/jimeng/getOhIdentifyMain 数字人v1.5 步骤1:主体识别 - 请求参数 - image_url < string > 图片url【必填】 - 响应示例 - 成功: - {"code": 200, "data": {"workId": "ImagineWork表记录Id"}} - 失败:对应报错提示 ### /volcengine/jimeng/getOhDateByTask 数字人查询任务(步骤1/步骤3) - 请求参数 - taskId < string > 任务id【选填】与workId二选一 - workId < string > 作品id【选填】与taskId二选一 - routerName < string > 查询接口名称【必填】 - 取值:getOhIdentifyMain 或 getOmniHuman - logo_info < object > 水印信息【选填】 - 仅 routerName=getOmniHuman 时生效 - 响应示例 - 成功: - 主体识别:{"code": 200, "data": {"tip": "存在主体"|"不存在主体"|"生成中,请等待...", "isContinue": true|false, "isFinish": false}} - 数字人生成:{"code": 200, "data": {"tip": "生成成功"|状态文案, "isFinish": true|false}} - 失败:对应报错提示 ### /volcengine/jimeng/getOhDetectMain 数字人v1.5 步骤2:主体检测 - 请求参数 - taskId < string > 任务id【选填】与workId二选一 - workId < string > 作品id【选填】与taskId二选一 - 响应示例 - 成功: - {"code": 200, "data": {"tip": "生成成功", "isContinue": true, "isFinish": false}} - 失败:对应报错提示或失败状态 ### /volcengine/jimeng/getOmniHuman 数字人v1.5 步骤3:视频生成 - 请求参数 - taskId < string > 任务id【选填】与workId二选一 - workId < string > 作品id【选填】与taskId二选一 - audio_url < string > 音频url【必填】 - prompt < string > 提示词【选填】 - pe_fast_mode < boolean > 数字人快速模式【选填】默认false - mask_url < array > 掩码图URL列表【选填】 - 优先使用此参数,否则使用步骤2生成的掩码 - 响应示例 - 成功: - {"code": 200, "data": {"tip": "生成成功", "isContinue": true, "isFinish": false}} - 失败:对应报错提示 ## 接口列表-注意事项 - 所有接口请求body内必传token参数 < string > 【必填】 - 示例:token: `Bearer r:f0333969e312a40e4703e8fxxxxxxxxx` - 生成作品后自动扣费, ImagineWork 表 usage 字段记录了扣费详情 ## 请求示例: - /test/testImg.js ## 前端调用流程 - 正常接口 - 步骤1:提交任务 - 本地测试:调用 http://127.0.0.1:7337/api/volcengine/jimeng/相应接口名称 - 生产环境:调用 https://server.fmode.cn/api/volcengine/jimeng/相应接口名称 - 步骤2:获取作品 - 调用 getDataByTask02 接口,轮询查询任务状态,直到任务完成。 - 步骤3:获取作品生成结果 - 查询 ImagineWork 表, objectId 为步骤1的 workId - videos: < array< string > > 视频URL列表 - 示例:["https://example.com/video1.mp4", "https://example.com/video2.mp4"] - videos里面的url已转存,永久有效 - images: < array< string > > 图片URL列表 - 示例:["https://example.com/image1.png", "https://example.com/image2.png"] - images里面的url已转存,永久有效 - 数字人接口 - 步骤1:提交主体识别任务 - 调用 getOhIdentifyMain 接口 - 步骤1.1:获取主体识别结果 - 调用 getOhDateByTask 接口, routerName = 'getOhIdentifyMain' ,轮询查询任务状态,直到任务完成。 - 步骤2:主体检测任务 - 调用 getOhDetectMain 接口 - 此 步骤2、 步骤2.1 、 步骤2.2 可跳过,直接进行步骤3 - 步骤2.1:获取主体检测结果 - 查询 ImagineWork 表, objectId 为步骤1的 workId ,获取 maskUrls 字段 - maskUrls < array< string > > 掩码图URL列表 - 示例:["https://example.com/mask1.png", "https://example.com/mask2.png"] - maskUrls图片未转存,有效期仅1h - 步骤2.2:前端选择主体 - 前端根据 maskUrls 图片,展示主体检测结果,用户可选择其中一个主体。 - 在步骤3的 mask_url 参数中,传入用户选择的主体对应的mask图url。 - 步骤3:提交视频生成任务 - 调用 getOmniHuman 接口 - 步骤3.1:获取视频生成结果 - 调用 getOhDateByTask 接口, routerName = 'getOmniHuman' ,轮询查询任务状态,直到任务完成。 - 步骤4:获取视频生成结果 - 查询 ImagineWork 表, objectId 为步骤1的 workId - videos: < array< string > > 视频URL列表 - 示例:["https://example.com/video1.mp4", "https://example.com/video2.mp4"] - videos里面的url已转存,永久有效 ## 接口介绍 ### /volcengine/jimeng/getImgV4 图片生成4.0 - 简介 图片生成4.0:即梦4.0是即梦同源的图像生成能力,该能力在统一框架内集成了文生图、图像编辑及多图组合生成的功能:支持单次输入最多 10 张图像及进行复合编辑,并能通过对提示词的深度推理,自动适配最优的图像比例尺寸与生成数量,可一次性输出最多 15 张内容关联的图像。此外,模型显著提升了中文生成的准确率与内容多样性,且支持 4K 超高清输出,为专业图像创作提供了从生成到编辑的一站式解决方案。 - 费用 图片生成v4 0.22元/张 https://www.volcengine.com/docs/85621/1544714 ### /volcengine/jimeng/getText2ImgV3 即梦文生图3.0 - 简介 即梦文生图3.0:文生图3.0是即梦同源的文生图能力,在文字响应准确度、图文排版、层次美感和语义理解能力上相较之前版本均有显著提升,人像质感更逼真,且支持输出高清大图。此外,在文字响应更精准的基础下,还支持响应大小字、各类艺术字体和不同字重。 - 费用 即梦文生图3.0 每次调用费用为0.2元 ### /volcengine/jimeng/getText2ImgV31 即梦文生图3.1 - 简介 即梦文生图3.1:文生图3.1是与即梦同源的文生图能力,该版本重点实现画面效果呈现升级,在画面美感塑造、风格精准多样及画面细节丰富度方面提升显著,同时兼具文字响应效果。 - 费用 即梦文生图3.1 每次调用费用为0.2元 ### /volcengine/jimeng/getImg2ImgV3 即梦图生图3.0智能参考 - 简介 即梦图生图3.0智能参考:图生图3.0智能参考是即梦同源的图生图能力,支持基于文本指令进行图像编辑。该能力在精准执行编辑指令和保持图像内容完整性(如人物特征及精细细节)方面实现显著提升,尤其在处理真实图像和海报图文设计场景表现卓越。推荐在海报等设计等场景中,在文本指令中加入「海报」「平面设计」等词,并用引号标出期望文字时,可显著提升文字响应效果,产出高质量编辑结果,有效满足用户改图需求。 - 费用 即梦即梦图生图v3.0 每次调用费用为0.2元 ### /volcengine/jimeng/getImgV4_pod 图片生成4.0-素材提取(POD按需定制) - 简介 图片生成4.0-素材提取(POD按需定制):通过智能图案提取技术,从实物商品中精准提取并矢量化核心图案,生成平面设计图,提升电商领域中商品打版和产品设计等场景的制作效率。 - 费用 图片生成v4 POD素材提取 0.22元/张 https://www.volcengine.com/docs/85621/1544714 ### /volcengine/jimeng/getImgV4_goods 图片生成4.0-商品提取 - 简介 图片生成4.0-商品提取:采用智能视觉技术,提取商品主体并智能匹配最佳展示视角,一键生成专业商品展示图。现已支持服装、鞋包、饰品、家具、日用品几大核心品类,助力高效产出高品质商品视觉素材,有效提升视觉吸引力与转化效率。 - 费用 图片生成v4 商品提取 0.22元/张 https://www.volcengine.com/docs/85621/1544714 ### /volcengine/jimeng/getInpaint 交互编辑(局部重绘/消除笔) - 简介 交互编辑(局部重绘/消除笔): 即梦「局部重绘」「消除笔」同款图像编辑功能:用户可通过涂抹、选区等方式建立重绘区域,将相应mask图及文本prompt传入模型,即可重新编辑生成图片。 本能力支持涂抹消除,和涂抹编辑场景,在消除的场景,输入prompt文本为删除即可;在涂抹编辑场景,可以用自然语言描述预期生成的内容,涉及文字内容的修改建议讲修改后的文字放在“”双引号内,会提升准确率 - 费用 交互编辑 每次调用费用为0.2元 https://www.volcengine.com/docs/86081/1660170 ### /volcengine/jimeng/getSuperResolution 智能超清 - 简介 智能超清:即梦「智能超清」同款图像编辑功能:基于seedream基模,针对AIGC生成类场景和低质量图像,尝试在保证【全局结构、语义一致性】的前提下,适当放开一致性,允许生成更多的细节内容,全面提升画面质感,当前支持将图像超清到4K/8K。 - 费用 智能超清 每次调用费用为0.4元 https://www.volcengine.com/docs/86081/1660170 ### /volcengine/jimeng/getVideoV3_720p 视频生成3.0(720p) - 简介 视频生成3.0(720p): 即梦视频3.0 —— 即梦同源的文生视频能力,专业级视频生成引擎,释放无限创意。准确遵循复杂指令,视觉表达流畅一致,可驾驭多元艺术风格,在视频生成质量出色的基础上,是生成效果与速度兼备的高性价比之选。 即梦视频3.0 720P支持: 文生视频:输入文本提示词,生成视频 图生视频 - 首帧:输入首帧图片和文本提示词,生成视频 图生视频 - 首尾帧:输入首帧图片、尾帧图片和文本提示词,生成视频 图生视频 - 运镜:输入首帧图片和文本提示词,调节运镜类型和幅度参数,生成运镜视频 - 费用 0.28 元/秒 ### /volcengine/jimeng/getVideoV3_1080p 视频生成3.0(1080p) - 简介 视频生成3.0(1080p): 即梦视频3.0 —— 即梦同源的文生视频能力,专业级视频生成引擎,释放无限创意。准确遵循复杂指令,视觉表达流畅一致,支持最高1080P高清渲染,更可驾驭多元艺术风格,在视频生成质量出色的基础上,是生成效果与速度兼备的高性价比之选。 即梦视频3.0 1080P支持: 文生视频:输入文本提示词,生成视频 图生视频 - 首帧:输入首帧图片和文本提示词,生成视频 图生视频 - 首尾帧:输入首帧图片、尾帧图片和文本提示词,生成视频 - 费用 0.63 元/秒 https://www.volcengine.com/docs/85621/1544715?lang=zh ### /volcengine/jimeng/getVideoV3_Pro 即梦视频生成3.0Pro - 简介 即梦视频生成3.0Pro: 即梦视频3.0Pro —— 即梦同源的文生视频与图生视频能力,在视频生成效果上实现飞跃,各维度均表现优异。该版本具备多镜头叙事能力,能更精准遵循指令,动态表现流畅自然,支持生成1080P高清且具专业级质感的视频,还可实现更丰富多元的风格化表达。 即梦视频3.0Pro支持功能含: 文生视频:输入文本提示词,生成视频; 图生视频-首帧:输入首帧图片和对应的文本提示词,生成视频。 - 费用 即梦视频生成3.0Pro 1 元/秒 ### /volcengine/jimeng/getActor 动作模仿 - 简介 动作模仿: 动作模仿 —— 即梦同源的视频动作模仿(生动模式),输入一张图片和一段模版视频,可以将图片中的人物按照模版视频的动作/表情/口型驱动起来,主体及背景特征与输入图片保持一致。 相较于前一代模型,它具有更稳定、更逼真的效果,突破竖屏画幅限制,各种画幅、比例视频均能高度还原,支持多种风格角色,具备一定的运镜还原能力。 - 费用 动作模仿1.0 0.5元/秒 https://www.volcengine.com/docs/85621/1544715?lang=zh ### /volcengine/jimeng/getActorV2 动作模仿2.0 - 简介 动作模仿2.0: 动作模仿2.0 —— 新一代视频动作模仿大模型,输入一张图片和一段模版视频,可以将图片中的人物按照模版视频的动作/表情/口型驱动起来,主体及背景特征与输入图片保持一致。 相较于前一代模型,2.0支持了多人驱动,能够更好地保持图片画幅、原始姿态、特征等信息,具有更好的视觉表现,同时2.0也首次支持了非真人驱动视频。整体效果更好,适用场景更多。 - 费用 动作模仿2.0 0.4元/秒 https://www.volcengine.com/docs/85621/2205633?lang=zh ### /volcengine/jimeng/getOhIdentifyMain 数字人v1.5 步骤1:主体识别 - 简介 数字人v1.5 步骤1:主体识别:用于识别图片中是否包含人、类人、拟人等主体。 ### /volcengine/jimeng/getOhDetectMain 数字人v1.5 步骤2:主体检测 - 简介 数字人v1.5 步骤2:主体检测:检测图片中的主体,并支持返回主体对应的mask图。如果在视频生成时不需要指定主体说话,可以跳过该步骤。 ### /volcengine/jimeng/getOmniHuman 数字人v1.5 步骤3:视频生成 - 简介 数字人v1.5 步骤3:视频生成: OmniHuman1.5(即梦同源数字人模型),该模型可根据用户上传的单张图片+音频,生成与图片对应的视频效果。支持输入任意画幅包含人物或其他主体(宠物、动漫等)的图片,结合音频,生成高质量的视频。人物的情绪、动作与音频具有强关联性,支持通过提示词(prompt)对画面、动作、运镜进行调整。同时OmniHuman1.5对动漫、宠物等形象支持较好,允许指定讲话人/主体,可广泛应用于内容表达、唱歌和表演等场景。相较于上一代模型,OmniHuman1.5 在运动自然度和结构稳定性提升明显,在人物/主体的运动表现力和画面质量上更优。可以广泛应用于制作剧情对话、多人对话/对唱、商品交互、漫剧等内容。对比其他视频通用模型,OmniHuman 数字人大模型在人物/主体的剧情演绎效果上极具优势。 - 费用 数字人v1.5 1元/秒 https://www.volcengine.com/docs/85621/1834143?lang=zh