gangvy 883f71c265 update 即梦功能 5 месяцев назад
..
README_v2.md 883f71c265 update 即梦功能 5 месяцев назад
testImg.js 883f71c265 update 即梦功能 5 месяцев назад

README_v2.md

即梦接口文档

接口列表

/volcengine/jimeng/getDataByTask02 获取数据接口

  • 请求参数
    • taskId < string > 任务ID【选填】与workId二选一
    • workId < string > ImagineWork数据id【选填】与taskId二选一
    • routerName < string > 对应接口名称【必填】首次获取资源必填
      • 可选:getClothesV2、getImgByImg、getImgV4、getText2ImgV3、getText2ImgV31、getImg2ImgV3、getImgV4_pod、getImgV4_goods、getInpaint、getSuperResolution、getVideoV3_720p、getVideoV3_1080p、getVideoV3_Pro、getActor、getActorV2
    • logo_info < object > 水印信息【选填】
      • add_logo:< Boolean > 是否添加水印【选填】
        • 默认:False
      • position:< Int > 水印的位置【选填】
        • 0-右下角 (默认)
        • 1-左下角
        • 2-左上角
        • 3-右上角
      • language:< Int > 语言【选填】
        • 0-中文(默认)
        • 1-英文
      • opacity:< Float > 不透明度【选填】
        • [0,1],1表示完全不透明,默认1
      • logo_text_content:< String > 水印内容【选填】
  • 响应示例

    • 成功:
      • {"code": 200,"data": {tip:'生成成功',isFinish:true}}
      • 根据workId查询ImagineWork表的images或videos字段
    • 失败:对应报错提示

      /volcengine/jimeng/getClothesV2 图片换装V2

  • 请求参数

    • model < string > 模特图URL【必填】
    • upper < string > 上装图URL【选填】与bottom至少提供一个
    • bottom < string > 下装图URL【选填】与upper至少提供一个
    • inference_config < object > 推理配置参数【选填】
      • do_sr < boolean > 是否对结果进行超分处理【选填】默认false
      • seed < number > 随机种子参数【选填】默认-1
      • keep_head < boolean > 是否保持模特原图的头【选填】默认true
      • keep_hand < boolean > 是否保持模特原图的手【选填】默认false
      • keep_foot < boolean > 是否保持模特原图的足【选填】默认false
      • num_steps < number > 模型推理步数【选填】默认16,范围[8,50]
      • keep_upper < boolean > 是否保持模特原图的上装【选填】默认false
      • keep_lower < boolean > 是否保持模特原图的下装【选填】默认false
      • tight_mask < string > 模特图遮挡区域范围【选填】默认"loose",支持["tight","loose","bbox"]
      • p_bbox_iou_ratio < number > 多人时bbox相交比例【选填】默认0.3,范围[0,1.0]
      • p_bbox_expand_ratio < number > bbox扩大比例【选填】默认1.1,范围[1.0,1.5]
      • max_process_side_length < number > 最大边长【选填】默认1920,范围[1080,4096]
  • 响应示例

    • 成功:

      • {"code": 200, "data": {"workId": "ImagineWork表记录Id"}}
      • 失败:对应报错提示

        /volcengine/jimeng/getImgByImg 图生图

  • 请求参数

    • image_urls < string > 图片url【选填二选一】
    • binary_data_base64 < string > 图片base64【选填二选一】
    • prompt < string > 图像的提示语【必填】
    • scale < string > 文本描述影响程度【必填】范围[0.0,1.0],默认0.5
    • width < string > 图像宽【选填】范围[512,2016],默认512
    • height < string > 图像高【选填】范围[512,2016],默认512

/volcengine/jimeng/getImgV4 图片生成4.0

  • 请求参数
    • image_urls < array of string > 图片文件URL【选填】支持输入0至10张图
    • prompt < string > 提示词【必填】
    • sizeDate < object > 图片尺寸数据【选填】不传则使用上游默认

      • 字段:size,width,height,min_ratio,max_ratio

        生成图片的面积,默认值:4194304,即2048*2048,生成2K分辨率图像;
        取值范围:[1024*1024, 4096*4096],可生成1K到4K分辨率图像;
        建议生成2k以上的图片,过小分辨率图片较大概率出现人脸效果不佳、文字异常等效果问题;若2K图片出图效果也不符合预期,可尝试输出更高分辨率图片
        1、生成图像宽高,默认该字段不传;
        2、宽高乘积在[1024*1024, 4096*4096],且宽高比在[min_ratio, max_ratio]之间
        注意:
        需同时传width和height才会生效
        推荐可选的宽高:
        1K
        1024x1024 (1:1)
        2K
        2048x2048 (1:1)
        2304x1728(4:3)
        2496x1664 (3:2)
        2560x1440 (16:9)
        3024x1296 (21:9)
        4K
        4096x4096 (1:1)
        4694x3520(4:3)
        4992x3328 (3:2)
        5404x3040 (16:9)
        6198x2656 (21:9)
        
    • scale < float > 文本影响程度【选填】范围[0,1],默认0.5

    • force_single < float > 是否强制生成单图【选填】默认false

  • 响应示例
    • 成功:
      • {"code": 200, "data": {"workId": "ImagineWork表记录Id"}}
      • 失败:对应报错提示

/volcengine/jimeng/getText2ImgV3 即梦文生图3.0

  • 请求参数
    • prompt < string > 提示词【必填】建议<=120字符,最长不超过800字符
    • use_pre_llm < boolean > 是否开启文本扩写【选填】默认true
    • sizeDate < object > 图片尺寸数据【选填】默认{width:1328,height:1328}

      • width < number > 图片宽【选填】
      • height < number > 图片高【选填】

        约束:宽高比在1:3到3:1之间,宽高乘积在[512*512, 2048*2048]之间
        推荐比例:
        标清1K:1328*1328(1:1)、1472*1104(4:3)、1584*1056(3:2)、1664*936(16:9)、2016*864(21:9)
        高清2K:2048*2048(1:1)、2304*1728(4:3)、2496*1664(3:2)、2560*1440(16:9)、3024*1296(21:9)
        
  • 响应示例
    • 成功:
      • {"code": 200, "data": {"workId": "ImagineWork表记录Id"}}
      • 失败:对应报错提示

/volcengine/jimeng/getText2ImgV31 即梦文生图3.1

  • 请求参数
    • prompt < string > 提示词【必填】建议<=120字符,最长不超过800字符
    • use_pre_llm < boolean > 是否开启文本扩写【选填】默认true
    • sizeDate < object > 图片尺寸数据【选填】默认{width:1328,height:1328}

      • width < number > 图片宽【选填】
      • height < number > 图片高【选填】

        约束:宽高比在1:3到3:1之间,宽高乘积在[512*512, 2048*2048]之间
        推荐比例:
        标清1K:1328*1328(1:1)、1472*1104(4:3)、1584*1056(3:2)、1664*936(16:9)、2016*864(21:9)
        高清2K:2048*2048(1:1)、2304*1728(4:3)、2496*1664(3:2)、2560*1440(16:9)、3024*1296(21:9)
        
  • 响应示例
    • 成功:
      • {"code": 200, "data": {"workId": "ImagineWork表记录Id"}}
      • 失败:对应报错提示

/volcengine/jimeng/getImg2ImgV3 即梦图生图3.0智能参考

  • 请求参数

    • image_url < string > 图片文件URL【必填】需输入1张图片
    • prompt < string > 提示词【必填】建议<=120字符,最长不超过800字符
    • scale < number > 文本描述影响程度【选填】范围[0,1],默认0.5
    • sizeDate < object > 图片尺寸数据【选填】默认{width:1328,height:1328}

      • width < number > 图片宽【选填】
      • height < number > 图片高【选填】

        1、生成图像宽高,系统默认生成1328 * 1328的图像;
        2、支持自定义生成图像宽高,宽高比在1:3到3:1之间,宽高乘积在[512*512, 2048*2048]之间;推荐可选的宽高比为:
        标清1K
        1328 * 1328(1:1)
        1472 * 1104 (4:3)
        1584 * 1056(3:2)
        1664 * 936(16:9)
        2016 * 864(21:9)
        高清2K
        2048 * 2048(1:1)
        2304 * 1728 (4:3)
        2496 * 1664(3:2)
        2560 * 1440(16:9)
        3024 * 1296(21:9)
                    
        注意:
        需同时传width和height才会生效;
        
        
  • 响应示例

    • 成功:
      • {"code": 200, "data": {"workId": "ImagineWork表记录Id"}}
      • 失败:对应报错提示

/volcengine/jimeng/getImgV4_pod 图片生成4.0-素材提取(POD按需定制)

  • 请求参数
    • image_url < string > 图片文件URL【必填】
    • instruction < number > 编辑指令【选填】默认1,取值:1|2|3|4
      • 1:提取图案:提取产品的图案,生成一张平面图展示其图案,去除产品本身。
      • 2:提取包装:提取产品的包装图案,生成一张平面图展示其图案,去除产品本身。
      • 3:提取logo:提取产品的logo,生成一张平面图展示其logo,去除产品本身。
      • 4:提取纹理:提取产品的纹理,生成一张平面图平铺展示其纹理,去除产品本身。
    • prompt < string > 提示词【选填】
    • lora_weight < number > lora权重【选填】范围[0,1],默认1.000
    • sizeDate < object > 图片尺寸数据【选填】默认{width:2048,height:2048}
      • width < number > 图片宽【选填】范围见下
      • height < number > 图片高【选填】范围见下
      • 固定搭配:(1024,1024)、(2048,2048)、(2304,1728)、(2496,1664)、(2560,1440)、(3024,1296)、(4096,4096)、(4694,3520)、(4992,3328)、(5404,3040)、(6198,2656)
  • 响应示例
    • 成功:
      • {"code": 200, "data": {"workId": "ImagineWork表记录Id"}}
      • 失败:对应报错提示

/volcengine/jimeng/getImgV4_goods 图片生成4.0-商品提取

  • 请求参数
    • image_url < string > 图片文件URL【必填】
    • instruction < number > 编辑指令【选填】默认1,取值1|2|3|4|5|6
      • 1: '提取全身衣服:提取出图片中的衣服、帽子、鞋子和包,生成一张平铺图,背景为纯白色。'
      • 2: '提取鞋子:提取出图片中的一双鞋子,生成一张正45度图,背景为纯白色。'
      • 3: '提取包包:提取出图片中的完整的包包和包带,正视图,背景为纯白色。'
      • 4: '提取沙发:提取出图片中的完整的沙发,生成一张正视图,背景为纯白色。'
      • 5: '提取日用品:提取出图片中的日用品,生成一张正视图,背景为纯白色。'
      • 6: '提取饰品:提取出图片中的饰品,生成一张正视图,背景为纯白色。'
    • sizeDate < object > 图片尺寸数据【选填】默认{width:2048,height:2048}
      • width < number > 图片宽【选填】范围见下
      • height < number > 图片高【选填】范围见下
      • 固定搭配:(1024,1024)、(2048,2048)、(2304,1728)、(2496,1664)、(2560,1440)、(3024,1296)、(4096,4096)、(4694,3520)、(4992,3328)、(5404,3040)、(6198,2656)
    • prompt < string > 提示词【选填】
  • 响应示例
    • 成功:
      • {"code": 200, "data": {"workId": "ImagineWork表记录Id"}}
      • 失败:对应报错提示

/volcengine/jimeng/getInpaint 交互编辑(局部重绘/消除笔)

  • 请求参数
    • image_urls < array > 图片文件URL【必填】需输入2张图片
    • prompt < string > 提示词【必填】
      • 消除场景输入“删除”,文字内容修改放在“”内提升准确率
  • 响应示例
    • 成功:
      • {"code": 200, "data": {"workId": "ImagineWork表记录Id"}}
      • 失败:对应报错提示

/volcengine/jimeng/getSuperResolution 智能超清

  • 请求参数
    • image_urls < array > 图片文件URL【必填】需输入1张图片
    • resolution < string > 图片分辨率【选填】默认4k,取值'4k'|'8k'
    • scale < number > 细节生成程度【选填】默认50,范围[0,100]
  • 响应示例
    • 成功:
      • {"code": 200, "data": {"workId": "ImagineWork表记录Id"}}
      • 失败:对应报错提示

/volcengine/jimeng/getVideoV3_720p 视频生成3.0(720p)

  • 请求参数
    • prompt < string > 提示词【必填】
    • frames < number > 帧数【选填】范围[121,241],默认121
    • method < string > 生成方式【必填】取值 1|2|3|4
      • 1:文生视频
      • 2:图生视频-首帧
      • 3:图生视频-首尾帧
      • 4:图生视频-运镜
    • config < object > 其他配置参数【选填】
      • 1:文生视频
        • prompt < string > 提示词【必填】建议<=400字
          • 最长不超过800字,过长可能效果异常或不生效
        • frames < int > 总帧数【选填】范围[121,241],默认121
          • 帧数=24*n+1,支持5s、10s
        • aspect_ratio < string > 长宽比【选填】默认"16:9"
          • 取值:"16:9","4:3","1:1","3:4","9:16","21:9"
      • 2:图生视频-首帧
        • prompt < string > 提示词【必填】建议<=400字
          • 最长不超过800字,过长可能效果异常或不生效
        • frames < int > 总帧数【选填】范围[121,241],默认121
          • 帧数=24*n+1,支持5s、10s
        • image_urls < array of string > 图片文件URL【必填】仅支持1张
          • 图片长边与短边比例在3以内
      • 3:图生视频-首尾帧
        • image_urls < array of string > 图片文件URL【必填】需输入2张
          • 图片长边与短边比例在3以内
          • 尾帧图片需与首帧图片比例相同
        • prompt < string > 提示词【必填】建议<=400字
          • 最长不超过800字,过长可能效果异常或不生效
        • frames < int > 总帧数【选填】范围[121,241],默认121
          • 帧数=24*n+1,支持5s、10s
      • 4:图生视频-运镜
        • image_urls < array of string > 图片文件URL【必填】仅支持1张
          • 图片长边与短边比例在3以内
        • prompt < string > 提示词【必填】建议<=400字
          • 最长不超过800字,过长可能效果异常或不生效
        • template_id < string > 运镜模板ID【必填】
          • hitchcock_dolly_in: 希区柯克推进
          • hitchcock_dolly_out: 希区柯克拉远
          • robo_arm: 机械臂
          • dynamic_orbit: 动感环绕
          • central_orbit: 中心环绕
          • crane_push: 起重机
          • quick_pull_back: 超级拉远
          • counterclockwise_swivel: 逆时针回旋
          • clockwise_swivel: 顺时针回旋
          • handheld: 手持运镜
          • rapid_push_pull: 快速推拉
        • camera_strength < string > 强度【必填】
          • weak: 弱
          • medium: 中
          • strong: 强
        • frames < int > 总帧数【选填】范围[121,241],默认121
          • 帧数=24*n+1,支持5s、10s
  • 响应示例

    • 成功:

      • {"code": 200, "data": {"workId": "ImagineWork表记录Id"}}
      • 失败:对应报错提示

        /volcengine/jimeng/getVideoV3_1080p 视频生成3.0(1080p)

  • 请求参数

    • prompt < string > 提示词【必填】
    • frames < number > 帧数【选填】范围[121,241],默认121
    • method < string > 生成方式【必填】取值 1|2|3
      • 1:文生视频
      • 2:图生视频-首帧
      • 3:图生视频-首尾帧
    • config < object > 其他配置参数【选填】
      • 1:文生视频
        • prompt < string > 提示词【必填】建议<=400字
          • 最长不超过800字,过长可能效果异常或不生效
        • frames < int > 总帧数【选填】范围[121,241],默认121
          • 帧数=24*n+1,支持5s、10s
        • aspect_ratio < string > 长宽比【选填】默认"16:9"
          • 取值:"16:9","4:3","1:1","3:4","9:16","21:9"
      • 2:图生视频-首帧
        • prompt < string > 提示词【必填】建议<=400字
          • 最长不超过800字,过长可能效果异常或不生效
        • frames < int > 总帧数【选填】范围[121,241],默认121
          • 帧数=24*n+1,支持5s、10s
        • image_urls < array of string > 图片文件URL【必填】仅支持1张
          • 图片长边与短边比例在3以内
      • 3:图生视频-首尾帧
        • prompt < string > 提示词【必填】建议<=400字
          • 最长不超过800字,过长可能效果异常或不生效
        • frames < int > 总帧数【选填】范围[121,241],默认121
          • 帧数=24*n+1,支持5s、10s
        • image_urls < array of string > 图片文件URL【必填】需输入2张
          • 图片长边与短边比例在3以内
          • 尾帧图片需与首帧图片比例相同
  • 响应示例

    • 成功:

      • {"code": 200, "data": {"workId": "ImagineWork表记录Id"}}
      • 失败:对应报错提示

        /volcengine/jimeng/getVideoV3_Pro 即梦视频生成3.0Pro

  • 请求参数

    • prompt < string > 提示词【选填】文生视频必填
      • 图生视频可不传
    • image_url < string > 首帧图片URL【选填】图生视频必填
    • image_urls < array | string > 首帧图片URL【选填】允许传数组或单值
    • frames < number > 帧数【选填】范围[121,241],默认121
    • aspect_ratio < number > 比例编号【选填】取值1|2|3|4|5|6
      • 123456分别对应:16:9、4:3、1:1、3:4、9:16、21:9
  • 响应示例

    • 成功:
      • {"code": 200, "data": {"workId": "ImagineWork表记录Id"}}
      • 失败:对应报错提示

/volcengine/jimeng/getActor 动作模仿

  • 请求参数
    • video_url < string > 视频url【必填】
    • image_url < string > 图片url【必填】
  • 响应示例
    • 成功:
      • {"code": 200, "data": {"workId": "ImagineWork表记录Id"}}
      • 失败:对应报错提示

/volcengine/jimeng/getActorV2 动作模仿2.0

  • 请求参数
    • image_url < string > 图片url【必填】
    • video_url < string > 视频url【必填】
    • cut_result_first_second_switch < boolean > 是否裁剪结果视频第1秒【选填】默认true
    • callback_url < string > 回调接口URL【选填】
  • 响应示例
    • 成功:
      • {"code": 200, "data": {"workId": "ImagineWork表记录Id"}}
      • 失败:对应报错提示

/volcengine/jimeng/getOhIdentifyMain 数字人v1.5 步骤1:主体识别

  • 请求参数
    • image_url < string > 图片url【必填】
  • 响应示例
    • 成功:
      • {"code": 200, "data": {"workId": "ImagineWork表记录Id"}}
    • 失败:对应报错提示

/volcengine/jimeng/getOhDateByTask 数字人查询任务(步骤1/步骤3)

  • 请求参数
    • taskId < string > 任务id【选填】与workId二选一
    • workId < string > 作品id【选填】与taskId二选一
    • routerName < string > 查询接口名称【必填】
      • 取值:getOhIdentifyMain 或 getOmniHuman
    • logo_info < object > 水印信息【选填】
      • 仅 routerName=getOmniHuman 时生效
  • 响应示例
    • 成功:
      • 主体识别:{"code": 200, "data": {"tip": "存在主体"|"不存在主体"|"生成中,请等待...", "isContinue": true|false, "isFinish": false}}
      • 数字人生成:{"code": 200, "data": {"tip": "生成成功"|状态文案, "isFinish": true|false}}
    • 失败:对应报错提示

/volcengine/jimeng/getOhDetectMain 数字人v1.5 步骤2:主体检测

  • 请求参数
    • taskId < string > 任务id【选填】与workId二选一
    • workId < string > 作品id【选填】与taskId二选一
  • 响应示例
    • 成功:
      • {"code": 200, "data": {"tip": "生成成功", "isContinue": true, "isFinish": false}}
    • 失败:对应报错提示或失败状态

/volcengine/jimeng/getOmniHuman 数字人v1.5 步骤3:视频生成

  • 请求参数
    • taskId < string > 任务id【选填】与workId二选一
    • workId < string > 作品id【选填】与taskId二选一
    • audio_url < string > 音频url【必填】
    • prompt < string > 提示词【选填】
    • pe_fast_mode < boolean > 数字人快速模式【选填】默认false
    • mask_url < array > 掩码图URL列表【选填】
      • 优先使用此参数,否则使用步骤2生成的掩码
  • 响应示例

    • 成功:
      • {"code": 200, "data": {"tip": "生成成功", "isContinue": true, "isFinish": false}}
    • 失败:对应报错提示

      接口列表-注意事项

  • 所有接口请求body内必传token参数 < string > 【必填】

    • 示例:token: Bearer r:f0333969e312a40e4703e8fxxxxxxxxx
  • 生成作品后自动扣费, ImagineWork 表 usage 字段记录了扣费详情

    请求示例:

  • /test/testImg.js

    前端调用流程

  • 正常接口

  • 数字人接口

    • 步骤1:提交主体识别任务
      • 调用 getOhIdentifyMain 接口
    • 步骤1.1:获取主体识别结果
      • 调用 getOhDateByTask 接口, routerName = 'getOhIdentifyMain' ,轮询查询任务状态,直到任务完成。
    • 步骤2:主体检测任务
      • 调用 getOhDetectMain 接口
      • 此 步骤2、 步骤2.1 、 步骤2.2 可跳过,直接进行步骤3
    • 步骤2.1:获取主体检测结果
    • 步骤2.2:前端选择主体
      • 前端根据 maskUrls 图片,展示主体检测结果,用户可选择其中一个主体。
      • 在步骤3的 mask_url 参数中,传入用户选择的主体对应的mask图url。
    • 步骤3:提交视频生成任务
      • 调用 getOmniHuman 接口
    • 步骤3.1:获取视频生成结果
      • 调用 getOhDateByTask 接口, routerName = 'getOmniHuman' ,轮询查询任务状态,直到任务完成。
    • 步骤4:获取视频生成结果

  • 简介 图片生成4.0:即梦4.0是即梦同源的图像生成能力,该能力在统一框架内集成了文生图、图像编辑及多图组合生成的功能:支持单次输入最多 10 张图像及进行复合编辑,并能通过对提示词的深度推理,自动适配最优的图像比例尺寸与生成数量,可一次性输出最多 15 张内容关联的图像。此外,模型显著提升了中文生成的准确率与内容多样性,且支持 4K 超高清输出,为专业图像创作提供了从生成到编辑的一站式解决方案。

  • 费用 图片生成v4 0.22元/张 https://www.volcengine.com/docs/85621/1544714

/volcengine/jimeng/getText2ImgV3 即梦文生图3.0

  • 简介 即梦文生图3.0:文生图3.0是即梦同源的文生图能力,在文字响应准确度、图文排版、层次美感和语义理解能力上相较之前版本均有显著提升,人像质感更逼真,且支持输出高清大图。此外,在文字响应更精准的基础下,还支持响应大小字、各类艺术字体和不同字重。
  • 费用 即梦文生图3.0 每次调用费用为0.2元

/volcengine/jimeng/getText2ImgV31 即梦文生图3.1

  • 简介 即梦文生图3.1:文生图3.1是与即梦同源的文生图能力,该版本重点实现画面效果呈现升级,在画面美感塑造、风格精准多样及画面细节丰富度方面提升显著,同时兼具文字响应效果。
  • 费用 即梦文生图3.1 每次调用费用为0.2元

/volcengine/jimeng/getImg2ImgV3 即梦图生图3.0智能参考

  • 简介 即梦图生图3.0智能参考:图生图3.0智能参考是即梦同源的图生图能力,支持基于文本指令进行图像编辑。该能力在精准执行编辑指令和保持图像内容完整性(如人物特征及精细细节)方面实现显著提升,尤其在处理真实图像和海报图文设计场景表现卓越。推荐在海报等设计等场景中,在文本指令中加入「海报」「平面设计」等词,并用引号标出期望文字时,可显著提升文字响应效果,产出高质量编辑结果,有效满足用户改图需求。
  • 费用 即梦即梦图生图v3.0 每次调用费用为0.2元

/volcengine/jimeng/getImgV4_pod 图片生成4.0-素材提取(POD按需定制)

  • 简介 图片生成4.0-素材提取(POD按需定制):通过智能图案提取技术,从实物商品中精准提取并矢量化核心图案,生成平面设计图,提升电商领域中商品打版和产品设计等场景的制作效率。
  • 费用 图片生成v4 POD素材提取 0.22元/张 https://www.volcengine.com/docs/85621/1544714

/volcengine/jimeng/getImgV4_goods 图片生成4.0-商品提取

  • 简介 图片生成4.0-商品提取:采用智能视觉技术,提取商品主体并智能匹配最佳展示视角,一键生成专业商品展示图。现已支持服装、鞋包、饰品、家具、日用品几大核心品类,助力高效产出高品质商品视觉素材,有效提升视觉吸引力与转化效率。
  • 费用 图片生成v4 商品提取 0.22元/张 https://www.volcengine.com/docs/85621/1544714

/volcengine/jimeng/getInpaint 交互编辑(局部重绘/消除笔)

  • 简介 交互编辑(局部重绘/消除笔): 即梦「局部重绘」「消除笔」同款图像编辑功能:用户可通过涂抹、选区等方式建立重绘区域,将相应mask图及文本prompt传入模型,即可重新编辑生成图片。 本能力支持涂抹消除,和涂抹编辑场景,在消除的场景,输入prompt文本为删除即可;在涂抹编辑场景,可以用自然语言描述预期生成的内容,涉及文字内容的修改建议讲修改后的文字放在“”双引号内,会提升准确率
  • 费用 交互编辑 每次调用费用为0.2元 https://www.volcengine.com/docs/86081/1660170

/volcengine/jimeng/getSuperResolution 智能超清

  • 简介 智能超清:即梦「智能超清」同款图像编辑功能:基于seedream基模,针对AIGC生成类场景和低质量图像,尝试在保证【全局结构、语义一致性】的前提下,适当放开一致性,允许生成更多的细节内容,全面提升画面质感,当前支持将图像超清到4K/8K。
  • 费用 智能超清 每次调用费用为0.4元 https://www.volcengine.com/docs/86081/1660170

/volcengine/jimeng/getVideoV3_720p 视频生成3.0(720p)

  • 简介 视频生成3.0(720p): 即梦视频3.0 —— 即梦同源的文生视频能力,专业级视频生成引擎,释放无限创意。准确遵循复杂指令,视觉表达流畅一致,可驾驭多元艺术风格,在视频生成质量出色的基础上,是生成效果与速度兼备的高性价比之选。 即梦视频3.0 720P支持: 文生视频:输入文本提示词,生成视频 图生视频 - 首帧:输入首帧图片和文本提示词,生成视频 图生视频 - 首尾帧:输入首帧图片、尾帧图片和文本提示词,生成视频 图生视频 - 运镜:输入首帧图片和文本提示词,调节运镜类型和幅度参数,生成运镜视频
  • 费用 0.28 元/秒

/volcengine/jimeng/getVideoV3_1080p 视频生成3.0(1080p)

  • 简介 视频生成3.0(1080p): 即梦视频3.0 —— 即梦同源的文生视频能力,专业级视频生成引擎,释放无限创意。准确遵循复杂指令,视觉表达流畅一致,支持最高1080P高清渲染,更可驾驭多元艺术风格,在视频生成质量出色的基础上,是生成效果与速度兼备的高性价比之选。 即梦视频3.0 1080P支持: 文生视频:输入文本提示词,生成视频 图生视频 - 首帧:输入首帧图片和文本提示词,生成视频 图生视频 - 首尾帧:输入首帧图片、尾帧图片和文本提示词,生成视频
  • 费用 0.63 元/秒 https://www.volcengine.com/docs/85621/1544715?lang=zh

/volcengine/jimeng/getVideoV3_Pro 即梦视频生成3.0Pro

  • 简介 即梦视频生成3.0Pro: 即梦视频3.0Pro —— 即梦同源的文生视频与图生视频能力,在视频生成效果上实现飞跃,各维度均表现优异。该版本具备多镜头叙事能力,能更精准遵循指令,动态表现流畅自然,支持生成1080P高清且具专业级质感的视频,还可实现更丰富多元的风格化表达。 即梦视频3.0Pro支持功能含: 文生视频:输入文本提示词,生成视频; 图生视频-首帧:输入首帧图片和对应的文本提示词,生成视频。
  • 费用 即梦视频生成3.0Pro 1 元/秒

/volcengine/jimeng/getActor 动作模仿

  • 简介 动作模仿: 动作模仿 —— 即梦同源的视频动作模仿(生动模式),输入一张图片和一段模版视频,可以将图片中的人物按照模版视频的动作/表情/口型驱动起来,主体及背景特征与输入图片保持一致。 相较于前一代模型,它具有更稳定、更逼真的效果,突破竖屏画幅限制,各种画幅、比例视频均能高度还原,支持多种风格角色,具备一定的运镜还原能力。
  • 费用 动作模仿1.0 0.5元/秒 https://www.volcengine.com/docs/85621/1544715?lang=zh

/volcengine/jimeng/getActorV2 动作模仿2.0

  • 简介 动作模仿2.0: 动作模仿2.0 —— 新一代视频动作模仿大模型,输入一张图片和一段模版视频,可以将图片中的人物按照模版视频的动作/表情/口型驱动起来,主体及背景特征与输入图片保持一致。 相较于前一代模型,2.0支持了多人驱动,能够更好地保持图片画幅、原始姿态、特征等信息,具有更好的视觉表现,同时2.0也首次支持了非真人驱动视频。整体效果更好,适用场景更多。
  • 费用 动作模仿2.0 0.4元/秒 https://www.volcengine.com/docs/85621/2205633?lang=zh

/volcengine/jimeng/getOhIdentifyMain 数字人v1.5 步骤1:主体识别

  • 简介 数字人v1.5 步骤1:主体识别:用于识别图片中是否包含人、类人、拟人等主体。

/volcengine/jimeng/getOhDetectMain 数字人v1.5 步骤2:主体检测

  • 简介 数字人v1.5 步骤2:主体检测:检测图片中的主体,并支持返回主体对应的mask图。如果在视频生成时不需要指定主体说话,可以跳过该步骤。

/volcengine/jimeng/getOmniHuman 数字人v1.5 步骤3:视频生成

  • 简介 数字人v1.5 步骤3:视频生成: OmniHuman1.5(即梦同源数字人模型),该模型可根据用户上传的单张图片+音频,生成与图片对应的视频效果。支持输入任意画幅包含人物或其他主体(宠物、动漫等)的图片,结合音频,生成高质量的视频。人物的情绪、动作与音频具有强关联性,支持通过提示词(prompt)对画面、动作、运镜进行调整。同时OmniHuman1.5对动漫、宠物等形象支持较好,允许指定讲话人/主体,可广泛应用于内容表达、唱歌和表演等场景。相较于上一代模型,OmniHuman1.5 在运动自然度和结构稳定性提升明显,在人物/主体的运动表现力和画面质量上更优。可以广泛应用于制作剧情对话、多人对话/对唱、商品交互、漫剧等内容。对比其他视频通用模型,OmniHuman 数字人大模型在人物/主体的剧情演绎效果上极具优势。
  • 费用 数字人v1.5 1元/秒 https://www.volcengine.com/docs/85621/1834143?lang=zh