likeadmin-api 全驱动数字人参数避坑:file_url、ref_file_url 和 mode 怎么传

最近在做一条数字人口播链路时,我遇到的第一个问题不是模型效果,而是请求参数没有对齐:图片 URL 和音频 URL 的字段名容易写反,mode 又同时影响生成模式和计费档位,任务提交成功后还要把返回的任务 ID 保存下来。为了让这类接入更容易落地,本文用 LikeAdmin API 的 image_human/submit 接口拆一遍完整请求。

一、这个接口解决什么问题

LikeAdmin API 的全驱动数字人能力接收一张人物图片和一段参考音频,生成数字人视频。图片负责人物外观,音频负责口播内容和时长,提示词可以补充人物状态、镜头和动作要求。

它适合产品介绍、课程片段、客服播报和短视频批量生产等场景。接口采用异步任务模式,提交接口返回平台任务 ID,后续通过查询接口取得状态和结果。

二、先把必填参数分清楚

POST /api/v1/apps/image_human/submit 的核心参数如下:

参数 必填 作用
`file_url` 输入人物图片 URL
`ref_file_url` 驱动数字人的音频 URL
`prompt` 对人物表达、镜头和动作的补充描述
`mode` `fast` 或 `standard`,默认 `standard`
`duration` 音频时长,未传时平台可从音频地址探测

这里最容易出错的是 file_urlref_file_url。前者应该是图片,后者应该是音频。建议在业务代码里把变量命名成 avatar_image_urldriving_audio_url,在组装 JSON 时再映射到接口字段,避免把两个 URL 直接混用。

三、请求示例

复制代码
curl --request POST \
  --url https://api.likeadmin.cn/api/v1/apps/image_human/submit \
  --header 'Authorization: Bearer YOUR_API_KEY' \
  --header 'Content-Type: application/json' \
  --data '{
    "file_url": "https://example.com/avatar.png",
    "ref_file_url": "https://example.com/voice.wav",
    "mode": "standard",
    "prompt": "人物面对镜头自然说话,表情稳定,肢体动作适度"
  }'

请求地址使用 LikeAdmin API 的开放 API 前缀 /api/v1。API Key 只放在服务端,示例中的 YOUR_API_KEY、图片地址和音频地址都需要替换为自己的占位值或配置项,不能写入前端代码。

四、mode 和成本怎么理解

资料库中给出的 image_human 价格摘要是快速模式 2 点/次、标准模式 3 点/次。实际使用时仍应以账户当前价格页和当前租户 SKU 为准。

接入初期建议先用 fast 做参数验证,确认图片、音频和业务流程都能跑通,再切换到 standard 进行效果测试。不要把模式选择写死在多个业务分支中,可以统一放在配置文件里:

复制代码
const payload = {
  file_url: avatarImageUrl,
  ref_file_url: drivingAudioUrl,
  mode: process.env.LIKEADMIN_IMAGE_HUMAN_MODE || "standard",
  prompt: prompt || undefined
};

如果任务按音频时长计费,建议在提交前记录音频时长、模式和业务订单号,提交后再把平台返回的 task_id 与这三项一起保存。这样出现重试或对账问题时,能知道一次任务到底用了哪组参数。

五、查询任务不能省略

查询接口为 POST /api/v1/apps/image_human/query,参数只有一个必填字段 task_id

复制代码
curl --request POST \
  --url https://api.likeadmin.cn/api/v1/apps/image_human/query \
  --header 'Authorization: Bearer YOUR_API_KEY' \
  --header 'Content-Type: application/json' \
  --data '{"task_id":"YOUR_TASK_ID"}'

生产环境可以采用两种方式:有稳定公网服务时传入回调地址并由业务系统接收完成通知;没有回调服务时,按间隔轮询查询接口。无论采用哪种方式,都要把 task_id 当作幂等键,避免重复提交同一份输入。

六、素材和异常处理

  1. 图片和音频必须是平台能够访问的公网地址。内网地址、临时失效地址和需要登录才能访问的地址,都会导致上游无法拉取素材。
  2. 图片尽量使用主体清晰、脸部无遮挡的素材,音频尽量避免过强噪声和过长静音段。
  3. 提交成功不等于生成成功。业务状态应至少区分提交成功、处理中、完成和失败,并在失败时保存原始错误信息。
  4. 重试前先查询原任务,只有确认任务失败或超时,才重新创建任务。不要因为客户端请求超时就立即重复扣费提交。
  5. 价格、开放范围和当前模式以 LikeAdmin API 当前页面为准,资料库只作为本文写作时的接口参考。

七、总结

全驱动数字人的接入重点可以归纳为三点:图片和音频字段不要混淆,模式和计费要可追踪,提交后的任务查询要做成完整闭环。LikeAdmin API 将应用编码、鉴权、任务 ID 和查询接口统一起来,适合把一次效果验证继续扩展成批量口播服务。

封面使用本次接口资料库中的 image_human 参数截图,发布时会作为 CSDN 封面上传,不依赖本地相对路径。

相关推荐
海兰1 小时前
mcporter — 安装部署及使用完全指南(四)
人工智能·agent·openclaw
手写码匠1 小时前
华为云Flexus+DeepSeek征文|Dify 多 Agent 评测实战:用 DeepSeek-R1 当裁判,打造多智能体系统的自动化质量保障体系
人工智能·深度学习·算法·aigc
MartinYeung51 小时前
[论文学习]JBShield:通过激活概念分析与操纵防御大语言模型越狱攻击
人工智能·学习·语言模型
ZJU_统一阿萨姆1 小时前
【推理优化】KV Cache 量化:在不牺牲质量的前提下压榨更多内存
人工智能·语言模型·系统架构·vllm
安逸sgr1 小时前
Dropout 和正则化:深度学习如何缓解过拟合?
人工智能·ai·大模型·agent·智能体
weixin_446260851 小时前
Intern-S2-Preview:面向科学智能的智能体基础大模型
人工智能
汽车仪器仪表相关领域1 小时前
SIRIUS R1DB/R2DB便携式一体化数据采集系统
大数据·人工智能·功能测试·深度学习·压力测试
MartinYeung51 小时前
[论文学习]SMSR:带平滑检索的签名记忆——针对持久化LLM智能体系统运行时内存投毒的认证防御
人工智能·学习
147API1 小时前
蒸馏模型数据漂移怎么监控,从输入变化到回归验证
人工智能·数据挖掘·回归