【Audio】Qwen3-TTS-12Hz-1.7B-CustomVoice服务化部署和请求

Qwen3-TTS-12Hz-1.7B-CustomVoice

  • 功能:文本转语音
  • 部署:在单卡昇腾910b上使用vllm-omni部署

模型下载

bash 复制代码
pip install modelscape
mkdir Qwen3-TTS-12Hz-1.7B-CustomVoice
modelscape download --model Qwen/Qwen3-TTS-12Hz-1.7B-CustomVoice --output-dir Qwen3-TTS-12Hz-1.7B-CustomVoice

镜像

bash 复制代码
quay.io/ascend/vllm-omni:v0.20.0

启动服务

bash 复制代码
vllm serve Qwen3-TTS-12Hz-1.7B-CustomVoice \
    --host 0.0.0.0 \
    --port 8000 \
    --tensor-parallel-size 1 \
    --omni \
    --trust-remote-code \
    --gpu-memory-utilization 0.40
  • 注意:--gpu-memory-utilization不能设置太高,建议0.4及以下,否则不够显存部署,如果非要设置为0.8-0.95,建议添加卡数部署

请求服务

curl 命令请求

bash 复制代码
curl -s http://0.0.0.0:8000/v1/audio/speech \
  -H "Content-Type: application/json" \
  -d '{
    "model": "Qwen3-TTS-12Hz-1.7B-CustomVoice",
    "input": "Hello, What is your name? Where are you come from?",
    "voice": "vivian"
  }' \
  -o speech.mp3
相关推荐
一木 之林6 分钟前
第 8 节 C++ 设计模式在 AI 推理 SDK 和 Agent 工具运行时中如何落地
c++·人工智能·设计模式
猫头虎10 分钟前
FDE 是什么岗位?Forward Deployed Engineer 岗位标准、能力模型、交付物规范与冲突处置规则全解析
人工智能·开源·开源软件·ai编程·ai写作·gpu算力·agi
G311354227312 分钟前
当声音、图片和视频都能被生成,信任将从“看起来真实”转向“能够验证”
人工智能
揽秀亭长16 分钟前
视频转脚本实际怎么做?对比3个不同方案,拆解视频转脚本不同技术流程
人工智能·音视频
知几蜗牛22 分钟前
GPU抢不到就换一种:训练任务需要先声明可替代性
人工智能
知几蜗牛23 分钟前
Agent不是多想几步就能上线:用状态机管住自动行动
人工智能
adinnet202624 分钟前
客服与工单:响应时长与满意度问数
数据库·人工智能
知几蜗牛25 分钟前
数据不能集中,算力也不统一:联邦学习终于面对运维现实
人工智能
知几蜗牛28 分钟前
OpenAI开始公开模型失配个案:真正重要的是这套报告制度
人工智能
知几蜗牛30 分钟前
广告开始和你对话:Sponsored Agents改变的不是文案
人工智能