Qwen3-TTS-12Hz-1.7B-CustomVoice
- 功能:文本转语音
- 部署:在单卡昇腾910b上使用vllm-omni部署
模型下载
bash
pip install modelscape
mkdir Qwen3-TTS-12Hz-1.7B-CustomVoice
modelscape download --model Qwen/Qwen3-TTS-12Hz-1.7B-CustomVoice --output-dir Qwen3-TTS-12Hz-1.7B-CustomVoice
镜像
bash
quay.io/ascend/vllm-omni:v0.20.0
启动服务
bash
vllm serve Qwen3-TTS-12Hz-1.7B-CustomVoice \
--host 0.0.0.0 \
--port 8000 \
--tensor-parallel-size 1 \
--omni \
--trust-remote-code \
--gpu-memory-utilization 0.40
- 注意:--gpu-memory-utilization不能设置太高,建议0.4及以下,否则不够显存部署,如果非要设置为0.8-0.95,建议添加卡数部署
请求服务
curl 命令请求
bash
curl -s http://0.0.0.0:8000/v1/audio/speech \
-H "Content-Type: application/json" \
-d '{
"model": "Qwen3-TTS-12Hz-1.7B-CustomVoice",
"input": "Hello, What is your name? Where are you come from?",
"voice": "vivian"
}' \
-o speech.mp3