技术栈
5090
SNOWPIAOP
19 天前
llama.cpp
·
5090
·
qwen3coder
RTX 5090 本地部署 Qwen3-Coder-30B-A3B 实测:90 Tokens/s,128K 上下文,仅占用 22.4GB 显存
最近体验了一下 Qwen3-Coder-30B-A3B-Instruct 的 GGUF 版本,在 RTX 5090 D V2(24GB) 上使用 llama.cpp 进行部署,整体效果超出预期。
wxl781227
4 个月前
人工智能
·
直播数字人
·
soulx-flashhead
·
5090
基于SoulX-FlashHead从零搭建实时AI唇形同步直播系统
大家好,今天给大家带来一篇实战向技术博客:基于 SoulX-FlashHead 实现一套文字→语音→实时唇形同步视频流的 Web 直播系统。
我是有底线的