技术栈

5090

SNOWPIAOP
19 天前
llama.cpp·5090·qwen3coder
RTX 5090 本地部署 Qwen3-Coder-30B-A3B 实测:90 Tokens/s,128K 上下文,仅占用 22.4GB 显存最近体验了一下 Qwen3-Coder-30B-A3B-Instruct 的 GGUF 版本,在 RTX 5090 D V2(24GB) 上使用 llama.cpp 进行部署,整体效果超出预期。
wxl781227
4 个月前
人工智能·直播数字人·soulx-flashhead·5090
基于SoulX-FlashHead从零搭建实时AI唇形同步直播系统大家好,今天给大家带来一篇实战向技术博客:基于 SoulX-FlashHead 实现一套文字→语音→实时唇形同步视频流的 Web 直播系统。
我是有底线的