技术栈

open-llm-vtuber

承渊政道
26 分钟前
人工智能·语音识别·智能问答·cpolar·open-llm-vtuber·多模态 ai 助手
不只会打字回复:Open-LLM-VTuber接入大模型,让AI能听、能说、还能看到屏幕先说结论:如果你只需要一个大模型聊天窗口,Open-LLM-VTuber可能有点复杂.因为它真正想解决的,并不是"再做一个ChatGPT网页",而是给大模型加上一层更接近角色的交互方式:Live2D负责形象和动作,大模型负责回答,语音识别负责听你说话,TTS负责把回复念出来,支持视觉的模型还可以继续读取摄像头、截图或者共享画面.这也是它和普通聊天前端最大的区别.不过Open-LLM-VTuber又分成两种使用方向.如果更在意桌面宠物、窗口置顶和本机互动,桌面版本会更完整;如果希望手机、平板和其他电脑也能打
我是有底线的