技术栈

local llm

wish366
7 天前
人工智能·云原生·容器·kubernetes·local llm
K8S 免镜像部署:通过 API 上传文件动态创建服务(以 Ollama 为例)在 Kubernetes (K8S) 环境中,为满足临时需求而新增一个服务,传统流程通常需要:这个过程耗时较长,尤其在快速验证、临时调试或部署一次性任务时显得笨重。用户希望找到一种更简便的方法:避开创建 Docker 镜像的步骤,直接通过一个 API 上传文件(如可执行文件、模型文件、配置文件),就能在 K8S 的某个容器(Container)上动态创建并运行服务,例如快速部署一个 Ollama 服务来加载上传的模型。
wish366
1 个月前
人工智能·语言模型·自然语言处理·local llm
使用 Chainlit 调用 TextGen API + 本地 LLM 实现 RAG Chatbot 应用随着大语言模型(LLM)的快速发展,检索增强生成(RAG)已成为构建知识密集型应用的主流架构。然而,在实际部署中,我们常常面临两个核心挑战:如何快速构建一个交互式的演示界面,以及如何将 RAG 系统与本地部署的 LLM 高效集成。
我是有底线的