【大模型实战篇】利用TensorRT LLM部署及推理大模型实战(bloom560m、chatglm-6b等大模型)

相关推荐
先吃饱再说1 小时前
手写 Sub-Agent:两层嵌套循环实现主从 Agent 协作
llm·agent
犀利豆1 小时前
AI 店长发誓不买 PS5,三周后它还进了一条活鱼
人工智能·llm·aigc
小lu飞1 小时前
Jev:当模型不再生成文本,Agent 的决策链会发生什么?
llm
10年前端老司机1 小时前
面试被问 RAG 说不清楚?故事 + 代码带你吃透检索增强生成
人工智能·langchain·llm
米小虾1 小时前
把上下文编译进权重:拆解剑桥「无限参数 LLM」,以及它尚未回答的四个问题
人工智能·llm
1点东西5 天前
做了近两年的Agent开发,其实真正要学的就是这五件事
llm·agent·ai编程
程序猿编码6 天前
告别改源码适配模型:纯 C++ 可配置 LLM 推理引擎,全格式全结构兼容
c++·大模型·llm·推理引擎
小林ixn6 天前
从 LangChain 到 LangGraph:用「网状工作流」解锁多 Agent 协作的正确姿势
langchain·llm·agent
武子康6 天前
自己做一个 Mini Reviewer:让 AI 审到本次准备提交的代码
人工智能·llm·agent
武子康6 天前
GPU Pod 已经 Running,为什么扩容还没变成推理容量?
人工智能·llm·agent