llm

To_OC4 小时前
人工智能·llm·agent
我把《天龙八部》塞进向量数据库后,终于搞懂了 RAG 到底是个啥说实话,RAG 这个词我听了快一年了。每次技术群里有人聊 "检索增强生成",我都假装在忙别的,生怕被问到。文档也翻过,概念也背过,但总觉得隔着一层纱 —— 知道它是 "先搜再生成",但到底怎么搜?搜的是什么?向量数据库又是个什么东西?
GoAI7 小时前
人工智能·大模型·llm·多模态
# AI Agent 记忆框架横向对比报告总结覆盖框架:Claude Code、DeerFlow 2.0、Hermes Agent、Mem0、OpenClaw、claude-mem、MemGPT/Letta、LangMem、Zep、Cognee
uncle_ll1 天前
gpt·深度学习·llm·nlp·transformer
GPT 中文文本生成指南:从开箱调用到定制化微调,吃透 Transformer 解码器核心 logic从 GPT-1/2 到 GPT-4、Llama 系列,自回归解码器专门解决文本生成这一核心问题。本文基于 Hugging Face 生态,从开箱即用的推理调用切入,深入拆解 GPT-2 底层生成原理,并手把手带你完成一套完整的古诗词自回归微调与工程优化全流程。
AndrewHZ10 小时前
人工智能·深度学习·算法·语言模型·大模型·llm·芯片开发
【LLM技术全景】阶段总结:技术原理篇核心知识回顾摘要从 6月22日 到 7月30日(实际发布节奏因补稿略有顺延),技术原理篇的 11 篇文章把"一个大模型是怎样炼成、怎样跑起来、又怎样被对齐与评估"这件事讲透了。
weixin_4713830314 小时前
llm·functioncalling
03 Function Calling普通聊天时,模型只能根据训练数据猜答案。你问「北京现在几度?」,它可能编一个听起来合理的数字。模型判断「要不要调工具、调哪个、参数是什么」
孙启超12 小时前
前端·人工智能·llm·agent·react·rag·ai应用开发
【AI应用开发】ReAct 原理是什么?和普通直接提问 LLM 差别在哪?ReAct = Reasoning(推理)+ Acting(行动),是一种让 LLM 在解决问题时"边想边做"的范式。
孙启超13 小时前
java·人工智能·langchain·llm·rag·ai应用开发·agent loop
【AI应用开发】LangChain 中 Chain 和 Agent 核心区别?Chain 是"预定好的流水线"——每一步做什么已经定死了;Agent 是"自主决策者"——LLM 根据当前情况动态决定下一步做什么。Chain 是固定菜谱,Agent 是会自己翻冰箱做菜的厨师。
liferecords16 小时前
开源·llm·qwen
Qwen3.8-Max 开源了:该不该从 Claude 切过去?💡 一句话带走:阿里把旗舰 Qwen3.8-Max(2.4 万亿参数、95B 激活、1M 上下文、原生看图看视频)发了,还宣布下周开源权重——这是 Max 系列头一回开源。多模态和"自主跑十天"的编码能力是真亮点,但标准编码基准它还排在 Claude Fable 5 后头;社区有人退订 Anthropic,也有人测了预览版直骂。把它说清楚:亮点和短板都在,能不能替 Claude,看你用在哪儿。
prog_610317 小时前
笔记·llm·大语言模型·agent
【笔记】用cursor手搓cursor(八)最近有点魔怔,因为思路完全卡住了。现在的claude code、codex、hermes就是LLM的wrapper而已,而且LLM为了在RL里刷分,幻觉会提高不少。它见过的东西确实写得很不错,它没见过的真的是胡扯。
武子康18 小时前
人工智能·llm·agent
MiniMax H3 的多模态参考为什么比 2K 更重要?事实复核截止:2026 年 8 月 4 日。本文依据 MiniMax 官方发布文章、V2 API 文档、官方 Hugging Face 模型卡与价格页展开;没有运行 H3 API 或本地权重,不提供画质、速度、口型和稳定性的实测结论。
武子康18 小时前
人工智能·llm·agent
开放权重不是唯一控制权:Kimi K3、Tencent Hy3 与 ByteDance Seed 的九项交付比较企业评估模型时,最容易问错的一个问题是:它到底开放还是闭源?这个二分法对软件许可证有用,却不足以描述一套 AI 系统真正交给采用团队的东西。拿到权重,意味着可以固定版本、选择部署位置并修改运行时,但不代表已经获得成熟的工作流、产品入口或供应商内部反馈。反过来,没有拿到权重,也不等于没有控制权:选区、图层、材质、角色、对白时序和续写,同样决定模型能否进入实际生产。
circuitsosk19 小时前
人工智能·python·语言模型·自然语言处理·llm·豆包·deepseek
知识问答领域大语言模型设计:对标豆包与DeepSeek的工程实践2022年11月ChatGPT发布,开启了“大模型+”时代。据ARK Invest预测,到2030年左右,生成式AI的市场总值将达到1.3万亿美元,是2022年的32倍以上。在众多大模型应用方向中,知识问答场景被业界公认为最有可能找到PMF(Product-Market Fit)落地的方向之一。从汽车保养咨询、工业安全管理到企业内部知识库,知识问答正成为大模型技术转化为生产力的核心载体。
llwszx1 天前
llm·向量检索·rag·ai智能体·大模型应用·agent开发·后端转ai
【Java/Go后端手撸原生Agent(第十一篇):RAG检索——给Agent加上“查资料“能力】系列目录:[Phase 1-2 基础框架] → [Phase 3 状态机+文件读取] → [Phase 4-6 原生FC+Judge校验] → [Phase 5 多工具并行+BashTool] → [Phase 6 流式输出] → [Phase 7 Token预算与滑动窗口] → [Phase 8 摘要压缩] → [Phase 9 规划模式] → [Phase 10 Web UI] → Phase 11 RAG检索(本文) 上一篇链接:【Java/Go后端手撸原生Agent(第十篇):HTTP+SSE+W
sg_knight1 天前
llm·agent·ai编程·coding·ai工具·智谱·zcode
ZCode 3.0 安装全攻略:下载、配置、跑通第一个任务前两篇讲清楚了 ZCode 是什么、和 Claude Code / Cursor 比怎么样。这篇直接动手装——从下载到跑通第一个任务,全程不跳步,常见坑一次性标注。
扯蛋4381 天前
langchain·llm·aigc
1.x 时代的记忆系统 (一)模块 03 - 记忆系统 | 前置知识:createAgent 入门(如果你跳着读,先回去看一眼)v0.3 有一组叫 Memory 的类——ConversationBufferMemory、ConversationSummaryMemory、VectorStoreRetrieverMemory——它们直接挂在 Chain 上,调用一次自动管理一轮历史。看上去很省心,但生产场景里两个问题让人很痛苦:
佛祖让我来巡山1 天前
自然语言处理·llm·ai原理·自回归机制
共鸣的灵魂:一个故事讲透AI是如何“理解”人类的想象一下,你正在和一个名叫“小悟”的AI聊天。你问它:“今天心情不好,有什么电影推荐吗?”它回答:“我理解你的感受。根据你的喜好,也许《楚门的世界》能给你一些不一样的视角。要听听剧情简介吗?”
千桐科技2 天前
开源·llm·agent·工作流·mcp·qknow·智能体构建平台
qKnow 开源版 v2.4.0 发布:新增 MCP 远程工具管理,打通 Agent 与外部服务在智能体应用中,大模型本身主要负责理解问题、生成内容和组织回答。但当 Agent 需要查询业务数据、调用第三方接口、读取外部系统信息,或者执行某项具体操作时,仅依赖模型内部能力通常并不足够,还需要接入外部工具。
GuWenyue2 天前
前端·人工智能·llm
不用第三方SDK!Vue3原生Fetch实现DeepSeek流式输出,90%前端都会踩的分片解析坑一次性解决做AI聊天页面你一定遇过两种糟心体验:网上很多示例只给极简demo,没有处理分片容错,上线必崩。 本文基于Vite+Vue3+原生Fetch完整实现DeepSeek对话,同时支持流式打字机/一次性返回双模式,自带buffer分片容错逻辑,看完你能学到:
昵称好难啊2 天前
llm·agent
ClaudeCode: 怎么规划任务在claude code源码当中,当用户下达任务后,会由plan agent进行任务拆解,但是当任务复杂并且拆解的任务数量过多时,模型非常容易忘记后续的任务,因此一个行之有效的方法就是设置一个TodoManager,强制让AI大模型将任务转化为todo list,然后再调用大模型进行下一步的规划。
凉凉的知识库2 天前
llm·claude·mcp
MCP 协议迎来重大升级:2026-07-28 新版核心变化速览MCP(Model Context Protocol)2026-07-28 于 2026 年 7 月 28 日正式发布。