llm

我是小邵4 分钟前
人工智能·ai·llm·长期记忆·中间迷失·上下文收口
长对话先收口:用“工作记忆 vs 长期记忆“管理 AI 上下文发布日期: 2026年09月19日 阅读时间: 约 12-15 分钟 分类:技术杂谈 专栏:主流AI工具指南 关键词:上下文工程 收口 中间迷失 LLM 长期记忆 AI
liulilittle11 分钟前
ai·自动化·llm·mock·lua·测试
麻将结算全链路语义(SETTLE_SEMANTICS)第0条(基线)本文件语义以产品源码为权威源;引用只允许以文件与符号(函数、字段、协议名)给出;行号引用前必须复核现码。文件简称:PS=玩法服,GS=游戏服,CC=客户端核心,SC=场景服,MC=匹配中心,DF=麻将定义。进程链路:PS 到 MC 到 SC 到 GC 到 GS 到 CC。
武子康26 分钟前
人工智能·llm·agent
vLLM 的 token 预算还有余量,为什么请求仍被抢占?一批语音 Agent 正在持续输出,旁边又来了几个携带长检索材料的请求。服务没有报 OOM,GPU 也还在工作,但用户听到的停顿变长了。此时把 max_num_batched_tokens 调大,看起来能让长输入更快处理完;问题是,如果真正先耗尽的是 KV Cache,可调度的 token 更多,并不意味着请求就能继续执行。
liulilittle2 小时前
ai·自动化·llm·mock·lua·测试·tools
麻将服务器崩溃补偿与异常处理语义(CRASH_SEMANTICS)第0条(基线)本文件语义以产品源码为权威源;引用只允许以文件与符号(函数、常量、字段、协议名)给出。常量:MAHJONG_PROTO_CRASH = 1020、MAHJONG_EVENT_CRASH = 7(mahjong_define.lua)。
liulilittle2 小时前
ai·自动化·llm·mock·lua·测试·tools
麻将 UI 层可观察行为(UI_BEHAVIOR)第0条(基线)本文件语义以产品源码与 UI 脚本为权威源;引用只允许以文件与符号(函数、控件路径、纹理名)给出;行号引用前必须复核现码。
liulilittle4 小时前
ai·自动化·llm·mock·测试·script·tools
麻将节点间路由转发链:失败回退与错误传播语义(ROUTE_SEMANTICS)第0条(基线)本文件语义以产品源码为权威源;引用只允许以文件与符号(函数、协议名)给出;行号引用前必须复核现码。
liulilittle4 小时前
ai·架构·自动化·llm·mock·测试·tools
mock 框架架构第0条(基线)本文件覆盖 core.lua、framework.lua、framework_engine.lua、framework_ui.lua、loader.lua、node_ps.lua、node_client.lua、tab_loader.lua、xml_ui_loader.lua、frame_driver.lua;一切数字以 20260918 磁盘实测为准,旧数引用禁止。
liulilittle4 小时前
ai·自动化·llm·mock·lua·测试·tools
C++ 引擎接口到 mock 的映射(INTERFACE_MAP)第0条(基线)依据=C++ 绑定与注册清单(Luna 机制、全局函数、各服务器 KScriptFuncList、闭源 UI 引擎头文件)加 Lua 使用矩阵(tools/scan_framework_usage.lua,扫描根为 modules/ 与 scripts/,共 2525 个 Lua 文件,20260918 实测)。新增或缺失接口必须先查本表;未实现的必须补入 mock 并登记本表。
slacker-kian15 小时前
大模型·llm·sap·agent·mcp·odata
本地大模型 + 自建 MCP Server + SAP OData:让 LLM 代理 SAP 业务操作本文记录从零搭建「本地 LLM → MCP Server → SAP OData」完整链路的全过程,附带解决方案与完整代码;核心思路:把 SAP OData 的查/改/增/删能力封装成 MCP Tool,LLM 通过 function_call 自然语言调用。
坐吃山猪17 小时前
llm·agent·harness
Harness Engineering知识总结一句话主线:模型能力强 ≠ 执行可靠。Harness(模型之外的一切工程基础设施)决定了模型能力能被发挥多少。遇到失败,先修 harness,再考虑换模型。
桃西西呀19 小时前
人工智能·llm·ai编程
别被"秒回"骗了:推理模型背后那只"吞金兽",吃的是你看不见的预算上个月帮朋友看一笔 API 账单。他用 o3 跑了两万次「把这句话翻译成英文」之类的轻量请求,月底发现输出费用比预期高了不止一个数量级。他第一反应是接口算错了,因为我明明看到每次返回的答案就那么十几个词。
掰头战士19 小时前
typescript·llm·agent
多重影分身!恨不得把一个agent掰成两个? 还真能干!Multi-agent,多么迷人的概念。再也不怕我的agent分身乏术。我的agent能多重影分身出多个子agent,而且个个拥有一样多的查克拉(上下文)。
武子康19 小时前
人工智能·llm·agent
CLAUDE.md 引用 AGENTS.md 后,两边真的读到同一套规则吗?一个团队交替使用 Codex 和 Claude Code。最初,维护者把测试入口、生成目录和提交要求复制到 AGENTS.md 与 CLAUDE.md,各改一次,似乎就完成了兼容。后来测试脚本更名,只更新了前者:同一个修复任务,一边运行新入口,另一边还在寻找旧命令。
武子康20 小时前
人工智能·llm·agent
TP、PP、DP、EP 如何组合:八张卡,怎样淘汰不合适的配置平台版本:vLLM docs.vllm.ai/en/stable 页眉 v0.28.0(并行与扩展 / 基准参数 / 专家并行分层)。资料检查日期 2026-09-08。八卡拓扑、显存预算、SLO、吞吐数字与扩容推导均为作者假设或手算,未进行 GPU 或生产环境验证。
半桶水专家20 小时前
llm
初识 LLM 应用开发Token = LLM 处理文字的基本单位我们平时看到的是:今天天气很好,我想出去散步。但是 LLM 通常不会直接把“字、词、句子”作为最底层输入,而是先经过 Tokenizer(分词器) 把文本拆成 Token。
moMo1 天前
llm
LLM 的 Tool Call:从字符串协议到 LangChain 工具调用用户问“北京天气怎么样”,模型需要先获得天气数据,才能给出有依据的回答。Tool Call 就是把这个需求交给程序执行的一种机制。
小马过河R1 天前
人工智能·语言模型·llm·agent·ai编程·deepagent
开篇|3天从0到1入门AI应用开发AI 应用工程师 · 系列课程15 课 + 收官篇,带你走完 AI 应用工程师成长之路作者:小马过河R · 认知 → 原理 → 基础能力 → Agent 进阶 → 综合实战
liulilittle1 天前
linux·ai·llm·agent·hyper-v·dev·opencode
Linux AI 开发环境搭建实录Windows PowerShell 对 LLM + Agent 的工具调用(Function Calling)和上下文理解并不友好。Unix 标准工具链(grep、awk、sed)的结构化输出更容易被 Agent 调度。因此,选择在 Linux 环境下运行 AI 编程助手。
happy_king_zi1 天前
llm·milvus
Milvus 生产环境部署,优化,日常维护中遇到的问题整个集群由四大层组成,每层独立扩展:黄金法则:nlist = 4 × sqrt(N),nprobe 默认 16-32。