llm

阿弱1 小时前
后端·llm·agent
pi 扩展机制:加载、执行与能力pi 的扩展系统解决一个问题:把 agent 内部流程以事件形式暴露出来,让外部代码能观察、拦截、修改它的行为。Claude Code 这类 agent 默认是黑盒——你不知道它中途改了哪些文件、跑了哪些命令、每一轮花了多少 token、有没有切模型。pi 的做法是给一套扩展机制,把内部流程白盒化,挂回调就能拿到这些信息。
vivo互联网技术3 小时前
深度学习·计算机视觉·llm
Octopus:基于无历史数据的梯度正交化的学习框架|CVPR 2026作者: vivo BlueImage Lab 本文入选 CVPR 2026 CVPR(IEEE Conference on Computer Vision and Pattern Recognition)IEEE国际计算机视觉与模式识别会议,主要内容是计算机视觉与模式识别技术。CVPR 2026约160920篇投稿,接收率约25.42%。
leeyi4 小时前
llm·aigc·agent
Langfuse 集成源码:batch 协议、media 上传与 mock 测试(第89篇-E75)上一篇站在使用者视角把行车记录仪装上了:handler 翻译切面、队列攒批、四道工序。这篇下到桥接层最底下——libs/acl/langfuse 这个不含任何 Eino 概念的纯 HTTP 客户端库,回答三个出门前才需要想的问题:
修远客4 小时前
llm·agent
风格进化:让Agent越来越懂你 — 从"工具"到"助手"的关键跃迁没有风格进化的 Agent,用 100 次和用 1 次没区别 — 每次都是"第一次见面"。风格进化让 Agent 从"一次性工具"变成"越用越懂你的助手"。 这是 Agent 最有"Agent 味"的能力 — 不是开发者写死的规则,是 Agent 从用户行为中自己学到的偏好。
武子康5 小时前
人工智能·llm·agent
Pi Extension 写完不等于可用:从类型检查到真实 Runtime 的证据阶梯本文用一个 Context Audit Extension 展示 Pi Tool、Command、Event 与 UI Status 的职责, 并给出来源契约、官方类型检查、注册与 Mock、真实 Runtime、TUI/模型路径、生产安全六层 证据阶梯。文中真实验证到 Pi v0.82.1 RPC 加载、/audit 发现与执行、 context_audit 进入活动工具面;未把 TUI、模型自主调用或生产安全写成已通过。
一只积极向上的小咸鱼6 小时前
算法·llm
分词器tokenizer笔记12将原始文本转化为模型理解的数字序列 LLM负责“理解和生成”,而tokenizer负责“把语言变成模型能理解、可复用的格式” 分词器会影响模型能力:token划分得太“碎片化”或太“笼统”,都会影响表达效率; 所以:
AINative软件工程6 小时前
后端·llm·ai编程
LLM Token Budget 工程实践:给每个请求设上限,让成本和质量都在掌控中我们的 AI 总结功能上线第三天,成本告警炸了。复盘之后发现:有几条用户上传的长文档,每次请求的输出 token 数超过 4000,而我们并没有设置任何 max_tokens 限制。模型默认往长了生成,单次请求成本是预期的 6 倍。更糟的是,有个 Agent loop 在某个工具返回异常数据后开始反复重试,三分钟消耗了我们一天的 token 配额。
XLYcmy1 天前
深度学习·llm·sgd·adam·deepseek·mla·adamw
小红书 算法一面 八# DeepSeek R1的MLA:KV缓存的低秩压缩革命MLA(Multi-Head Latent Attention,多头潜在注意力)是DeepSeek R1前3层采用的核心创新机制,其**通过低秩联合压缩技术将KV缓存大小降低90%以上**,同时保持与标准多头注意力(MHA)相当的性能,为长上下文推理与高吞吐量部署提供了关键支撑。
魔术师Grace20 小时前
llm·agent
大模型到底怎么分类?从“聊天模型”走到 Agent 模型选型我有个前同事做 Java 开发的,最近被迫转行做 Agent 开发,他们公司要求不转型就拜拜,所以也只能硬着头皮上了,每天晚上都跟打了鸡血一样要找我聊五块钱的~
XLYcmy1 天前
llm·transformer·encoder·decoder·自注意力·deepseek·深度思考
小红书 算法一面 七Transformer 编码器(Encoder)的**多头自注意力(Multi-Head Self-Attention)**与解码器(Decoder)的**掩码多头自注意力(Masked Multi-Head Self-Attention)**,核心差异源于两者的任务目标不同:**Encoder 负责“理解输入序列的全局语义”,需双向关注所有 token;Decoder 负责“生成连贯的输出序列”,需单向关注已生成的 token,防止泄露未来信息**。
京东云开发者1 天前
llm·agent
让AI真正参与工作!JoyDesk已上线京东云大模型正加速走向产业应用,AI也正在从“回答问题”迈向“完成任务”。越来越多企业开始将AI应用到研发、办公、营销、运营等业务场景。然而,工具分散、知识难沉淀、业务系统割裂,以及安全治理不足等问题,成为AI价值落地的瓶颈。企业需要的不只是一个AI工具,而是一个能够真正参与工作的AI平台。
张彦峰ZYF1 天前
人工智能·llm·agent·langgroup·self-correction
LangGraph Self-Correction:让 AI 自己改 Bug目录一、Self-Correction 到底解决什么问题?二、先别急着让 LLM 判断:验证要分层(一)整体代码展示说明
程序猿DD1 天前
llm·agent
OctaFuse Gateway 2.6.0:完善 Vertex AI 鉴权、图片计费与日常调试OctaFuse Gateway 2.6.0 重点完善项目级 Vertex AI 的服务账号鉴权与文生图计费,让供应商接入、分时定价和异常请求扣费更明确、更容易核验。
用户458562068231 天前
llm
DeepSeek-Harness部署踩坑DeepSeek-Harness(简称dsh)是DeepSeek推出的本地网页调试工具,方便对各类大模型API进行对比调试。
leeyi1 天前
llm·aigc·agent
Langfuse 接入:给 Agent 加“行车记录仪“(第88篇-E74)上一篇把 Eino 的切面机制拆完了:一个 16 行的高阶函数包装,加一个挂在 ctx 里的注册表。机制有了,这篇把它用起来——接 Langfuse,给 Agent 装一台"行车记录仪":每次 LLM 调用的输入、输出、token 数、耗时、报错,全部录下来,出事故了倒回去看。
今日无bug1 天前
node.js·llm·agent
Tool Use 工具调用 —— 让LLM缸中大脑突破物理限制的3个阶段你用豆包让它自动搜网页、用 Claude 让它分析 Excel、用 AI Agent 操作电脑…… 你以为 AI 真的有自我意识?
众人皆醒我独醉1 天前
面试·llm·gpu
MLOps 流水线:从训练到推理的 CI/CDAI 加速器系列 · 第 8 篇软件部署错了回滚一个二进制就行。模型部署错了——精度下降 3%,错误率翻倍——你不知道问题出在数据、训练代码、还是模型本身。MLOps 管的不是一个 artifact,是三个。
shepherd1111 天前
人工智能·llm·ai编程
国产模型越来越强了:DeepSeek V4、Kimi K3 与 GLM 最新进展这是《ALL IN AI》专栏的第三篇文章,想和大家聊聊近期国产模型的最新进展。坦白说,我原本没打算写这种偏资讯盘点的文章。单纯追踪模型更新,对个人能力提升的帮助其实比较有限。不过,最近两个月国产模型发展得很快,有些小伙伴可能因为工作忙,或者平时没有关注这个领域,错过了不少重要变化。更主要的原因是,下一篇我准备介绍 Claude Code 和 Codex 如何接入国产模型。在开始具体操作之前,有必要先把 DeepSeek、Kimi 和 GLM 最近发生了什么梳理清楚,也算是为后面的实操教程做个铺垫
武子康1 天前
人工智能·llm·agent
Project Trust 不是 Sandbox:Pi Agent 的安全边界怎样补齐你克隆了一个陌生仓库,Pi 启动时询问是否信任项目。选择“不信任”,是不是就可以放心让 Agent 读代码、跑测试?选择“信任”以后,是不是意味着项目已经通过安全检查?
武子康1 天前
人工智能·llm·agent
DeepSeek Harness:Subagent、Job、Goal 都叫任务,为什么不能混成一个对象“让另一个 Agent 查资料”“把命令放到后台跑”“继续做,直到目标完成”,在人看来都像是在创建任务。