llm

桃西西呀5 小时前
人工智能·llm·agent
GPT-5.6 的 ultra 模式凭什么开 4 个 Agent 并行跑?——多智能体协作,是把"一个聪明人"换成"一个团队"本文从一个你大概率已经遇到的真实场景开始,逐个用事实和数据解决。最后你会发现:2026 年 8 月密集刷屏的 GPT-5.6 ultra(4-Agent 并行)、刚曝光的 OpenAI Astra(多智能体长程协作)、拿下 ARC-AGI-3 满分 的 NVIDIA AVO,踩中的是同一套被低估的原理——单模型的上限,正在被"系统"接管。
澄怀6 小时前
llm·agent
Agent 说「我已经改好文件了」,这句话到底能不能信?用 AI 编程工具的人多半见过这个场面:它一路说得很笃定——「已定位到问题」「已修改 shipping.ts」「测试已通过」——你一看文件,一个字没动。
夫唯不争,故无尤也10 小时前
llm·agent·强化学习·rl·opd
On-Policy Distillation(OPD)和reinforcement (RL)结合你这里说的 OPD,在当前 LLM 后训练 / Agent 语境里,通常指 On-Policy Distillation,在线策略蒸馏。
武子康12 小时前
人工智能·llm·agent
h3.c 的 fast 模式到底删了什么:六个计算轴不能混成一个开关很多推理工具把优化收进一个 fast=true。速度变快后,用户只看到总耗时下降,却不知道程序少算了哪些部分,也不知道画面出错时应该撤回哪个开关。
GoCoding13 小时前
llm·agent
Qwen3.8-27B 部署Qwen3.8-27B 是 Qwen 开源的多模态稠密(Dense)模型,于 2026-08-14 发布。
leeyi14 小时前
llm·aigc·agent
Eino ADK——Agent 的完整生命周期:从创建到中断恢复(第98篇-E84)上一篇 讲了数据库迁移怎么不翻车。但 Agent 本身是怎么跑起来的?创建、执行、工具调用、中断、恢复——这些生命周期节点 Eino ADK 怎么管?
艾莉丝努力练剑16 小时前
c++·人工智能·学习·面试·大模型·llm
【AI大模型接入SDK】Provider分析与实现🎬 艾莉丝的简介:基于 C++ 策略模式实现多大模型统一接入 SDK。需要接入多款大模型(DeepSeek、ChatGPT、Gemini、Ollama 本地模型等),对外提供统一 SDK,上层业务不需要感知底层模型厂商 API 差异。 前期已完成公共数据结构、日志库封装,现在完成模型接入层架构设计。
XLYcmy1 天前
pdf·llm·json·agent·token·csv·dify
PDF论文处理器 - 完整使用指南PDF论文处理器是一个专门为网安科研论文设计的PDF文本分割工具,旨在将英文论文PDF文件转化为Dify知识库可直接使用的高质量数据块。
cuguanren1 天前
人工智能·ai·大模型·llm·agent·上下文管理·会话记忆管理
Agent 框架的会话记忆管理机制会话记忆(上下文管理)是 Agent 从「Demo 玩具」走向「工程可用」的核心能力之一。对应 Agent Loop 的五类演进路径,不同阶段的框架在记忆的存储结构、生命周期、持久化能力、并发隔离等维度呈现出明显的分层差异,整体沿着「线性堆叠 → 结构化状态 → 持久化快照 → 跨会话长效记忆」的路径迭代。
the局外人1 天前
python·langchain·llm
别再背 Chain、Agent、Memory 了:用一条“智能流水线”学会 LangChain适合读者:会写基础 Python,知道 LLM 能对话,但还没有真正用过 LangChain。版本说明:本文按照 LangChain v1 的现行思路编写,示例需要 Python 3.10 或更高版本。旧教程里的 LLMChain、ConversationChain 等已归入 langchain-classic,不要把新旧 API 混着抄。
DigitalOcean1 天前
llm·agent·chatglm (智谱)
GLM 5.3 已上线 DigitalOcean AI 推理云平台:Agent 任务的高性价比底座来了GLM-5.3-Flash 已上线 DigitalOcean AI 推理云平台:3200 亿参数、每 Token 仅激活 180 亿参数,支持 100 万 Token 上下文与原生图像/视频输入。DigitalOcean 调用价格低至每百万输入 Token 0.15 美元,并支持统一 API、多模型路由与模型评估。
QuZhengRong1 天前
人工智能·学习·设计模式·llm·agent
【AI】Agent 全栈进阶|Agent 设计模式通常情况下,Agent 很少能仅靠一轮对话就完成任务,例如排查一个经营问题要查多次数据,做一份调研要分几个方向收集材料。当执行任务的步骤变多时,自然而然就会出现一个问题:任务该怎么推进?
AINative软件工程1 天前
llm
LLM 应用的 Rate Limit 工程实践:令牌桶、滑动窗口与 API 配额管理的生产设计你以为 retry 几次就搞定了限流问题,直到某个高峰夜晚你的服务在大模型 API 429 上抖了整整两小时。
今日无bug1 天前
llm·agent·mcp
MCP 入门实战:Tool 和 LLM 解耦?跨进程跨语言调用工具原来是这么回事你有没有遇到过这样的窘境:用 LangChain 写了一堆 Tool,结果发现只能在当前项目里用?换个项目就得重新拷一遍?更糟糕的是,团队里有人用 Java、有人用 Python,大家的 Tool 完全没法共享?
武子康1 天前
人工智能·llm·agent
拆开 Pi Monorepo:改模型、循环、产品和 UI 时,代码应该放在哪一层团队准备给 Coding Agent 增加一个新 Provider。最省事的做法,是在主应用里直接写认证、请求体转换和流式解析。过两周 Tool Call 格式不兼容,又在同一个目录加一层修补。再过一个月 Web、CLI 和评测都需要这个 Provider,三套实现开始各自演化。
武子康1 天前
人工智能·llm·agent
一次 Agent 失败后,到底该改模型、Prompt 还是 Router?摘要:一条失败 Trace 往往同时暴露模型、Prompt、Router、工具合同和产品逻辑问题。本文给出四步归因顺序,并用 change_candidate 把可推翻的责任面假设、单一主要变化、固定上下文、评测版本和回退门槛绑定在一起。
谢白羽2 天前
笔记·llm·论文·agent·vllm·大模型部署·sglang
SGLang模型加载过程笔记1.如果dp_size大于1 PP = 2 TP = 2 DP = 1因此会创建:2.如果dp_size大于1 DP Controller 根据轮询、当前请求数或 Token 数,把每个请求交给负载较低的模型副本。
xing-xing2 天前
语言模型·llm
AutoDL部署大模型dots.ocr网址:https://www.autodl.com帮助文档: https://www.autodl.com/docs/ssh_proxy/
魔术师Grace2 天前
llm·agent·强化学习
Agent总出错,什么时候才该训练模型?一个电商客服 Agent 上线后,连续出了三种问题:退货政策答成了去年的版本;查询订单时没有调用物流接口;用户要求退款时,它又直接执行了操作。