技术栈
llm
桃西西呀
5 小时前
人工智能
·
llm
·
agent
GPT-5.6 的 ultra 模式凭什么开 4 个 Agent 并行跑?——多智能体协作,是把"一个聪明人"换成"一个团队"
本文从一个你大概率已经遇到的真实场景开始,逐个用事实和数据解决。最后你会发现:2026 年 8 月密集刷屏的 GPT-5.6 ultra(4-Agent 并行)、刚曝光的 OpenAI Astra(多智能体长程协作)、拿下 ARC-AGI-3 满分 的 NVIDIA AVO,踩中的是同一套被低估的原理——单模型的上限,正在被"系统"接管。
澄怀
6 小时前
llm
·
agent
Agent 说「我已经改好文件了」,这句话到底能不能信?
用 AI 编程工具的人多半见过这个场面:它一路说得很笃定——「已定位到问题」「已修改 shipping.ts」「测试已通过」——你一看文件,一个字没动。
夫唯不争,故无尤也
10 小时前
llm
·
agent
·
强化学习
·
rl
·
opd
On-Policy Distillation(OPD)和reinforcement (RL)结合
你这里说的 OPD,在当前 LLM 后训练 / Agent 语境里,通常指 On-Policy Distillation,在线策略蒸馏。
武子康
12 小时前
人工智能
·
llm
·
agent
h3.c 的 fast 模式到底删了什么:六个计算轴不能混成一个开关
很多推理工具把优化收进一个 fast=true。速度变快后,用户只看到总耗时下降,却不知道程序少算了哪些部分,也不知道画面出错时应该撤回哪个开关。
GoCoding
13 小时前
llm
·
agent
Qwen3.8-27B 部署
Qwen3.8-27B 是 Qwen 开源的多模态稠密(Dense)模型,于 2026-08-14 发布。
leeyi
14 小时前
llm
·
aigc
·
agent
Eino ADK——Agent 的完整生命周期:从创建到中断恢复(第98篇-E84)
上一篇 讲了数据库迁移怎么不翻车。但 Agent 本身是怎么跑起来的?创建、执行、工具调用、中断、恢复——这些生命周期节点 Eino ADK 怎么管?
艾莉丝努力练剑
16 小时前
c++
·
人工智能
·
学习
·
面试
·
大模型
·
llm
【AI大模型接入SDK】Provider分析与实现
🎬 艾莉丝的简介:基于 C++ 策略模式实现多大模型统一接入 SDK。需要接入多款大模型(DeepSeek、ChatGPT、Gemini、Ollama 本地模型等),对外提供统一 SDK,上层业务不需要感知底层模型厂商 API 差异。 前期已完成公共数据结构、日志库封装,现在完成模型接入层架构设计。
XLYcmy
1 天前
pdf
·
llm
·
json
·
agent
·
token
·
csv
·
dify
PDF论文处理器 - 完整使用指南
PDF论文处理器是一个专门为网安科研论文设计的PDF文本分割工具,旨在将英文论文PDF文件转化为Dify知识库可直接使用的高质量数据块。
cuguanren
1 天前
人工智能
·
ai
·
大模型
·
llm
·
agent
·
上下文管理
·
会话记忆管理
Agent 框架的会话记忆管理机制
会话记忆(上下文管理)是 Agent 从「Demo 玩具」走向「工程可用」的核心能力之一。对应 Agent Loop 的五类演进路径,不同阶段的框架在记忆的存储结构、生命周期、持久化能力、并发隔离等维度呈现出明显的分层差异,整体沿着「线性堆叠 → 结构化状态 → 持久化快照 → 跨会话长效记忆」的路径迭代。
the局外人
1 天前
python
·
langchain
·
llm
别再背 Chain、Agent、Memory 了:用一条“智能流水线”学会 LangChain
适合读者:会写基础 Python,知道 LLM 能对话,但还没有真正用过 LangChain。版本说明:本文按照 LangChain v1 的现行思路编写,示例需要 Python 3.10 或更高版本。旧教程里的 LLMChain、ConversationChain 等已归入 langchain-classic,不要把新旧 API 混着抄。
DigitalOcean
1 天前
llm
·
agent
·
chatglm (智谱)
GLM 5.3 已上线 DigitalOcean AI 推理云平台:Agent 任务的高性价比底座来了
GLM-5.3-Flash 已上线 DigitalOcean AI 推理云平台:3200 亿参数、每 Token 仅激活 180 亿参数,支持 100 万 Token 上下文与原生图像/视频输入。DigitalOcean 调用价格低至每百万输入 Token 0.15 美元,并支持统一 API、多模型路由与模型评估。
QuZhengRong
1 天前
人工智能
·
学习
·
设计模式
·
llm
·
agent
【AI】Agent 全栈进阶|Agent 设计模式
通常情况下,Agent 很少能仅靠一轮对话就完成任务,例如排查一个经营问题要查多次数据,做一份调研要分几个方向收集材料。当执行任务的步骤变多时,自然而然就会出现一个问题:任务该怎么推进?
AINative软件工程
1 天前
llm
LLM 应用的 Rate Limit 工程实践:令牌桶、滑动窗口与 API 配额管理的生产设计
你以为 retry 几次就搞定了限流问题,直到某个高峰夜晚你的服务在大模型 API 429 上抖了整整两小时。
今日无bug
1 天前
llm
·
agent
·
mcp
MCP 入门实战:Tool 和 LLM 解耦?跨进程跨语言调用工具原来是这么回事
你有没有遇到过这样的窘境:用 LangChain 写了一堆 Tool,结果发现只能在当前项目里用?换个项目就得重新拷一遍?更糟糕的是,团队里有人用 Java、有人用 Python,大家的 Tool 完全没法共享?
武子康
1 天前
人工智能
·
llm
·
agent
拆开 Pi Monorepo:改模型、循环、产品和 UI 时,代码应该放在哪一层
团队准备给 Coding Agent 增加一个新 Provider。最省事的做法,是在主应用里直接写认证、请求体转换和流式解析。过两周 Tool Call 格式不兼容,又在同一个目录加一层修补。再过一个月 Web、CLI 和评测都需要这个 Provider,三套实现开始各自演化。
武子康
1 天前
人工智能
·
llm
·
agent
一次 Agent 失败后,到底该改模型、Prompt 还是 Router?
摘要:一条失败 Trace 往往同时暴露模型、Prompt、Router、工具合同和产品逻辑问题。本文给出四步归因顺序,并用 change_candidate 把可推翻的责任面假设、单一主要变化、固定上下文、评测版本和回退门槛绑定在一起。
谢白羽
2 天前
笔记
·
llm
·
论文
·
agent
·
vllm
·
大模型部署
·
sglang
SGLang模型加载过程笔记
1.如果dp_size大于1 PP = 2 TP = 2 DP = 1因此会创建:2.如果dp_size大于1 DP Controller 根据轮询、当前请求数或 Token 数,把每个请求交给负载较低的模型副本。
xing-xing
2 天前
语言模型
·
llm
AutoDL部署大模型dots.ocr
网址:https://www.autodl.com帮助文档: https://www.autodl.com/docs/ssh_proxy/
魔术师Grace
2 天前
llm
·
agent
·
强化学习
Agent总出错,什么时候才该训练模型?
一个电商客服 Agent 上线后,连续出了三种问题:退货政策答成了去年的版本;查询订单时没有调用物流接口;用户要求退款时,它又直接执行了操作。