技术栈
llm
tachibana2
2 小时前
人工智能
·
ai
·
大模型
·
llm
·
agent
复杂任务怎么做的任务拆分?
摘要:在构建大语言模型(LLM)驱动的自主智能体(Agent)和企业级复杂应用系统时,开发者面临的核心瓶颈往往不是模型基座的单次生成能力,而是面对跨越多个领域、依赖多工具交互、耗时较长的“复杂长链路任务”时系统的崩溃与失控。
tachibana2
2 小时前
人工智能
·
ai
·
大模型
·
llm
·
agent
ReAct、Plan-and-Execute、Reflection 三种范式有什么核心区别
摘要:构建一个稳定、高可用且具备复杂推理能力的智能体(Agent),核心难点不在于大模型(LLM)基座本身,而在于认知控制流与规划执行范式(Cognitive Architecture)的设计。
EDPJ
6 小时前
llm
·
负载均衡
·
大语言模型
·
moe
(2024|DeepSeek & 北大,Loss-Free Balancing,每专家偏置,QB)MoE 的无辅助损失负载均衡策略
论文地址:https://arxiv.org/abs/2408.15664ICLR 2025:https://openreview.net/forum?id=y1iU5czYpE
桃西西呀
1 天前
人工智能
·
llm
·
agent
GPT-5.6 的 ultra 模式凭什么开 4 个 Agent 并行跑?——多智能体协作,是把"一个聪明人"换成"一个团队"
本文从一个你大概率已经遇到的真实场景开始,逐个用事实和数据解决。最后你会发现:2026 年 8 月密集刷屏的 GPT-5.6 ultra(4-Agent 并行)、刚曝光的 OpenAI Astra(多智能体长程协作)、拿下 ARC-AGI-3 满分 的 NVIDIA AVO,踩中的是同一套被低估的原理——单模型的上限,正在被"系统"接管。
澄怀
1 天前
llm
·
agent
Agent 说「我已经改好文件了」,这句话到底能不能信?
用 AI 编程工具的人多半见过这个场面:它一路说得很笃定——「已定位到问题」「已修改 shipping.ts」「测试已通过」——你一看文件,一个字没动。
夫唯不争,故无尤也
1 天前
llm
·
agent
·
强化学习
·
rl
·
opd
On-Policy Distillation(OPD)和reinforcement (RL)结合
你这里说的 OPD,在当前 LLM 后训练 / Agent 语境里,通常指 On-Policy Distillation,在线策略蒸馏。
武子康
2 天前
人工智能
·
llm
·
agent
h3.c 的 fast 模式到底删了什么:六个计算轴不能混成一个开关
很多推理工具把优化收进一个 fast=true。速度变快后,用户只看到总耗时下降,却不知道程序少算了哪些部分,也不知道画面出错时应该撤回哪个开关。
GoCoding
2 天前
llm
·
agent
Qwen3.8-27B 部署
Qwen3.8-27B 是 Qwen 开源的多模态稠密(Dense)模型,于 2026-08-14 发布。
leeyi
2 天前
llm
·
aigc
·
agent
Eino ADK——Agent 的完整生命周期:从创建到中断恢复(第98篇-E84)
上一篇 讲了数据库迁移怎么不翻车。但 Agent 本身是怎么跑起来的?创建、执行、工具调用、中断、恢复——这些生命周期节点 Eino ADK 怎么管?
艾莉丝努力练剑
2 天前
c++
·
人工智能
·
学习
·
面试
·
大模型
·
llm
【AI大模型接入SDK】Provider分析与实现
🎬 艾莉丝的简介:基于 C++ 策略模式实现多大模型统一接入 SDK。需要接入多款大模型(DeepSeek、ChatGPT、Gemini、Ollama 本地模型等),对外提供统一 SDK,上层业务不需要感知底层模型厂商 API 差异。 前期已完成公共数据结构、日志库封装,现在完成模型接入层架构设计。
XLYcmy
2 天前
pdf
·
llm
·
json
·
agent
·
token
·
csv
·
dify
PDF论文处理器 - 完整使用指南
PDF论文处理器是一个专门为网安科研论文设计的PDF文本分割工具,旨在将英文论文PDF文件转化为Dify知识库可直接使用的高质量数据块。
cuguanren
2 天前
人工智能
·
ai
·
大模型
·
llm
·
agent
·
上下文管理
·
会话记忆管理
Agent 框架的会话记忆管理机制
会话记忆(上下文管理)是 Agent 从「Demo 玩具」走向「工程可用」的核心能力之一。对应 Agent Loop 的五类演进路径,不同阶段的框架在记忆的存储结构、生命周期、持久化能力、并发隔离等维度呈现出明显的分层差异,整体沿着「线性堆叠 → 结构化状态 → 持久化快照 → 跨会话长效记忆」的路径迭代。
the局外人
2 天前
python
·
langchain
·
llm
别再背 Chain、Agent、Memory 了:用一条“智能流水线”学会 LangChain
适合读者:会写基础 Python,知道 LLM 能对话,但还没有真正用过 LangChain。版本说明:本文按照 LangChain v1 的现行思路编写,示例需要 Python 3.10 或更高版本。旧教程里的 LLMChain、ConversationChain 等已归入 langchain-classic,不要把新旧 API 混着抄。
DigitalOcean
2 天前
llm
·
agent
·
chatglm (智谱)
GLM 5.3 已上线 DigitalOcean AI 推理云平台:Agent 任务的高性价比底座来了
GLM-5.3-Flash 已上线 DigitalOcean AI 推理云平台:3200 亿参数、每 Token 仅激活 180 亿参数,支持 100 万 Token 上下文与原生图像/视频输入。DigitalOcean 调用价格低至每百万输入 Token 0.15 美元,并支持统一 API、多模型路由与模型评估。
QuZhengRong
2 天前
人工智能
·
学习
·
设计模式
·
llm
·
agent
【AI】Agent 全栈进阶|Agent 设计模式
通常情况下,Agent 很少能仅靠一轮对话就完成任务,例如排查一个经营问题要查多次数据,做一份调研要分几个方向收集材料。当执行任务的步骤变多时,自然而然就会出现一个问题:任务该怎么推进?
AINative软件工程
2 天前
llm
LLM 应用的 Rate Limit 工程实践:令牌桶、滑动窗口与 API 配额管理的生产设计
你以为 retry 几次就搞定了限流问题,直到某个高峰夜晚你的服务在大模型 API 429 上抖了整整两小时。
今日无bug
2 天前
llm
·
agent
·
mcp
MCP 入门实战:Tool 和 LLM 解耦?跨进程跨语言调用工具原来是这么回事
你有没有遇到过这样的窘境:用 LangChain 写了一堆 Tool,结果发现只能在当前项目里用?换个项目就得重新拷一遍?更糟糕的是,团队里有人用 Java、有人用 Python,大家的 Tool 完全没法共享?
武子康
2 天前
人工智能
·
llm
·
agent
拆开 Pi Monorepo:改模型、循环、产品和 UI 时,代码应该放在哪一层
团队准备给 Coding Agent 增加一个新 Provider。最省事的做法,是在主应用里直接写认证、请求体转换和流式解析。过两周 Tool Call 格式不兼容,又在同一个目录加一层修补。再过一个月 Web、CLI 和评测都需要这个 Provider,三套实现开始各自演化。