ai agent

doiito16 小时前
rust·系统设计·ai agent
【Agent Harness】流马(Gliding Horse)DeepSeek Responses API 接入介绍Commit: 4391ba3 — update Responses API support 日期: 2026-08-04 范围: src/gateway/unified_gateway.rs、src/llm/sse.rs、src/config/settings.rs、apps/gliding_code/src/config.rs、config.yaml 及测试适配
暗黑小白21 小时前
大模型·ai agent
LLM 业务级可观测monitoring-agent 说全绿,用户却炸了:redis / postgres / 网关都活着,但本月 LLM 账单翻三倍,且回答质量肉眼下滑。组件级健康监控(《系统健康监控巡检》)管不了"业务维度"的健康——组件活着 ≠ 服务健康。
大龄码农有梦想21 小时前
人工智能·机器学习·ai agent·智能体·ai工作流·智能体平台
AI Agent 目前最大的瓶颈是什么?过去两年,AI Agent 的能力曲线涨得非常快。它们能写代码、查资料、调用业务 API、操作浏览器,也能把一个模糊目标拆成几十个步骤连续执行。
暗黑小白1 天前
后端·ai agent
脱敏引擎工程化《合规护栏》把所有 PII 落点接到同一套脱敏引擎后,这个引擎就成了全系统的统一依赖——它的形态、加载方式、启动依赖、故障行为直接决定"防护层会不会成为新的单点故障"。
deepseek231 天前
大模型·openai·ai agent
GPT-5.6 Luna 降价 80%:从 24% 到 90% 的缓存命中率,OpenAI 的价格战打在了工程层2026 年 7 月 30 日,OpenAI 宣布 GPT-5.6 系列 API 调价。最轻量的 Luna 输入价格从每百万 token 一美元降到零点二美元,输出价格从六美元降到一点二美元,降幅百分之八十。
暗黑小白2 天前
ai agent
LLM 流量网关团队有三个服务(shop-agent / gateway / monitoring-agent),每个都在调 LLM。有一天老板问:“上个月 LLM 花了多少钱?”——没人答得上来,因为三个服务各调各的,账单分散在阿里云、Azure、Bedrock 三个供应商后台。这还不是最糟的:一次客服请求里 shop-agent 内部要调 3 次 LLM + 1 次 embedding,如果直连供应商,限流、脱敏、成本计量全漏。我们需要一道闸口,把所有 LLM 流量收敛到一处。
暗黑小白2 天前
后端·python·ai agent
路由策略与引擎可替换性同一套业务代码,dev 环境用本地 Ollama 跑小模型,prod 环境用阿里百炼的 Qwen 大模型,怎么零改动切换?答案是:业务不该知道后端是谁——这个决策由网关一层统一完成。
暗黑小白2 天前
大模型·ai agent
自动操作回复与自愈闭环能否让系统自己把 redis 重启了,而不是凌晨叫醒人?能,但前提是「安全边界」先设计好,否则自动化会放大故障。
CaspianSea2 天前
ai agent
配置 Claude Code for VS + Deepseek1.在 VS code 的extension里安装 Claude code2. 安装 cc-switch,在里面配置 deepseek
海市公约2 天前
ai agent·planandexecute·智能体开发·react 架构·大模型工具调用·大模型推理机制
AI Agent 核心:ReAct 机制原理、缺陷与 Plan-and-Execute 解决方案面试详解很多面试者对 ReAct Agent 存在理解误区,分不清模型和代码各自承担的职责。本文拆解 ReAct 完整运行流程,剖析它的两大工程缺陷,对比 Plan-and-Execute 优化方案,贴合面试答题逻辑,帮你精准吃透 Agent 推理架构。
只是甲3 天前
人工智能·text2sql·nl2sql·ai agent·自助数据分析·data agent·agentic 数据洞察
Text2SQL 系列博客 02:技术原理深度剖析 - 从自然语言到 SQL 的完整链路系列目录(共 15 篇):关键词:Text2SQL 技术原理、NL2SQL 链路、Schema Linking、SQL 生成、SQL 校验、意图识别、实体抽取、向量检索
deepseek233 天前
ai agent·开源模型·ai act
欧盟 AI Act 明天开罚:10^25 FLOP 红线与开源豁免,你的模型在不在射程内?2026 年 8 月 2 日,欧盟委员会对通用人工智能模型提供者的执法权正式生效。从这一天起,AI 办公室不再只是发指南、开研讨会的咨询机构——它有权对不合规的模型提供者开出罚单,金额最高可达 1500 万欧元或全球年营业额的 3%,取两者中较高者。对很多中国开发者来说,这条新闻的第一反应是"跟我没关系,我又不在欧盟"——但 AI Act 的管辖逻辑是"投放欧盟市场",不是"注册地在欧盟"。你的模型只要在 Hugging Face 上开放下载、你的 API 只要对欧洲用户开放,你就已经在射程之内。
lincats3 天前
ai·ai agent·vibe coding·claude code
Caveman vs Ponytail:AI 编程圈"懒人哲学"两大门派正面交锋一个把 Agent 的嘴缝小,一个把 Agent 的手管住。都叫"懒",一个省 token,一个省代码。走向截然不同,却意外互补。
deepseek233 天前
人工智能·ai agent·mcp
750 亿参数只激活 37 亿:LG 开源 K-EXAONE 2.0,与 DeepSeek 的路线之争迎来新玩家7 月 31 日,LG AI 研究院在 Hugging Face 上放出了 K-EXAONE 2.0 的完整权重,三个数字在开源圈迅速传开:750B 总参数、37B 激活参数、Apache 2.0 许可证。这是韩国迄今规模最大的 AI 基础模型,总规模是初代 K-EXAONE(236B/23B)的 3 倍以上,而激活率从初代的 9.7% 一路压到 4.9%——比 DeepSeek-V3 的 671B/37B(激活率 5.5%)更狠。同一天,美国商务部对 Anthropic 模型的出口管制风波尚未平息,韩国
新知图书3 天前
人工智能·agent·ai agent·智能体
2.3 开发工作流《扣子编程从一句话到产品上线:零门槛AI心流开发》全书案例分享~-CSDN博客2.3.1 AI编程开发工作流
MatrixOrigin4 天前
人工智能·深度学习·ai-native·ai agent·矩阵起源·matrix origin
MatrixOne Git4Data 技术详解(十)·深度学习篇:训练数据怎么管——lakeFS 管文件,MatrixOne 管元数据前面九篇一直在结构化数据上打转:前四篇讲清了 Git4Data 是什么、怎么用、和其他方案分别站在哪一层;第五到第七篇是数据运维;第八、九篇进入 AI 训练,用一个风控模型走通了全流程总图和数据集发布与泄漏。
三无推导5 天前
人工智能·开源·github·ai agent·工具调用·mcp·多agent协作
读了一遍 GitHub 上 12K Star 的 AI Agent 开源书去年年底,LLaMA 的老板说 2025 年是 AI Agent 元年。我当时觉得他在画饼。然后项目就来了。
码哥字节5 天前
ai agent·mcp"·mcp server开发
改了20字描述,MCP工具调用准确率飙到85%你有没有遇到过这种情况——花了一个周末写好 MCP Server,三个工具跑得飞起。丢给 Claude Code 用,结果 AI 全程不调用你的工具。查阅日志,发现它宁可自己编答案,也不碰你精心写好的接口。
lincats5 天前
ai·ai agent·vibe coding·claude code·skills
/handoff,只有几行,却是Matt Pocock调用频率最高的 skill和 Claude Code 对话时,每一次工具调用、每一次文件编辑,都往上下文窗口里塞 token。窗口确实大——厂商说 100 万 token——但好用程度不是均匀的。聊到后半段,它开始忘记你半小时前说过的话,给出的方案越来越敷衍。
大龄码农有梦想6 天前
人工智能·私有化部署·数据安全·信创·ai agent·智能体·智能体开发平台
使用大模型服务如何保证数据安全?企业 AI 安全、私有化部署与治理实践企业可以使用大模型服务,但前提是先把“哪些数据能出域、哪些数据不能出域、哪些调用必须审计”说清楚。真正可落地的做法不是简单禁止员工使用 AI,也不是把所有数据一股脑发给公有云模型,而是建立一套分级、脱敏、路由、权限、日志和私有化部署结合的 AI 安全治理体系。