ai agent

linweidong3 小时前
java·python·大模型·提示词·ai agent·mcp·rag原理
中科闻歌Java面试题及参考答案Java 集合框架整体分为 Collection 与 Map 两大体系,Collection 存储独立单个元素,Map 存储键值对映射关系,面试答题关键点在于区分接口和具体实现类,不能只罗列类名,需要从底层存储结构出发推导性能、特性、线程安全情况,同时区分过时实现类,这部分属于面试加分点,很多面试人员只会背诵类名,忽略底层结构与线程安全带来的取舍。
枫彩6 小时前
python·ai agent·股票数据·mcp
A股数据源怎么选?用 Python 验收 AI 复盘的日期与明细选股票数据源时,很多比较从“覆盖多少接口”开始。我更想先拿到一份实际结果,回答三个问题:它对应哪一天,是否完整,报告里的总数能不能回到明细。
deepseek231 天前
持续集成·ai agent·mcp·llm 评测
从 MCP 工具定义自动生成 Agent 评测集:把可靠性验证接入 CIAgent 评测最容易失真的地方,是用例和真实能力脱节。MCP 工具定义同时描述名称、参数和返回约束,天然是一份机器可读契约。把它作为生成种子,评测就能随接口变化同步更新。每次提交都能留下可追踪差异。这一步让失败可定位。这一步让失败可定位。这一步让失败可定位。这一步让失败可定位。
萧鼎1 天前
人工智能·python·开源·开发工具·ai agent
2026新库实测:sbxloop 1.5.24 让 AI Agent 在 Docker 沙箱中安全自治,告别环境混乱本文面向 Python / AI 开发者,结合 2026年09月 前后的工具与生态变化做一次可落地的盘点。
deepseek232 天前
ai agent·forrester·agent control plane·企业级治理
Agent Control Plane 同构拆解:Forrester 三平面首登分类,KPMG 27.6 万 Agent 部署背书2026 年 6 月 9 日这天,KPMG 与 Microsoft 联合宣布史上企业级 Agent 部署。整张订单覆盖 27.6 万名专业人员,跨审计、税务、咨询三大业务线,由 Microsoft Agent 365 控制面统一接管。这次部署不是市场稿件里的口号,是一份可复制的参考架构。整套架构覆盖 27.6 万专业人员,配齐四大云原生组件。整套架构是 Forrester 2026 Q2 报告里 34 家厂商的唯一典型案例。
deepseek233 天前
python·多模态·ai agent·gemini·视频理解
Google Gemini Agentic Video 上线:88% 少 token 的主动取样如何改写长视频理解那天晚上我对着一段45分钟的项目复盘录像,想找出所有提到数据库迁移的片段。按固定帧率处理,默认每秒取一帧,整段录像会先被拆成2700个画面,再把这些画面送进模型。问题不只在账单,画面变化很小的白板讨论也可能刚好落在两帧之间,模型看见了会议,却没看见真正有用的那几秒。
deepseek233 天前
人工智能·ai agent·mcp
Anthropic开源Commerce Agents:购物与商户智能体如何把审批写进工具链商品搜索、加入购物车、人工付款,在很多电商系统里由不同模块负责。搜索归搜索引擎管,购物车归前端状态管,付款跳到收银台后,前面搜过什么、聊过什么常常就丢了。让顾客重新说一遍,顾客可能直接离开。Anthropic在2026年9月2日发布的Claude Commerce Agents,试着把这条链重新接起来,但它交付的不是一个聊天窗口。
lunzi_08263 天前
ai·金融·开源·供应链安全·ai agent·银行开源治理
【无标题】系列「金融开源治理实战」第一季 · 银行业以下场景根据多个银行项目中的共性问题脱敏合并,不对应任何单一机构。
deepseek233 天前
大模型·ai agent·评测
ARC-AGI-3 评测 harness 效应拆解:GPT-6 Astra 的 99.9% 与 62.7% 之间,隔着一整套测量装置2026 年 9 月 3 日,OpenAI 发布旗舰模型 GPT-6 Astra。训练动用德州 Stargate 基地超过十万张 GPU,是该公司史上规模最大的预训练。总裁 Greg Brockman 在发布会上喊出「欢迎来到 AGI 时代」。同一份发布材料里,ARC-AGI-3 出现了两个相差悬殊的数字:99.9% 与 62.7%。两个分数指向同一个模型,同一天公布,却差了三十七个多百分点,几乎是及格线级别的鸿沟,业界一片哗然。
deepseek233 天前
人工智能·ai agent·mcp
Tenable联合OpenAI做AI Inspector:第三方Agent、Skill与MCP组件如何过供应链验收那天晚上值班,团队从社区接入了一个看起来很实用的模型上下文协议(MCP)服务器。不到二十分钟,大家发现它除了查日志,还在尝试读取本地密钥配置,并向陌生地址发送数据。这个工具没有经过权限核对,也没有在隔离环境里跑过。平台组随后问了一个不太舒服的问题:第三方智能体组件,凭什么可以直接拿到生产凭证。
漂着的圆木4 天前
人工智能·计算机视觉·aigc·ai agent
GLM-5.3-Flash 接入 Agent Loop:图片验收别只查 OCR一张图尺寸正确、没有乱码、文件哈希也对,为什么仍然可能完全不能发?因为这些检查只证明“文件存在且结构正常”,没有证明画面真的符合题目。手握钢笔的图库照片可以没有任何文字,也可以通过尺寸、OCR 和感知哈希检查,但它仍然可能和“模型输出的隐形签名”毫无关系。
漂着的圆木4 天前
分布式·架构·状态模式·ai agent
MCP 2026-07-28 长任务改造:别再用 HTTP 超时判断任务失败一个 Agent 调用工具生成报表,网关在 60 秒时返回超时。此时最危险的处理不是报错,而是客户端立刻重试:前一次报表可能仍在后台生成,第二次请求又启动了一份;如果工具带有扣款、发信或写状态副作用,重复执行会更麻烦。
deepseek234 天前
大模型·openai·ai agent
GPT-6 Astra 发布拆解:Computer Use 产品化时刻、CoT 监控失守与 AGI 契约的终结九月三日夜里,OpenAI 把 GPT-6 Astra 的系统卡、定价页与新闻通话一次性放了出来。没有提前预热,也没有零点倒计时。这家八千五百亿美元估值的公司给新旗舰的头衔是"最智能也最对齐"。两句表述并列出现,点明了本次发布的主基调。能力叙事与安全叙事,第一次被绑进同一个包里出售。
长谷深风1115 天前
大数据·人工智能·ai agent·智能体·工具调用·用户偏好·长期memory
AI 的 Memory 到底该记什么?你告诉 AI:“以后给我的方案尽量简洁一点。”第二天再聊,它还能保持这种风格,你会觉得它“懂你”。但如果你随口说了一句“我今天在上海出差”,半年后 AI 还把这件事当成你的长期状态,体验就会变得奇怪。
DanaAI5 天前
ai agent
端云协同的算力分工:AI硬件平台的架构设计与演进一台耳机要听懂 140 多种语言,一只玩具要陪孩子连续对话,一副眼镜要实时翻译眼前的菜单。这些设备的芯片功耗预算通常只有几瓦甚至不到一瓦,装不下一个大模型。把计算全放云端,一次来回要一两秒。端云协同要解决的,是在这两头之间分派任务:端侧处理离得近、来得快的活,云侧负责算得动、想得深的事。
Akiyama_Mio-Kon6 天前
devsecops·github copilot·ai agent·代码审查·pull request·分支保护
Copilot 现在能批准 PR 了:从“可审”到“可签字”,合并门该怎么重画GitHub 于 2026-09-01 宣布:Copilot Code Review 可以提交 Approve 类型的 PR review,并且在管理员明确开启后,该 approval 可以计入仓库的 merge requirements。它目前是 public preview;管理员须显式开启,企业层的相关策略默认是 Disabled everywhere。企业、组织和仓库都有控制面,仓库还能用最多 15 条文件 glob 限制“哪些 PR 的 Copilot approval 才能计数”。新 comm
circuitsosk6 天前
前端·javascript·python·react.js·llm·ai agent
任务规划器的三种范式对比:ReAct、Plan-and-Execute 与 Tree-of-Thought 在真实业务中的取舍上一篇文章讲 Function Calling,解决的是"模型如何调用工具";但工具再多,没有规划能力,Agent 就只能做"一次调用"的简单问答。真正复杂的业务诉求——“帮我对比三家供应商的报价并生成采购建议”——需要 Agent 自己拆解成多个子任务、决定执行顺序、根据中间结果调整后续步骤。这个"拆解与决策"的过程,就是任务规划。
DanaAI6 天前
ai agent
AI硬件卖出去只是开场:模型迭代与内容运营的成本由谁扛一只会聊天的玩具卖出699元,机芯加包装的成本可能只有80元,硬件毛利看上去很厚。真正的账要从开机之后算起:每一次对话消耗Token,每一次识别调用云端算力,模型要迭代、角色要更新、内容要维护、儿童场景要审核。AI硬件与传统硬件的分界就在这里——产品卖出去只是开场,之后还有一笔长期账单,等着某个环节的人来付。
deepseek236 天前
大模型·ai agent·moe
Kimi K3 开放日拆解:2.8T MoE 的 896 专家稀疏路由、KDA 混合注意力与 Infra 三件套开放日当天,月之暗面把 Kimi K3 的模型权重、技术报告和三个基础设施仓库同时放了出来。我第一时间把权重拉下来,顺手把报告和仓库也一起克隆了,现场拆解会人坐得挺满,周围几位开发者没太关注台上讲了什么,都在低头翻刚公开的模型卡和配置文件。官方公布时间是 2026 年 7 月 27 日,选择这个日子相当于把整个训练家底一次性摊开。
deepseek237 天前
大模型·claude·ai agent
Claude Fable 5.1 深度拆解:推理强度、缓存降价,Agent 工作流成本如何省 45%九月一日晚间,Anthropic 在 Fable 5 发布不到三个月后,突然端出了 Fable 5.1 与 Mythos 5.1。名义上这是小版本迭代,但官方公布的基准测试数据显示,这次升级的幅度远超常规小版本应有的范围。Terminal-Bench-Science 从两成四点七跳到五成二点六,翻了一倍还多。在竞争白热化的大模型市场,这显然不是一次常规迭代。