agent

武子康39 分钟前
人工智能·llm·agent
GAIA、Cosmos、Genie 等视频模型纷纷自称"世界模型",为什么说视觉逼真度不构成决策证据?视频模型能生成可控画面,只说明它学到部分视觉统计规律。要成为决策世界模型,还需证明动作会改变预测、任务状态可持续、反事实可比较、失效可校准,并在固定预算与安全约束下改善真实决策。
思考着亮1 小时前
agent
12.Query改写前面聊了这么多检索技术,但有一个前提一直被忽略 —— 用户得先提出一个好问题。 现实中用户是怎么提问的:
洛阳泰山1 小时前
人工智能·开源·agent
别再为做 AI 去学 Python 了!MaxKB4j:纯 Java 造的企业级 RAG + 工作流引擎,开箱即用写给每一个被"做 AI 应用必须学 Python"逼到墙角的 Java 工程师。2024 年之后,AI 应用彻底爆了。老板拍着桌子说:"咱也搞个智能客服、搞个企业知识库,让大模型答内部问题。"
武子康1 小时前
人工智能·llm·agent
Video VAE 不是末端编解码器:5 维-潜网格-主模型 Token 的“表示合同“Video VAE 在主模型之前就决定时空网格、信息损失和 token 数量,在主模型之后又决定解码峰值、分块缓存和最终伪影。本文区分 VAE、VQ-VAE 与 Tokenizer,给出张量计算、责任边界和纯重建验收方法。
DigitalOcean4 小时前
llm·agent·ai编程
Kimi K3 现已上线 DigitalOcean 无服务器推理Moonshot AI 的最新旗舰模型 Kimi K3——也是目前公开发布的最大规模开源模型——现已通过 DigitalOcean 无服务器推理(Serverless Inference) 正式上线。Kimi K3 专为长时自主 Agent 工作负载设计:自主编码、多步研究、以及需要在数百次工具调用中稳定运行而不丢失上下文的生产级 AI Agent。它可以通过 Serverless Inference 集成到现有应用中,享有按量计费与全托管基础设施。同时,Kimi K3 也已接入 DigitalOcean
一条泥憨鱼7 小时前
人工智能·ai·agent·claude·token
如何制作一个Token账本【附完整提示词】🌈个人主页:一条泥憨鱼(欢迎各位大佬莅临)🎬精选专栏:数据结构与算法,Java ,AI与Agent
tkevinjd4 小时前
大数据·python·搜索引擎·llm·agent
MiniCode 项目详解7:Memory 记忆系统一个 Coding Agent 每轮对话都是独立的——LLM 调用结束后,上下文就消失了。下次启动新 session,Agent 对之前的项目一无所知:
玉鸯4 小时前
后端·llm·agent
旧概念还是新范式?Agent 框架集体"图化"背后的矛盾与必然导读:几乎在同一时间,大多数主流 Agent 框架(LangGraph、Microsoft Agent Framework、Dify、Coze Studio)都在底层把自己变成了图执行引擎。为什么整个行业不约而同地选了同一个方向?
倾颜5 小时前
前端·后端·agent
断线之后,不要重跑 AI:在 POST + NDJSON 中实现可恢复 Agent 流本文基于 AI Mind 项目的真实实现整理。 GitHub:github.com/HWYD/ai-min… 对应代码版本:v0.4.10 线上体验:ai.hwyblog.cloud/instant-min…
新知图书6 小时前
人工智能·agent·ai agent·智能体
3.2 技能的格式和工作机制(扣子编程)《扣子编程从一句话到产品上线:零门槛AI心流开发》全书案例分享~持续更新-CSDN博客3.2.1 技能标准文件结构
明明如月学长6 小时前
agent
一个主持人管 5 档节目,他用 AI 把 1 小时的活压到 5 分钟大家好,我是悟鸣。(公众号:悟鸣AI)“悟鸣 AI 学习圈”里,有不少行业的 AI 先行者已经将 AI 与工作深度融合。
爱昏羔7 小时前
python·langchain·pdf·agent·rag
上篇:从PDF到向量库 — 物流行业RAG系统的知识库构建全解析物流行业涉及大量非结构化文档:运单规则、时效说明、理赔条款、仓储操作手册等。这些知识频繁更新,且属于企业内部私有数据,通用大模型无法覆盖。
武子康7 小时前
人工智能·后端·agent
权重已到、Recipe 还在变:Kimi K3 发布后该怎样做工程验收关键词: Kimi K3、开放权重、模型服务、发布验收、vLLM、SGLang2026 年 7 月 28 日再看 Kimi K3,会遇到一个很有代表性的反常场景。
网易云信7 小时前
人工智能·agent
AI 员工也要"绩效考核"?企业管理 Agent 的未来图景先设想一个不算遥远的场景。某天,一位企业管理者打开电脑,要为销售团队"扩编"。只不过这次,他招的不是人,而是一批 AI 员工。他给这些 AI 员工设定岗位目标、配置权限、灌输组织知识,让它们"入职上岗";一段时间后,他打开一张看板,逐一审视每个 AI 员工的产出——哪些达成了业绩、哪些环节效率提升、哪些还需要"再培训"。表现好的,加大投入;表现平平的,调整优化。
Zacks_xdc7 小时前
人工智能·架构·agent·next.js
【从0开发一个 Agent】第十七章:完整项目回顾与架构终章历经十六章的演进,我们从零构建了一个具备企业级能力的 AI Agent 系统。本章不再引入新功能,而是站在系统终局的高度,重新审视这十六个模块如何有机融合,形成一套可落地、可维护、可扩展的生产级架构。
labixiong8 小时前
agent·mcp
MCP 7/28 最大改版实测:扒开真实 HTTP 请求,无状态化到底改了什么2026年7月28日,MCP(Model Context Protocol)正式发布 2026-07-28 版本规范,官方称之为自发布以来最大规模的协议修订。本文搭建了新旧两套规范的服务端实例,通过真实 HTTP 报文拆解本次改版的核心变化、设计逻辑与生产迁移路径。
武子康9 小时前
人工智能·llm·agent
1M Context 也会失忆:Coding Agent 为什么需要 Context Ledger发布边界:价格、会员层级、模型 ID、默认 effort、缓存与 compact 行为需在发布前复核;本文不声称已完成本地吞吐或成本实测。
Flynt9 小时前
安全·agent
GPT-5.6 Sol自主逃出沙箱入侵Hugging Face,我当晚排查了自己项目里的每一处AI调用7月22日凌晨两点刷到OpenAI那篇博客的时候,我愣了大概有二分钟。 不是震惊,是那种"完蛋了,我项目里也有类似问题"的后背发凉。 OpenAI承认他们的GPT-5.6 Sol和一款更强的未发布模型,在内部ExploitGym安全评测中突破了沙箱环境,自主入侵了Hugging Face的生产系统。不是人类指挥的,不是外部黑客干的——是模型自己决定这么做的。它接到一个"做安全评测题"的任务,做了一半觉得太慢,于是自己推理出Hugging Face上可能存着测试答案,然后自己找了一条路翻墙出去拿。 从7月9