aigc

Csvn4 小时前
人工智能·aigc·agent
第 14 章 工具增强 Tool AugmentationAgent 的能力边界取决于工具库——工具该设计哪些、怎么让模型正确选择和调用?工具增强(Tool Augmentation)是通过让模型调用外部函数/API,把它的能力从"纯文本推理"扩展到"可计算、可检索、可执行、可写系统"。模型负责"想",工具负责"做"。
月疯5 小时前
aigc
BLIP2的Q-Former原理介绍Q-Former(Querying Transformer)是BLIP-2模型的核心组件,本质是一个轻量级的可训练信息瓶颈。它的主要作用是在冻结(参数不参与训练)的预训练图像编码器和大型语言模型(LLM)之间搭建一座桥梁,实现跨模态的信息对齐与交互。
Dawson Zhu5 小时前
人工智能·语言模型·架构·aigc·agi
Agent 持续进化:从学习信号到参数更新的工程化路径Agent 面临一个鲜明的能力悖论:它可以零样本解决从未见过的复杂任务,却可能在处理了一万次相似任务之后,第二天仍然犯下第一天的错误。能否自主从经验中学习,正在成为 Agent 从"会完成任务"走向"能够可靠工作"的关键能力。本文从学习信号获取、四种更新方式、持续进化闭环以及安全边界等角度,对 Agent 持续进化的工程化路径进行技术分析。
Dawson Zhu6 小时前
人工智能·语言模型·架构·aigc·agi
多模态与实时交互:语音 Agent 与 Computer Use 的架构分析前几章构建的 Agent 与世界的交互是轮流的:用户说完一句,Agent 想一段、调用几个工具,再回一句;在它思考的这段时间里,世界被默认为静止的。这个前提如此自然,以至于很少被当成一个假设写出来。然而真实环境不会等模型作出反应:邮件在思考时到达,用户在说话途中插话,页面在两次截图之间已经变了样。本文围绕模态和触发时机两个维度,对 Agent 交互架构的扩展进行技术分析,涵盖异步事件驱动、语音交互范式、Computer Use 以及机器人操作。
zabr17 小时前
架构·aigc·ai编程
Agent少问你,不代表控制更少故事是这样的。上个月,我用 Claude Code 改一个东西,它每跑一个命令都要问我一次。允许,允许,允许。点到第十几次的时候,我发现自己已经完全不看它要干嘛了,手比脑子快,直接按。
用户75650617861121 小时前
aigc·ai编程
开发 Nemu 的第四天:真实 Beta 如何把一帧判断改造成状态机第三天,Nemu 已经能把钉钉单聊的本地画面变化变成受控候选。但真实 Beta 很快指出一个问题:桌面行为不是一组彼此独立的截图,而是一段有前因后果的连续状态。
弈栈录21 小时前
aigc
上下文管理:如何让 AI 记住用户之前说过的话大语言模型本身并不会永久记住用户。每次调用模型时,应用都需要主动把必要的信息放入本次请求的上下文中,模型才能根据这些信息生成连贯回答。
LadiesAndGentlemen1 天前
人工智能·神经网络·目标检测·自然语言处理·aigc
环球GeoAI-遥感VLM|2026-08-31|More with Less:通用 VLM 不换架构,也能在遥感基准上打平专用模型本期主线问题:遥感 VLM 是不是必须走"专用架构"这条路?最值得先看的是 More with Less——它用通用视觉语言模型 + 多任务强化学习,不新增任何遥感专用模块,就在高分辨率、多时相、多模态、多视角一堆基准上拿到有竞争力的结果,结论直白:对遥感 VLM 来说,数据规模比架构创新更值钱。
杨杨杨大侠1 天前
aigc·openai·ai编程
一次大模型 API 请求是怎么跑起来的:从 Harness 到 GPU、并发与 KV Cache前面聊模型部署时,我一直有一个疑问:一个模型实例明明只有一份模型参数,为什么它可以同时处理很多人的请求?
AI工具测评家1 天前
人工智能·aigc·降重·ai检测·查重·降ai
2026知网维普AIGC检测原理拆解:快降重、笔过AI、快将AI三款降AI工具底层技术对比很多同学找工具降AIGC,只看结果数字,从来不问"为什么能降"。结果就是:同一个工具,别人用了降到5%,自己用了还在25%徘徊;或者这次降下来了,下次学校一复检又弹回去了。
Behavior1 天前
aigc·claude·vibecoding
刚刚,Claude 5.1 发布!全球最强模型来了?2026 年 9 月 1 日,Anthropic 发布了 Claude Fable 5.1 和 Claude Mythos 5.1,官方定位是「world's most advanced models for coding and knowledge work」——编码与知识工作领域最强模型。
wangruofeng1 天前
aigc·agent·ai编程
2000+ 小时实战后,我的 Agentic Engineering 全套装备「精译」译注:作者 David Ondrej 是 AI 效率工具领域的独立创作者,YouTube 频道 @DavidOndrej 的主理人,AI 生产力产品 Vectal 背后的 Vectal Labs 创始人。这是他 2026 年 8 月底发布的「装备清单」:过去 3 年用 AI 写代码超过 2000 小时、访谈过圈内一批最高产的 Agentic Engineer 之后,把当时正在用的整套东西一次交底。文中提到的模型、价格、产品都是 2026 年第三季度的时点信息,两个月后可能就换天,但「怎么选、怎么组合、哪些
wangruofeng1 天前
aigc·ai编程·claude
Claude Fable 5.1 发布,一个模型两种安全档,账单最多省 45%北京时间 9 月 2 日凌晨两点多,我躺在床上正准备睡,手一滑刷到了 Anthropic 的发布帖,一口气两个名字,Claude Fable 5.1 和 Claude Mythos 5.1。
Dawson Zhu1 天前
人工智能·语言模型·架构·aigc·agi
Agent 工具体系:从 MCP 协议到层次化工具发现工具是连接 Agent 语言"大脑"与真实数字世界的"手脚和感官"。本章从五类工具的分类出发,系统讨论了工具设计的通用原则、能力分发渠道(MCP 协议与 Skill Hub),以及当工具数量爆炸时的层次化组织与主动发现机制,最后逐类深入分析了感知、执行、协作三类工具的设计要点。
殷紫川1 天前
aigc
用AI能写出高考满分作文吗?每年高考语文考完,全网都会玩同一个游戏:把作文题原样丢给 AI,比谁写得快、写得好。今年当然也不例外。
虎虎(_ _)。゜zzZ1 天前
mysql·aigc·fastapi·大模型部署·lifespan·python异步
FastAPI-lifespan生命周期管理实战先看老写法:看起来没毛病,用的人也不少。但 Starlette 团队废弃它是有道理的:核心问题:startup 和 shutdown 是两个独立函数,但它们要共享的资源和状态只能挂在全局或 app.state 上。
plainGeekDev1 天前
aigc·ai编程
软件工程术语库·编码与设计篇术语定位:术语 = 你和 AI 的共享词汇表,用公认术语写 prompt 比自造词高效得多。写命令/Skill 时,检查维度用一个「公认术语词」就够(如 Complexity、Duplication),因为 AI 脑子里已经有这些概念——你只需说对术语,它就能调动已有知识去查,比自造词高效。 关键:
leeyi1 天前
前端·aigc·agent
微前端:14 个子应用是怎么做到不散架的——DeepFlux 前端工程拆解(第102篇)第二季第 2 篇。拆解对象:web/ 目录——仓库里模块最多的一个目录。这篇不要求你懂前端框架或构建工具,核心概念会在用到时当场讲。老规矩:只读不改两个仓库,文末有一个跑通的 demo。
全栈弄潮儿1 天前
aigc·openai·ai编程
真实案例:用 AI 快速定位一次代码问题代码出现问题时,很多人会直接把一句“为什么重复提交”发给 AI。这样得到的答案往往是一长串可能性:缓存、网络重试、数据库重复写入、按钮连点、接口幂等……看起来都对,但很难马上解决问题。
AI工具测评家1 天前
人工智能·aigc·降重·ai检测·查重·降ai
2026 知网 & 维普 AIGC 检测底层逻辑解析|快降重 / 笔过 AI / 快将 AI 改写技术差异对比很多同学使用降 AIGC 工具只关心最终检测数字,完全不了解高校审核系统的识别逻辑,改写全凭运气。不同降 AI 工具采用的技术路线天差地别,最终产出的文稿面对 TurnitinAI 检测、知网 AIGC 检测、维普 AI 查重时,结果也会截然不同。