技术栈
llm
lucas_AI
4 分钟前
llm
把提示词「编译」成函数:Compile by Training 让大模型退居二线
写程序的时候,你有没有遇到过这种函数:规则代码写起来又臭又长,改一个条件就崩;直接调大模型又贵又慢,每调一次都像在点外卖?
修远客
9 分钟前
llm
·
agent
·
ai编程
持久化与缓存:Agent的数据底座 — 没有持久化的Agent像金鱼记忆,重启就忘
早期 self-media-agent 只有内存存储 — 所有人设、选题、生成内容全放在进程内的 dict 里。跑得好好的,但一重启,全没了。辛苦配置的人设、攒了几十天的选题、生成的内容,全归零。
武子康
32 分钟前
人工智能
·
llm
·
agent
同一份长文问两次,SGLang 怎样少算一遍
给模型一份长文,先问“付款条件是什么”,再问“违约责任有哪些”。第二次的问题变了,文档没有变。模型还要把整份文档从头处理一遍吗?
张彦峰ZYF
2 小时前
人工智能
·
架构
·
llm
·
agent
·
skill
·
agent memory
·
tencentdb
从“记住对话”到“经营组织经验”:TencentDB Agent Memory 的团队级记忆架构、工程取舍与企业落地边界
目录一、Agent 记忆为什么正在从“附加功能”变成基础设施(一)长上下文解决的是容量问题,不是记忆治理问题
AINative软件工程
2 小时前
前端
·
llm
编程
凌晨 2:47,某电商团队的 AI 选品功能开始批量出错。告警日志里满是 null——不是程序崩了,是 LLM 返回了一个合法的 JSON,字段都在,但值全是空字符串。
2601_96238186
15 小时前
llm
·
代码生成
·
工具调用
·
agent框架
·
python-use
基于Python-use范式的开源Agent
相较于其他, 传统 Agent 框架, 更像是那种, 借助低代码拖拽方式的设施, 也就是「机器人编排器」。
程序员于老七
17 小时前
llm
漫话大模型:同一个模型,换台机器效果就不同?——推理引擎这个隐形选手
你有没有遇到过这种情况:同一份模型权重,部署到 A 机器上跑得好好的,换到 B 机器上,回答质量明显下降——逻辑变差、输出乱码、甚至直接崩溃。
liulilittle
19 小时前
ai
·
llm
·
prompt
·
agent
·
tools
·
subagent
·
opencode
为什么需要回程闲置保护?
对象:opencode-goal 插件的子代理静默死亡巡检(sweep_idle_children + prompt_sent_at 登记)。本文讲清它为什么存在、为什么只能是现在的形状——每一个"只能",背后都是一次真机事故。
七牛开发者
20 小时前
chatgpt
·
llm
·
agent
HarnessDev:让 LLM 自己创建并迭代 Agent Harness
上周字节跳动 Seed 团队联合新加坡科技设计大学、佐治亚理工等机构发布了 HarnessDev,研究一个和 Agent 工程相关的问题:LLM 能不能自己创建 Agent Harness,并根据后续任务的运行反馈持续修改这套 Harness。
桃西西呀
21 小时前
人工智能
·
机器学习
·
llm
红酒标签上的 87 分是怎么算出来的?我拿 1599 瓶真酒把线性回归和逻辑回归拆开讲
上周朋友发来一张酒标照片,上面印着 87 分。他问我,这分数到底谁给的,凭什么这瓶 87、那瓶 90。我第一反应是,评分这东西看着主观,但背后一定有 measurable 的东西:酒精度、酸度、糖分、二氧化硫,这些理化指标和专家打分之间,到底有没有一条能写出来的关系。
uncle_ll
1 天前
llm
·
agent
·
codex
·
workbuddy
从 localStorage 到 Chrome 商店:一个 HTML 文件的 7 次重构
本文记录了使用 WorkBuddy 从零构建一个健康打卡 + 记账工具的完整过程。起点是一个单文件 HTML,终点是打包提交 Chrome Web Store。中间被 7 个坑逼着重构了 7 次——每个坑的根因都不一样,但有一个共同点:踩之前看不出来,踩完之后都觉得"这我怎么不知道"。
武子康
1 天前
人工智能
·
llm
·
agent
9/10 和 900/1000 都是 90%:机器人成功率计算器必须阻止的误判
摘要:9/10 与 900/1000 的点估计都是 90%,但 95% Wilson 区间宽度约相差十倍。本文把分母、独立与配对设计、精度与功效、数值失败和 URL 分享边界写成一份 fail-closed 的成功率计算器合同。
武子康
1 天前
人工智能
·
llm
·
agent
第一次用 SGLang:把本地模型接进聊天应用
你已经有一个聊天页面,后端也会调用 /v1/chat/completions。现在想把远程模型换成自己机器上的模型,卡住的地方通常很具体:权重下载完了,谁来把它变成一个能接请求、能连续返回文字的服务?
Web极客码
1 天前
服务器
·
人工智能
·
ai
·
llm
Pydantic 校验通过不等于答案正确:如何识别 LLM 的语义错误
本地测试时,结构化输出最容易给人一种“问题已经解决”的错觉:模型返回 JSON,解析器没有报错,Pydantic 模型实例化成功,数据库也顺利写入。真正上线一段时间后,团队才发现其中有些记录虽然格式完美,业务含义却不成立。
流浪001
1 天前
开发语言
·
人工智能
·
llm
大模型技术全景(六):AI 的“逐字接龙“——Token 与自回归生成背后的真相
你有没有好奇过:大模型回答问题时,是像人一样"想好整句话再写",还是别的方式?答案是——它根本不会先想好整句话。它是像一个"逐字接龙"游戏:根据已经写下的内容,一个字一个字地猜下一个最可能出现的词,直到写完。
米小虾
2 天前
人工智能
·
llm
告别逐 token 蹦字:扩散语言模型(dLLM)到底能不能终结自回归?
自回归统治了 NLP 整整八年。它有一个无法绕开的物理缺陷:必须一个 token 一个 token 地蹦。
米小虾
2 天前
人工智能
·
llm
一周 AI 观察(9.1–9.7):模型能力开始"过剩",行业真正卷的是落地
这一周,AI 行业同时发生了三件看起来毫不相干的事:OpenAI 发布了一个"太危险所以不敢全开"的模型;AI 短剧的制作报价半个月跌了九成;一家短视频公司借了 296 亿美元。
AI技术新视界
2 天前
人工智能
·
llm
·
agi
符号诞生之前:视觉通用智能如何开启 AGI 的物理进化之路
由全球多家顶尖学术机构、科研高校以及前沿工业界实验室共同合作发表名为《Visual General Intelligence: Pathways and Perspectives in the AGI Era》白皮书,它探讨了视觉通用智能(VGI)作为实现通用人工智能(AGI)潜在路径的可能性。研究者们认为,视觉模态不仅是传感器输入,更是捕捉世界结构的核心智能功能,其演化历史远早于语言。文中提出了多种观点,包括将生成式视频模型视为视觉基础模型,以及强调具身智能在物理世界中感知与行动的重要性。不同于目前的语
AI技术新视界
2 天前
人工智能
·
llm
·
认知科学
失控的认知外包:大语言模型如何像病毒般入侵人类思维与社会生态
西班牙、意大利和美国多个研究机构将大语言模型(LLM)的扩散视为一种“认知病毒”,通过流行病学模型探讨其在人类群体中的传播及其对认知自主性的影响。研究指出,LLM的使用可能引发非线性集体转型,即一旦普及程度超过临界点,社会将从自主思考快速转向技术依赖。这种转型伴随着认知外包现象,即人类将推理、验证和创作等职能外包给机器,可能导致认知能力的显著下降。作者强调了技术锁定的风险,认为这种过程具有不可逆性,即预防依赖比事后纠正要容易得多。然而,该框架也提出了“认知免疫”策略,建议通过强化独立思考实践和维持非辅助的
打破砂锅问到底007
2 天前
人工智能
·
ai
·
llm
115 行把 Qwen3-8B 跑进浏览器:WebLLM 本地推理实战
目标读者:隐私优先、数据不出机、想在前端跑本地 LLM 的开发者 预计阅读:18~25 分钟 主线:用 @mlc-ai/web-llm + WebGPU,在浏览器加载 Qwen3-8B-q4f16_1-MLC,完成聊天 / 摘要 / Agent 工具调用,并对比云端 API 的延迟与成本 关键词:WebLLM、MLC、WebGPU、Qwen3-8B、本地推理、隐私计算、Function Calling 官方参考:mlc-ai/web-llm · WebLLM Docs · MLC Models