llm

米小虾11 小时前
人工智能·llm
告别逐 token 蹦字:扩散语言模型(dLLM)到底能不能终结自回归?自回归统治了 NLP 整整八年。它有一个无法绕开的物理缺陷:必须一个 token 一个 token 地蹦。
米小虾11 小时前
人工智能·llm
一周 AI 观察(9.1–9.7):模型能力开始"过剩",行业真正卷的是落地这一周,AI 行业同时发生了三件看起来毫不相干的事:OpenAI 发布了一个"太危险所以不敢全开"的模型;AI 短剧的制作报价半个月跌了九成;一家短视频公司借了 296 亿美元。
AI技术新视界12 小时前
人工智能·llm·agi
符号诞生之前:视觉通用智能如何开启 AGI 的物理进化之路由全球多家顶尖学术机构、科研高校以及前沿工业界实验室共同合作发表名为《Visual General Intelligence: Pathways and Perspectives in the AGI Era》白皮书,它探讨了视觉通用智能(VGI)作为实现通用人工智能(AGI)潜在路径的可能性。研究者们认为,视觉模态不仅是传感器输入,更是捕捉世界结构的核心智能功能,其演化历史远早于语言。文中提出了多种观点,包括将生成式视频模型视为视觉基础模型,以及强调具身智能在物理世界中感知与行动的重要性。不同于目前的语
AI技术新视界14 小时前
人工智能·llm·认知科学
失控的认知外包:大语言模型如何像病毒般入侵人类思维与社会生态西班牙、意大利和美国多个研究机构将大语言模型(LLM)的扩散视为一种“认知病毒”,通过流行病学模型探讨其在人类群体中的传播及其对认知自主性的影响。研究指出,LLM的使用可能引发非线性集体转型,即一旦普及程度超过临界点,社会将从自主思考快速转向技术依赖。这种转型伴随着认知外包现象,即人类将推理、验证和创作等职能外包给机器,可能导致认知能力的显著下降。作者强调了技术锁定的风险,认为这种过程具有不可逆性,即预防依赖比事后纠正要容易得多。然而,该框架也提出了“认知免疫”策略,建议通过强化独立思考实践和维持非辅助的
打破砂锅问到底00714 小时前
人工智能·ai·llm
115 行把 Qwen3-8B 跑进浏览器:WebLLM 本地推理实战目标读者:隐私优先、数据不出机、想在前端跑本地 LLM 的开发者 预计阅读:18~25 分钟 主线:用 @mlc-ai/web-llm + WebGPU,在浏览器加载 Qwen3-8B-q4f16_1-MLC,完成聊天 / 摘要 / Agent 工具调用,并对比云端 API 的延迟与成本 关键词:WebLLM、MLC、WebGPU、Qwen3-8B、本地推理、隐私计算、Function Calling 官方参考:mlc-ai/web-llm · WebLLM Docs · MLC Models
烬羽15 小时前
langchain·llm·openai
让大模型输出 JSON:从"正则剥 markdown"到"让它调个工具",一条可靠性升级之路业务系统要让大模型干活,几乎都绕不开同一个问句:"你能不能给我一个结构化的 JSON?我要拿去继续算、入库、渲染。"
uncle_ll16 小时前
llm·agent·智能客服·rag·llamaindex
智能客服实践:微调+RAG双引擎架构落地在企业垂直问答、智能客服落地场景中,单一微调或纯RAG架构均存在明显短板:小样本微调泛化性存疑、无法适配动态数据;纯RAG检索精度不足、固定话术回答生硬。
桃西西呀17 小时前
人工智能·llm·ai编程
同一个模型 30% 到 100%?拆解 Harness 工程的 5 个机制,附 8 个坑的自检清单先看一组数字。8 月 21 日,NVIDIA 在开发者博客上放了一个结果:他们的 agent 系统 AVO 在 ARC-AGI-3 的公开集上拿到 100.00 RHAE,25 个环境 183 关全通。给它供能的模型是 Claude Opus 5。同一个 Opus 5 单独跑这个榜单,成绩是 30.16%。
Behavior17 小时前
llm·aigc·ai编程
Meta 发布 Muse Glimmer:30B 参数、一张 24GB 显卡就能常驻的本地 Agent 模型前段时间,Meta Superintelligence Labs 发布了一个对端侧智能体意义明确的新模型:Muse Glimmer。这是一个 30B 参数的稠密多模态开源模型,官方给它的定位就一句话——"always-on local agents"(常驻本地智能体),Apache 2.0 协议。
吴佳浩17 小时前
人工智能·llm·ai编程
为什么现在越来越多的开源模型,都“毕业“于 Qwen?作者:吴佳浩 Alben最近一年,AI 领域的信息量大到有点失控。每天打开手机,扑面而来的都是:标题也越来越夸张:
CoderJia程序员甲20 小时前
ai·大模型·llm·github·ai教程
GitHub 热榜项目 - 周榜(2026-09-06)生成于:2026-09-06共发现热门项目: 21 个Token赞助:siliconflow前些天发现了一个巨牛的人工智能学习网站,通俗易懂,风趣幽默,忍不住分享一下给大家。点击跳转到网站。
夫子39620 小时前
langchain·llm·agent
【第三部分:第一个 Agent 应用】12. 使用状态机开发一个可控 Agent上一篇介绍主流 Agent Framework 时,我们已经看到,简单 Agent 的核心仍然是 Model → Action → Observation → Model。模型根据当前上下文判断下一步,调用 Tool 获取结果,再结合新的 Observation 继续决策。
修远客20 小时前
llm·agent
配置驱动:让Agent灵活适配不同场景 — 硬编码是Agent的敌人,配置驱动让同一个Agent服务100个赛道早期赛道、格式、风格全硬编码在代码里 — 加一个"北漂"赛道要改 3 个文件:Python 枚举加一个值、前端 JS 加一个选项、人设模板加一个文件。改完还要重启服务。
不好听61321 小时前
llm
工具调用——让模型把答案"填进表格"而不是"写在作文里"系列第 3 篇。前两篇都属于"文本派":模型用自然语言作文,我们事后解析。这一篇换思路——既然平台提供了"工具调用"这种机制,为什么不让模型直接把结构化答案填进去?
不好听61321 小时前
llm
StructuredOutputParser——别再靠"哄",把 schema 讲清楚再验收系列第 2 篇。第 1 篇我们用 JsonOutputParser 拿到了对象,但它有个隐蔽的毛病:不校验。
武子康21 小时前
人工智能·llm·agent
从声学信号到工具阻断:实时语音安全决策门的系统设计摘要:工具调用获得人工批准或签名票据,并不等于它在真正提交时仍然有效。本文把 PROPOSE、AUTHORIZE、COMMIT 拆开,用 SDK Guardrail 覆盖矩阵、结构化确认、权威授权状态、一次性 jti 消费、业务幂等与 outbox,建立一条可撤销且能暴露远端未知终态的实时语音提交链。
tachibana21 天前
人工智能·算法·ai·大模型·llm·embedding·agent
Embedding 有哪几种算法?在信息检索、自然语言处理(NLP)以及大模型检索增强生成(RAG)系统中,计算机无法直接理解人类的自然语言字符。Embedding 算法充当了自然语言与高维几何计算之间的数学翻译器。
吴佳浩1 天前
人工智能·llm·ai编程
FDE:从系统落地工程师,演变为企业 AI 能力的知识架构师作 者:吴佳浩Alben撰稿时间:2026.8.21更新时间:2026.8.23筒子们如果你还把 FDE 理解成"前线部署工程师",那说明你看到的还是 2023 年。 2026 年真正的 FDE,已经不是部署系统的人,而是帮企业构建 AI 能力的人。 他做的不是写代码,而是把企业几十年的经验,变成 AI 可以理解、可以复用、可以持续成长的知识。 很多企业花几百万做 Agent,最后真正缺的,其实就是这样一个人。 今天,我们聊聊 AI 时代真正的 FDE。
吴佳浩1 天前
人工智能·llm·agent
从 OpenClaw、Codex 到 Hermes,看懂 AI Agent 架构为什么正在收敛作 者:吴佳浩Alben撰稿时间:2026.8.21更新时间:2026.8.22本文只讨论公开 GitHub 仓库、公开提交记录和公开源代码,目的是还原多个独立团队各自的设计演化路径,不构成对"代码抄袭"的指控——筒子们这一点全文只声明这一次,后面我们就不再重复。(现在很多无良的自媒体大肆的宣扬Codex终于开源了之类的话,实属没必要,接下来我们一起来看看真相)
stereohomology1 天前
llm
Wolfram会以什么姿态拥抱LLM我已经很久不用这个,但自然而然还会把符号计算能力跟LLM对比。——当前的LLM被吹到天花乱坠,仍然无法替代纯粹推理计算符号计算。