语言模型

零基础1233 小时前
人工智能·语言模型·自动驾驶
自动驾驶中的边界情况处理:基于世界模型与混合专家及大语言模型的方法本文提出了一种基于世界模型(World Model)结合混合专家(Mixture of Experts, MoE)与大语言模型(Large Language Models, LLMs)的方法,用于处理自动驾驶中的边界情况(Corner Cases)。边界情况是指那些罕见、难以预测且对安全至关重要的驾驶场景,例如突然闯入的行人、异常交通标志、极端天气条件或非标准道路布局等。这些场景虽然出现频率低,却对自动驾驶系统的安全性和可靠性构成重大挑战。
Dawson Zhu4 小时前
人工智能·语言模型·架构·aigc·agi
《Agentic Design Patterns》第 11 章导读:目标设定与监控(Goal Setting and Monitoring)本文是对开源书籍《Agentic Design Patterns》第 11 章的解读与导读,内容忠实呈现原文,并附个人思考。 原书在线阅读:https://adp.xindoo.xyz/ | 翻译项目代码仓库:https://github.com/xindoo/agentic-design-patterns
空 白II4 小时前
windows·microsoft·语言模型
10.10 大语言模型研究简报:Microsoft 发布 Windows 端侧混合智能架构发布信息:微软官方发布于 2026 年 10 月 7 日(美国当地日期);按旧金山发布会所在时区换算,北京时间为 2026 年 10 月 8 日
染指11106 小时前
人工智能·语言模型·langchain·skill·agents
141.Agent-多Agent框架-编写并使用Skills摘要:本文基于 Tool Use(Function Calling)机制,实现了一个支持技能(Skill)按需加载的本地智能代理(Agent)。全文围绕「发现阶段」与「激活阶段」两条主线展开:发现阶段通过扫描 .agents/skills 目录下的 SKILL.md 文件,解析 YAML frontmatter 中的技能描述并组装为 Skill 对象;激活阶段则创建 Agent,将技能名称与描述注入系统提示词,并通过 load_skill 工具在对话中按需加载技能内容,实现渐进式技能调用。文章附带了 fr
Dawson Zhu10 小时前
人工智能·语言模型·架构·aigc·agi
《Agentic Design Patterns》第 8 章导读:记忆管理(Memory Management)本文是对开源书籍《Agentic Design Patterns》第 8 章的解读与导读,内容忠实呈现原文,并附个人思考。 原书在线阅读:https://adp.xindoo.xyz/ | 翻译项目代码仓库:https://github.com/xindoo/agentic-design-patterns
Duang007_16 小时前
人工智能·语言模型·自然语言处理
Claude Managed Agents 动态工作流:让 Lead Agent 自己写编排程序本文更多文章见 Duang 的博客。Anthropic 在 2026 年 10 月 9 日把 Claude Managed Agents 的"动态工作流"(dynamic workflows)推到了公开 Beta。它不是又一个多智能体框架,而是把"编排这件事"本身交给模型:lead agent 先写出一段 workflow 程序,服务端把它当作一次 workflow run 在后台按阶段执行,跑完再合并结果。对开发者来说,这意味着多智能体系统从"你定义角色和流程"进化为"你描述目标,模型自己定义流程"。
Dawson Zhu1 天前
人工智能·语言模型·架构·aigc·agi
《Agentic Design Patterns》第 9 章导读:学习与适应(Learning and Adaptation)本文是对开源书籍《Agentic Design Patterns》第 9 章的解读与导读,内容忠实呈现原文,并附个人思考。 原书在线阅读:https://adp.xindoo.xyz/ | 翻译项目代码仓库:https://github.com/xindoo/agentic-design-patterns
Anastasiozzzz2 天前
ai·语言模型
深度拆解 Jev 模型:扒开“系统一模型”的底层工作原理大家好,这里是程序员阿亮!大家好,今天来给大家讲解一下Jev模型~这个模型是前阵子突然爆火网络的模型,甚至你在抖音都能一直刷到它
天空鸟_时光不老2 天前
人工智能·语言模型·自然语言处理
1-2-2-什么是大语言模型LLM 全称 Large Language Model,本质是一个用海量数据训练出来的深度学习模型,做的事情只有一件:给定一段输入,预测下一个内容片段应该是什么。
YYYing.2 天前
人工智能·语言模型·自然语言处理·agent
【Agent系列 (二) 】大语言模型基础⭐️在这个怀疑的年代,我们依然需要信仰。个人主页 :YYYing.⭐️Agent系列专栏:从零开始的agent学习
Dawson Zhu3 天前
人工智能·语言模型·架构·aigc·agi
《Agentic Design Patterns》第 10 章导读:模型上下文协议(MCP)本文是对开源书籍《Agentic Design Patterns》第 10 章的解读与导读,内容忠实呈现原文,并附个人思考。 原书在线阅读:https://adp.xindoo.xyz/ | 翻译项目代码仓库:https://github.com/xindoo/agentic-design-patterns
YOLO数据集集合3 天前
yolo·目标检测·语言模型
YOLO 目标检测模型与 DeepSeek/Qwen 大语言模型融合的跌倒检测系统 | 跌倒检测 YOLO DeepSeek Qwen 行为识别 目标检测本系统基于 YOLO 目标检测模型与 DeepSeek/Qwen 大语言模型,融合 Vue3、SpringBoot、Flask、Python 等技术,构建了一套完整的跌倒行为识别与预警平台。系统支持图片、批量图片、视频、摄像头实时检测,适配养老监护、医院看护、公共安全等场景。
硅谷秋水3 天前
人工智能·深度学习·机器学习·语言模型·机器人
将物理先验嵌入机器人学习:综述26年9月来自慕尼黑工大(TUM)、达姆施塔特工大(TUD)、意大利Trento大学和Ulm大学和的论文“Embedding Physics Priors in Robot Learning: A Survey”。
跟我学机器学习4 天前
人工智能·深度学习·语言模型
基于两阶段索引的RAG Agent:检索增强与 Agent 结合实践在上一节内容中,我们介绍了基于 Qwen3 Reranking 模型的原理及使用方法,并且对 Qwen3 Reranking 模型的实现代码也进行了简单的介绍。在本节内容中,我们将以第4.4节中介绍的 RAG Agent 为基础,来搭建一个包含有两阶段索引的 RAG Agent 。
阡陌数智4 天前
开发语言·人工智能·语言模型·自然语言处理·推荐算法
RAG 系统的召回退化:向量库、分块、重排全链路问题排查与优化实践检索增强生成 RAG 是知识库类大模型应用的主流方案。大量企业落地 RAG 会遭遇一个共性现象:项目初期测试样本效果优秀,上线后持续往知识库新增文档,过一段时间问答效果持续变差。用户提问明明知识库存在对应答案,却检索不到,或者检索出大量无关片段,最终大模型输出幻觉或者错误回答。很多运维直接升级向量数据库、增加算力,但效果提升有限。
Dawson Zhu4 天前
人工智能·语言模型·架构·aigc·agi
《Agentic Design Patterns》第 4 章导读:反思(Reflection)本文是对开源书籍《Agentic Design Patterns》第 4 章的解读与导读,内容忠实呈现原文,并附个人思考。 原书在线阅读:https://adp.xindoo.xyz/ | 翻译项目代码仓库:https://github.com/xindoo/agentic-design-patterns
冯胤清5 天前
人工智能·语言模型
《直觉主义时序逻辑在时序答案集编程中的应用》论文深度分析总结本文(arXiv:2603.14692v1,投稿于 Theory and Practice of Logic Programming, TPLP)由西班牙拉科鲁尼亚大学的 Pedro Cabalar、法国昂热大学的 Martín Diéguez 与 Igor Stéphan、巴塞罗那大学的 David Fernández-Duque、德国波茨坦大学与 Potassco Solutions 的 Torsten Schaub 以及 François Laferrière 合著。作者团队汇聚了答案集编程(ASP
Dawson Zhu5 天前
人工智能·语言模型·架构·aigc·agi
Multi-Agent架构与适用边界:何时应该使用Multi-Agent架构随着大语言模型(LLM)能力的持续演进,Multi-Agent(多智能体)架构逐渐成为解决复杂业务问题的热门技术方案。从 LangChain 的链式调用,到 AutoGen、CrewAI 的对话式多 Agent 协作,再到 LangGraph 的状态机图编排,Multi-Agent 框架经历了三代技术演进。然而,在实际工程落地中,盲目引入 Multi-Agent 往往导致系统复杂度飙升、延迟爆炸和 Token 成本失控。
Lucas_coding5 天前
语言模型·ai编程
【LLM】多平台思考模式的开启、关闭与响应判断现在越来越多的大模型支持思考模式。同一个模型可能既可以直接回答问题,也可以先进行推理,再生成最终答案。
大模型任我行5 天前
人工智能·语言模型·自然语言处理·论文笔记
字节:交替蒸馏与强化学习📖标题:Pistis Technical Report 🌐来源:arXiv, 2609.28554v1