语言模型

冯胤清3 小时前
人工智能·语言模型
《直觉主义时序逻辑在时序答案集编程中的应用》论文深度分析总结本文(arXiv:2603.14692v1,投稿于 Theory and Practice of Logic Programming, TPLP)由西班牙拉科鲁尼亚大学的 Pedro Cabalar、法国昂热大学的 Martín Diéguez 与 Igor Stéphan、巴塞罗那大学的 David Fernández-Duque、德国波茨坦大学与 Potassco Solutions 的 Torsten Schaub 以及 François Laferrière 合著。作者团队汇聚了答案集编程(ASP
Dawson Zhu3 小时前
人工智能·语言模型·架构·aigc·agi
Multi-Agent架构与适用边界:何时应该使用Multi-Agent架构随着大语言模型(LLM)能力的持续演进,Multi-Agent(多智能体)架构逐渐成为解决复杂业务问题的热门技术方案。从 LangChain 的链式调用,到 AutoGen、CrewAI 的对话式多 Agent 协作,再到 LangGraph 的状态机图编排,Multi-Agent 框架经历了三代技术演进。然而,在实际工程落地中,盲目引入 Multi-Agent 往往导致系统复杂度飙升、延迟爆炸和 Token 成本失控。
Lucas_coding5 小时前
语言模型·ai编程
【LLM】多平台思考模式的开启、关闭与响应判断现在越来越多的大模型支持思考模式。同一个模型可能既可以直接回答问题,也可以先进行推理,再生成最终答案。
大模型任我行5 小时前
人工智能·语言模型·自然语言处理·论文笔记
字节:交替蒸馏与强化学习📖标题:Pistis Technical Report 🌐来源:arXiv, 2609.28554v1
黑妹天下第一乖5 小时前
人工智能·嵌入式硬件·语言模型·自然语言处理·iot
第 11 讲:阿加犀 AidLux 多组件综合实战——端侧“智能摄像头解说“全链路本篇速览到第 10 讲为止,这套工具链的零件你已经逐个摸过了:AidLite 管推理底座,AIMO/Model Farm 管模型供给,AidCV 管图像处理,AidStream 管视频流水线,AidGen/AidGenSE 管大模型,AidConnect 管跨系统通信,AidVoice 管语音。每一个你都单独跑通过,知道它的接口长什么样、坑在哪里。
Dawson Zhu6 小时前
人工智能·语言模型·架构·aigc·agi
《Agentic Design Patterns》第 5 章导读:工具使用(Tool Use)本文是对开源书籍《Agentic Design Patterns》第 5 章的解读与导读,内容忠实呈现原文,并附个人思考。 原书在线阅读:https://adp.xindoo.xyz/ | 翻译项目代码仓库:https://github.com/xindoo/agentic-design-patterns
Dawson Zhu20 小时前
人工智能·语言模型·架构·aigc·agi
《Agentic Design Patterns》第 1 章导读:提示词链(Prompt Chaining)本文是对开源书籍《Agentic Design Patterns》第 1 章的解读与导读,内容忠实呈现原文,后续引入个人思考。 原书在线阅读:https://adp.xindoo.xyz/ | 翻译项目代码仓库:https://github.com/xindoo/agentic-design-patterns
YOLO数据集集合1 天前
人工智能·yolo·目标检测·计算机视觉·语言模型·无人机·工程车
无人机视角工程机械目标检测数据集 | 工程机械检测 无人机航拍 智慧工地9152期本数据集专注于无人机航拍视角下的工程机械检测与分类,服务于智慧工地管理、施工进度监控及工程机械调度。数据涵盖多种常见施工机械,适配工地安全监控、设备统计及自动化巡检等应用。
Dawson Zhu1 天前
人工智能·语言模型·架构·aigc·agi
《Agentic Design Patterns》第 2 章导读:路由(Routing)本文是对开源书籍《Agentic Design Patterns》第 2 章的解读与导读,内容忠实呈现原文,并附个人思考。 原书在线阅读:https://adp.xindoo.xyz/ | 翻译项目代码仓库:https://github.com/xindoo/agentic-design-patterns
Dawson Zhu1 天前
人工智能·语言模型·架构·aigc·agi
《Agentic Design Patterns》第 3 章导读:并行化(Parallelization)本文是对开源书籍《Agentic Design Patterns》第 3 章的解读与导读,内容忠实呈现原文,并附个人思考。 原书在线阅读:https://adp.xindoo.xyz/ | 翻译项目代码仓库:https://github.com/xindoo/agentic-design-patterns
零基础1232 天前
经验分享·python·语言模型·vllm
DeepSeek V4.1 Flash (Batch) 的性能测试与应用在开发过程中,我们常常面临一个两难选择:是追求极致的响应速度,还是等待更高质量的模型输出?特别是在构建实时交互应用、智能客服系统或需要高频调用的数据分析工具时,延迟往往直接决定了用户体验的上限。很多时候,业务场景并不需要模型具备深奥的推理能力去解复杂的数学题,而是要求它在毫秒级内给出准确、流畅的自然语言反馈。这种对“快”与“准”平衡点的渴求,推动了轻量级高性能模型的快速迭代。
零基础1232 天前
人工智能·经验分享·python·语言模型
Agent 的 Memory 怎么做科研:以中医诊断场景为例大语言模型(LLM)驱动的 Agent 在复杂任务中展现出卓越能力,但受限于上下文窗口与单轮推理范式,难以在长周期、多轮次的交互中维持稳定一致的记忆。Memory(记忆)机制由此成为 Agent 领域的前沿研究方向。本文以中医诊断这一典型的长周期、强领域依赖场景为切入点,系统梳理 Memory 科研的问题定义、数据构建、对比实验设计与参考文献,旨在为研究者提供一套可复现、可扩展的实验框架。
东方佑2 天前
人工智能·深度学习·语言模型·自然语言处理·架构
v24 (Hybrid2Fast) 架构与实验报告版本: 1.0 | 2026-09-30 | 模型 23.19M | minimind PT 39,695 步 | 真实 token NLL 2.4241(23M 家族新冠军)
YOLO数据集集合3 天前
人工智能·yolo·目标检测·语言模型·太阳能板·光伏组件
光伏组件异常检测数据集 | 光伏组件 异常检测 红外检测 热斑识别 光伏巡检9147期本数据集专注于红外热成像下的光伏组件异常检测,服务于光伏电站智能巡检、故障诊断及运维管理。数据涵盖光伏组件异常区域,适配无人机巡检、红外热成像分析及故障定位等应用。
c萱3 天前
ai·语言模型·aigc·产品经理·ai-native
AI产品经理——02AI产品的发展目录一、大模型的演变及概念二、AI产品经理的关键定义三、大模型带来的变化四、AI pm从入门到精通的职业路线
栈帧之外3 天前
人工智能·深度学习·语言模型
【白话大模型二】一文梳理深度学习与大语言模型深度学习(Deep learning),英⽂缩写为DL,是⼀种机器学习的分⽀,它是通过构建多层神经⽹络来实现⾃主学习和预测的能⼒。深度学习的核⼼是深度神经⽹络,它由多个层次的神经元组成,每⼀层都可以提取出不同的特征信息,从⽽实现对复杂数据的学习和预测。深度学习的应⽤范围⾮常⼴泛, 包括图像识别、语⾳识别、⾃然语⾔处理等领域。 相⽐于传统机器学习(如SVM、决策树)需要⼈⼯设计特征(特征⼯程),深度学习的本质区别在于,它不仅能⾃动学习参数(权重),更重要的是,它能通过多层结构⾃动从原始数据中逐层构建出⾼层次
硅谷秋水3 天前
人工智能·机器学习·语言模型·机器人·软件工程
EmbodiedSWE:面向长时程灵巧机器人的编程智能体26年9月来自字节Seed、耶鲁、普林斯顿、CMU、斯坦福、UCLA和西雅图U Wash的论文“EmbodiedSWE: Coding Agents for Long Horizon Dexterous Robotics”。
伞伞悦读3 天前
语言模型
Hermes Agent 在 Windows WSL2 中的安装与使用教程本文记录 Windows 11 + Ubuntu WSL2 + Clash Verge 环境下安装 Hermes Agent 的完整流程。
YOLO数据集集合3 天前
人工智能·yolo·目标检测·语言模型·河道污染·城市治理
河道环境智能检测系统(YOLO + DeepSeek) | 河道巡检 YOLO DeepSeek 大语言模型 智慧水利 9144期本系统是一款专为智慧水利、生态环保与河道监管打造的AI视觉分析平台。系统创新性地将改进型YOLO目标检测算法与DeepSeek/Qwen大语言模型深度融合,构建了“精准感知 + 智能研判 + 闭环管理”的三位一体解决方案。系统能够自动识别无人机航拍图像/视频中的河道环境问题,检测精度高达92%+,单图处理速度<0.25秒,并支持实时摄像头巡检、历史数据追溯及AI生成专业治理建议。
硅谷秋水4 天前
机器学习·语言模型·机器人
EmbodiedMemory-Bench:面向长时程具身任务的具身记忆基准测试26年9月来自浙大、中南大学和中科院软件所的论文“EmbodiedMemory-Bench: Benchmarking Embodied Memory for Long-Horizon Embodied Tasks”。