大语言模型

AI你一生一世5 小时前
人工智能·大语言模型·数学推理·ai对齐·形式化验证·推理模型·语义漂移
当AI在数学中“失准”:一场关于形式化、直觉与工程取舍的深度复盘我是AI时代的无业游民,我游荡在现实与意念之间过去两年,大模型在自然语言、代码生成甚至竞赛级数学题上的表现让人产生了一种错觉:数学似乎是AI最容易攻克的堡垒之一。毕竟,数学语言精确、规则明确、答案可验证——这不正是机器最擅长的领域吗?
winfredzhang12 小时前
人工智能·大语言模型·多线程·下载·多任务
9.7GB AI 模型总下崩?我用 Python 写了个支持分段续传的多线程下载器(源码解析)关键词:Python、多线程、HTTP Range、断点续传、wxPython、PyInstaller
段一凡-华北理工大学3 天前
大数据·人工智能·python·深度学习·大语言模型·python开发
大模型与智能体在工业的应用~系列文章12:大模型 × 数字孪生 × 智能体的融合图景十二期一路走来,我们从"认知"讲到"原理",从"提示词"讲到"RAG",从"单智能体"讲到"多智能体",从"接系统"讲到"可信"和"落地"。作为收官篇,我们该跳出"当下怎么用",抬头看看未来往哪走。一个清晰的趋势正在浮现:大模型 与 数字孪生、工业互联网 正在走向深度融合——智能体不再只是"问答助手",而会成为"能感知、能推演、能决策的工业数字伙伴"。本期展望这条演进路径,谈"高炉大脑想象图景",也给大家落下一句抓住时代风口的布局建议。
minji...4 天前
人工智能·python·ai·langchain·大语言模型·agent·langgraph
LangGraph-AI智能体开发框架 - LangGraph 入门案例1 : 智能快递配送系统目录一、智能快递配送系统Graph API 编码思路智能快递配送系统图讲解智能快递配送流程:二、编码编码流程
AI你一生一世5 天前
人工智能·大语言模型·注意力机制·rag·长上下文·上下文窗口·推理成本
Attention is all you have:当上下文成为唯一的护城河我是AI时代的无业游民,我游荡在现实与意念之间过去两年,主流大模型的上下文窗口从 8K 一路推到 1M 甚至 10M token。表面上看,这是"能塞更多文档"的工程红利;但在真实系统里,它带来的第一个问题不是性能,而是决策逻辑的崩塌。
墨心@5 天前
人工智能·大语言模型·agent·智能体·harness
【无标题】实验 10-2 用管理者模式(Orchestration)把一本英文技术小书的翻译拆给四个专职 Agent: Glossary(抽术语表)→ Translation(逐章翻译,每章一个独立实例)→ Proofreading(审校)→ Manager(调度与决策)。核心主张是上下文隔离与控制 Manager 上下文膨胀:完整译文全部落盘, Manager 上下文里只留任务、计划、调用记录与文件路径,因此书越长、Manager 上下文基本不涨。
小爷毛毛(卓寿杰)7 天前
人工智能·算法·大模型·prompt·大语言模型·agent
【Agent 意图识别】输出协议、评估与置信度🎯 面试话术Agent 意图识别不只输出一个意图标签,更完整的输出是一套结构化协议。简单来说就是除了意图标签,还要输出子任务列表、独立意图、已抽取的参数槽位、缺失的参数,以及硬约束和软约束。另外还有两类证据字段——已验证事实和暂定证据,用来区分用户当前轮明确说的和历史画像推断出来的。
空 白II8 天前
人工智能·大语言模型·clm
9.26 大语言模型研究简报:CLM-8B 用对比学习替代 Agent 中大量生成式决策发布时间(北京时间):2026 年 9 月 24 日 14:54 机构:Stanford 等 状态:开源模型 + 代码 + 技术博客,当前不是同行评审论文 时间说明:按研究者集中发布公告时间 2026-09-24 06:54 UTC 换算。
空 白II16 天前
大语言模型·qwen
9.20 大语言模型研究简报:Qwen Code v0.24.1从 Coding Agent 走向统一 Agent Runtime北京时间 2026 年 9 月 19 日 16:18:42 正式发布了 Qwen Code v0.24.1。
空 白II17 天前
大语言模型·claude
9.19 大语言模型研究简报:Anthropic × Accenture 把“第三方评测者”直接嵌入前沿模型研发流程北京时间 2026 年 9 月 19 日 04:05,Anthropic 宣布与 Accenture 建立 Embedded Evaluation 合作机制。
空 白II18 天前
openai·大语言模型
9.17 大语言模型研究简报:openAI 公开模型失配报告框架北京时间 2026 年 9 月 17 日 01:00 openAI 公开了模型失配报告框架,其原文链接为
空 白II19 天前
大语言模型·grok build
9.17 大语言模型研究简报:Grok Build 引入正式 Agent 系统发布Grok Build 在北京时间2026 年 9 月 17 日 03:00发布了正式的跨对话记忆 Agent ,原文链接为
prog_610321 天前
人工智能·llm·大语言模型·agent
【笔记】用agent手搓agent(一)今天我们从cursor手搓cursor进入下一个篇章,开始向泛化的agent去开发agent,进一步开始研究agent,向RSI进发。
澳鹏Appen21 天前
人工智能·大语言模型·智能体·大模型推理
AppenTalk | 当AI推理不再只是模型的事:Dan Roth谈智能体的真正边界Oracle首席AI科学家Dan Roth的回答比大多数人想象的更严格。在近期与澳鹏的对谈中,Roth提出:许多AI领域最棘手的问题,已不再是模型层面的问题,而是系统层面的问题。一个LLM可以生成恰好得出正确答案的token序列,但这与“推理”的形式意义之间存在根本区别。
prog_61031 个月前
人工智能·笔记·大语言模型·agent
【笔记】用cursor手搓cursor(十)本来准备开源自己的agent,但是测试以后还不是特别满意,尤其是coding上还欠点火候,还需要再打磨打磨再出开源第一个commit。目前使用的是qwen3.6:35b,token生成速度已经非常快了,它可以配置好自动approve的规则以后持续自主学习,然后写问答到知识数据库,推理的时候再通过知识数据库读取之前的知识,然后作出更好的行动。比如让它读linux源代码,从一个user space的行为追踪到kernel代码,已经很不错了;或者读取伤寒杂病论让它总结什么病症对应使用什么方剂;或者结合pdfcp
songsong.1 个月前
大模型·大语言模型·vibe coding·氛围编程
Vibe Coding实现Supabase + Vercel完整部署本文从零完整记录:Next.js前端项目搭建 → Supabase后端服务配置 → 本地调试验证 → Git托管 → Vercel一键部署,以及部署过程踩过的全部坑,手把手跑通一条完整上线链路。以登录注册为例,这也是Hello‑World般的存在!
指针常量1 个月前
人工智能·笔记·大语言模型·后训练
【RL相关笔记】RL 效率综述本综述记录与提升 LLM RL/RLVR 效率相关的已有工作,重点关注难样本处理、信用分配、隐状态信号、rollout 分配和训练动态。
songsong.1 个月前
大模型·openai·大语言模型
一个简单通用的ChatLLM类设计与使用大模型的封装调用,希望能帮助你在各种LLM辅助工具开发中快速上手。我们经常需要调用各种大语言模型(LLM)的API来辅助完成一些计算任务,为了方便复用和快速开发,我封装了一个通用的ChatLLM类,支持:
指针常量1 个月前
学习·大语言模型·rl·后训练
【RL系列文章】难样本学习等综述:看了很多,总的来说,不利用外部信息的都基本比较扯淡。链接:https://arxiv.org/pdf/2602.01601 本文的核心理论即我们到底选择哪些样本去学习,DAPO的逻辑是把全对全错的去掉,但是这个属于先rollout再评价好坏;本文提出可以事先根据query进行预测答对的概率。本文先证明了一个重要的前提,答对概率越接近50%的题目越具有信息量,优先采样这部分会对训练更有效。 为此,本文设计了一个非常巧妙的纯数学计算的方法,动态的维护题目答对的可能性。已经答过的题的答对概率被更新,未答过
Geek-Chow1 个月前
人工智能·大语言模型·mcp
MCP 模型上下文协议:四、概念地图 · 八个概念与五个组件🇬🇧 English version: mcp-guide/03-concept-map.md | 📦 GitHub: https://github.com/geekchow/mcp-explain