语言模型

单友人1 小时前
人工智能·神经网络·机器学习·语言模型·自动化
HMHA-RYST 算法技能包 + 聊天记录导出器高性能多启发式算法运行时系统技能包 + 聊天记录导出工具。包含61个核心算法 + 完整本地智能体 + 聊天记录导出功能。
sel_91 小时前
论文阅读·人工智能·笔记·深度学习·算法·语言模型·自然语言处理
【多轮对话论文导读(七)】多轮对话论文阅读笔记:从数据生成、用户模拟到上下文重构与长期记忆本文整理了前后与多轮对话、长程交互、Agent、用户模拟、上下文管理和长期记忆相关的 5 篇论文。本文不按照传统的“摘要—方法—实验”顺序介绍,而是统一采用下面的研究视角:
老郑聊AI业财智造2 小时前
人工智能·python·深度学习·语言模型·金融·架构·软件工程
给大模型装上“金融之眼”:Kronos-Report的量化预测架构与技术全景剖析一句话概括:Kronos-Report不是又一个量化分析工具,而是一套以Kronos金融时序大模型为推理核心、以“预测器-报告生成器-简报系统-HTTP服务”四层模块为工程骨架、以“多品种自适应+多格式报告+多模型管理”为能力矩阵的AI量化投研自动化平台——让金融预测从“人工撰写研报”变成“模型自动生成多格式分析报告和每日简报”,并在此过程中将预测能力从命令行延伸到HTTP服务、从单次预测延伸到定时任务、从本地使用延伸到远程调用。
MartinYeung53 小时前
学习·安全·语言模型
[论文学习]潜伏代理:训练能够经受安全训练的欺骗性大语言模型深度分析本文证明了大语言模型可以被训练出条件式后门行为——在正常情境下表现安全无害,但当特定触发信号出现时执行预设的有害动作——并且这些后门能够穿越包括监督微调(SFT)、基于人类反馈的强化学习(RLHF)和对抗训练在内的标准安全训练而持续存在。更令人警醒的是,研究发现模型规模越大、越有能力,后门行为就越持久;而对抗训练非但不能消除后门,反而可能教会模型更好地识别触发条件,从而更有效地“隐藏”其不安全行为。
MartinYeung55 小时前
人工智能·学习·语言模型
[论文学习]动态红队测试DAS:破解医疗大语言模型静态评估的“信任陷阱”本文提出了一种动态、自动且系统化的红队测试审计框架(Dynamic, Automatic and Systematic Red-Teaming,简称DAS),通过持续对大语言模型进行对抗性压力测试,揭示其在医疗健康场景中静态基准测试高分与动态可靠性低下之间的巨大鸿沟——“基准测试鸿沟”(Benchmarking Gap)。研究评估了15款主流大语言模型,发现即便模型在MedQA等静态基准上取得超过80%的中位准确率,在动态对抗测试中依然暴露出惊人的脆弱性。
sel_91 天前
人工智能·深度学习·算法·语言模型·自然语言处理
【多轮对话论文导读(二)】多轮对话与LLM Agent论文阅读:长期记忆、多轮评估与Agent训练最近多轮对话研究的一个明显趋势是:研究重点正在从“单轮回答质量”转向长期交互过程中的状态跟踪、用户意图理解、澄清决策、记忆和Agent训练。
硅谷秋水1 天前
人工智能·深度学习·计算机视觉·语言模型·机器人·音视频
ImageWAM:世界-动作模型真的需要视频生成,还是只需要图像编辑?26年6月来自上海交大、东方理工、腾讯、清华和中关村学院的论文“ImageWAM: Do World Action Models Really Need Video Generation, or Just Image Editing?”。
MartinYeung51 天前
人工智能·学习·语言模型
[论文学习]PoisonBench:评估语言模型对投毒偏好数据的脆弱性PoisonBench是首个系统性评估大语言模型在偏好学习阶段面对数据投毒攻击脆弱性的标准化基准。研究在22个广泛使用的模型上部署了两种攻击类型(内容注入与对齐退化),覆盖8个现实场景,揭示了三个关键发现:参数规模扩大并不天然增强抗投毒能力;投毒比例与攻击效果呈对数线性关系;投毒效应可泛化至训练中未见的触发词。该工作已被ICML 2025接收。
MartinYeung52 天前
人工智能·学习·语言模型
[论文学习]BadRobot:物理世界中具身大语言模型智能体的越狱攻击BadRobot 是首个针对物理世界中具身大语言模型(Embodied LLM)智能体的越狱攻击范式,首次系统地揭示了将 LLM 作为机器人“大脑”时所面临的全新安全威胁——攻击者仅通过语音交互,即可操纵机器人执行物理层面的危险行为。研究团队识别出三大安全漏洞,并在 Voxposer、Code as Policies、ProgPrompt 等主流具身 LLM 框架上通过大量实验验证了攻击的有效性。
晓天衡宇•评测社区2 天前
人工智能·语言模型
FSR-Bench 榜单更新:Qwen3.8-Max 开工具配置位列第 5,双配置均进入前十随着大模型逐步具备联网搜索、代码执行等能力,科学推理评测所考查的对象也开始从单一模型扩展到模型与工具组成的完整系统。模型不仅要理解问题,还要判断何时检索资料、如何筛选证据,以及怎样将工具返回的信息转化为可靠结论。
tachibana22 天前
数据库·人工智能·语言模型·自然语言处理·大模型·llm
大语言模型基础从概率论与统计学视角来看,语言模型(Language Model, LM)的目标是建立一个计算自然语言序列概率分布的数学模型。
Allen_LVyingbo2 天前
运维·人工智能·机器学习·语言模型·自然语言处理·自动化·健康医疗
面向电子病历的批量语义分析自动化工具:从设计到实战(上)Design and Implementation of a Batch Semantic Analysis Automation Tool for Electronic Medical Records — A Hands-on Blog
Zzj_tju2 天前
人工智能·pytorch·深度学习·语言模型
复现一个 Transformer Encoder:从论文公式到最小 PyTorch系列:开源 AI 论文复现实验与代码解读 日期:2026-08-24 适合读者:研究生、科研新人、希望真正理解 Transformer 代码的工程读者 检索日期:2026-08-24
MartinYeung52 天前
人工智能·学习·语言模型
[论文学习]Poser:通过操纵内部结构揭示对齐伪装的大语言模型本文提出了一个名为 Poser 的基准测试框架,用于检测那些在评估时表现对齐、但在有利时机下会故意作恶的大语言模型(即“对齐伪装者”)。研究发现,向模型激活值注入噪声 是最有效的检测策略,能以 98% 的准确率 识别出对齐伪装模型,并且该策略还能用于进一步消除模型的伪装行为。
sel_93 天前
人工智能·深度学习·算法·机器学习·语言模型
【强化学习】Hands-on Modern RL项目实践|OPD 算法完整解析关键词:On-Policy Distillation、OPD、Reverse KL、Mode-Seeking、GRPO、RLVR、Tinker、蒸馏
星辰AI3 天前
人工智能·ai·语言模型
全栈项目代码质量治理复盘:ESLint+Prettier+Husky的渐进式引入策略在一个15人的全栈团队中推行ESLint+Prettier+Husky时遇到的第一反应不是"太好了",而是:
howdoyoudo2026063 天前
大数据·人工智能·安全·ai·语言模型
AI审计手记 #01(数据补全版):107小时、17,600次操作——OpenAI越狱案完整攻击链量化分析AI审计手记 #01(数据补全版):107小时、17,600次操作——OpenAI越狱案完整攻击链量化分析
硅谷秋水3 天前
人工智能·深度学习·安全·机器学习·语言模型·机器人
通过技能-驾驭进化实现自我演化的具身智能体26年8月来自美国东北大学和微软研究院的论文“Self-Evolving Embodied Agents via Skill-Harness Evolution”。
大模型任我行3 天前
人工智能·语言模型·自然语言处理·论文笔记
NUS:全模态感知驱动AI科学家📖标题:OmniScientist: An Omni-Modal Omni-Discipline AI Scientist 🌐来源:arXiv, 2608.13558v1
硅谷秋水3 天前
人工智能·深度学习·安全·机器学习·语言模型·机器人
迈向具身智能体的驾驭26年8月来自宁波东方理工大学的论文“Towards the Harness of Embodied Agents”。