论文阅读

m4Rk_6 小时前
论文阅读·人工智能·学习
【论文阅读】Agent 记忆机制(27):MemRefine——用 LLM 事实判断将长期记忆压缩到固定预算长期运行的 Agent 会不断积累记忆。这些记忆可能包括:现有研究通常关注两个问题:但是,当 Agent 从几次交互扩展到数月甚至数年的运行后,还会出现第三个问题:
EQUINOX11 天前
论文阅读·人工智能·python·深度学习·gpt-3
GPT1-GPT3技术综述之前手搓过GPT-2(LLMs-From-Scratch),然后一时兴起想梳理一下GPT1~3的技术路线。
DuHz1 天前
论文阅读·算法·信息与通信·信号处理
论文解读:用于数据分析的极值点对称模态分解方法 (Extreme-point Symmetric Mode Decomposition,ESMD)Wang J L, Li Z J. Extreme-point symmetric mode decomposition method for data analysis[J]. Advances in Adaptive Data Analysis, 2013, 5(03): 1350015.
m4Rk_1 天前
论文阅读·人工智能·学习·开源·github
【论文阅读】Agent 记忆机制(26):Infini Memory——将长期记忆维护成可读写的主题文档长期运行的 Agent 会不断积累用户偏好、任务事实、工具观察和历史决策。最直接的做法,是将每次交互提取成独立记忆,再存入向量数据库。用户提出问题时,系统通过语义相似度召回若干条相关记录。
chnyi6_ya2 天前
论文阅读·笔记
论文阅读笔记 | The Script is All You Need: 对话到电影级视频生成的 Agentic 框架当前的视频生成模型(如 Sora2-Pro、Veo3.1、Wan2.5)虽然已经能够根据文本 prompt 合成高质量的短视频,但在面对更复杂的创作任务时暴露出根本性的局限:从高层叙事概念(如一段对话)到电影级视频之间存在巨大的"语义鸿沟"(semantic gap)。
iiiiii112 天前
论文阅读·人工智能·笔记·深度学习·机器学习·机器人·具身智能
【论文阅读笔记】Reparameterization Proximal Policy Optimization (RPO):将PPO的稳定性引入可微分强化学习ICML 2026 poster这篇文章提出了 Reparameterization Proximal Policy Optimization (RPO) ,核心贡献在于建立了重参数化策略梯度(RPG)与PPO风格替代目标函数之间的理论联系,从而为RPG提供了统一、稳定的样本复用机制。
实验如有神祝女士3 天前
论文阅读·人工智能·深度学习·学习·算法·语言模型·论文笔记
不同参数规模大模型在医学翻译场景的适配差异大众翻译场景普遍存在一种认知:模型参数量越大,通用文本翻译流畅度越好。但该适配规律不适用于医学这类强规范专业场景,千亿、万亿参数通用大模型在处理医学文献、临床资料时,容易出现语序错位、修饰成分混淆、临床逻辑颠倒、结构化表格/文稿排版错乱等现象。
IT阿瑞3 天前
论文阅读·人工智能·ai
学术论文 PDF 翻译:双栏、公式、图注的三个处理难点学术论文的翻译需求和普通文档不太一样。一篇工作报告翻错了几个词,最多是表达不够准确;但一篇论文如果排版处理不当,很可能连“读不读得下去"这个基本问题都保证不了。
chnyi6_ya4 天前
论文阅读·笔记
论文阅读笔记 | One Sentence, One Drama: 基于多智能体系统的个性化短剧生成短剧(Short Drama)近年来在内容消费领域爆发式增长,但现有的AI短剧生成方法存在三个核心痛点:
小马哥crazymxm4 天前
论文阅读·人工智能·科技
Arxiv论文周选 (2026-W28)同步自EasyReader每周精选模块。 配合“导读+思维导图”功能阅读,效率提升80%。立即体验EasyReader论文阅读
m4Rk_4 天前
论文阅读·人工智能·学习·开源·github
【论文阅读】Agent 记忆机制(20):RecMem——只在信息反复出现时进行长期记忆巩固前面阅读 Mem0、A-MEM、MemoryOS 等 Agent 记忆方法时,我们主要关注的是:这些方法通常采用一种相对积极的记忆构建策略。
m4Rk_5 天前
论文阅读·人工智能·学习
【论文阅读】Agent 记忆机制(22):FluxMem——根据对话结构动态选择记忆组织方式前面已经阅读了 Mem0、A-MEM、MemoryOS、LightMem、Zep 等不同类型的 Agent 记忆系统。
万里鹏程转瞬至6 天前
论文阅读·深度学习·aigc
论文简读:Boogu-Image 图像生成与编辑模型发表时间: 2026年7月14日 论文地址:https://arxiv.org/pdf/2607.13125 模型地址:添加链接描述 项目地址:添加链接描述
Rocky Ding*8 天前
论文阅读·人工智能·深度学习·机器学习·aigc·ai-native·kimi k1.5
一文读懂Kimi k1.5大模型核心基础知识欢迎大家关注Rocky的知乎:Rocky Ding 《三年面试五年模拟》AIGC/LLM/AI Agent算法工程师/开发工程师求职面试秘籍独家资源:【三年面试五年模拟】WeThinkIn/AIGC-Interview-Book,欢迎大家Star~
SimpleLearingAI9 天前
论文阅读
论文解读:RECCE — 端到端重建-分类学习的人脸伪造检测论文:End-to-End Reconstruction-Classification Learning for Face Forgery Detection 作者:Junyi Cao, Chao Ma, Taiping Yao, Shen Chen, Shouhong Ding, Xiaokang Yang 会议:CVPR 2022 机构:上海交通大学 VISION Lab + 腾讯优图 代码:https://github.com/VISION-SJTU/RECCE
柳叶方舟16 天前
论文阅读·人工智能·健康医疗
npj Digital Medicine IF=15.1 | 多模态数字活检:术前无创预测胃癌隐匿性腹膜转移胃癌的精准分期长期面临一个关键瓶颈:常规影像学检查(如CT)对隐匿性腹膜转移(OPM)的检出率低且不稳定,导致大量患者不得不接受有创的诊断性腹腔镜探查。能否在术前无创、准确地识别这些“看不见”的转移灶,从而优化治疗决策?
闲研随记19 天前
论文阅读·人工智能·算法·强化学习·icml·rl算法
【文献阅读 ICML 2026】RL算法:R2VPORL算法:R2VPO这一节,将从策略比值policy ratio的角度重新审视trust-region策略优化算法,并将证明,策略散度divergence的局部几何特征均由策略比值policy ratio的方差variance统一决定。这一发现引出了一种简单且具备理论依据的方案,替代裁剪操作:引入方差正则化目标函数来实现稳定参数更新,同时天然支持离线策略数据复用。
chnyi6_ya19 天前
论文阅读·笔记
论文阅读笔记 | VIDEOPHY: Evaluating Physical Commonsense for Video Generation近年来,文本生成视频(T2V)模型(如 Sora、CogVideoX 等)取得了飞速发展,能够生成高质量、逼真的视频内容。这些模型被认为有潜力成为通用物理世界模拟器——即不仅能生成好看的视频,还能准确模拟现实世界中的物理规律。
0X7820 天前
论文阅读
从随机几何看下行卫星网络覆盖概率分析这篇论文值得读,是因为它把 LEO/VLEO 卫星网络的覆盖性能分析从复杂星座仿真推进到可解析模型。当前研究方向关注 LEO satellite cell-free massive MIMO 下的 millisecond-level SINR prediction,而预测模型最终不能只看 MAE,还要说明预测误差如何影响 coverage probability、链路可用性和用户服务质量。
Eastmount20 天前
论文阅读·网络安全·sci·入侵检测·eswa
[论文阅读] (51)ESWA25 基于启发式优化器的入侵检测系统《娜璋带你读论文》系列主要是督促自己阅读优秀论文及听取学术讲座,并分享给大家,希望您喜欢。由于作者的英文水平和学术能力不高,需要不断提升,所以还请大家批评指正,非常欢迎大家给我留言评论,学术路上期待与您前行,加油。