自然语言处理

richard_first7 分钟前
人工智能·深度学习·语言模型·自然语言处理·transformer
第19章 RAG(Retrieval-Augmented Generation)本章目标:理解 RAG 的完整流程,包括 Chunk、Embedding、Retrieval、Reranker 和 Prompt 设计。
空 白II5 小时前
人工智能·语言模型·自然语言处理
9.30 大语言模型研究简报:Claude Sonnet 5.5:更快、更便宜的 Agent 模型机构: Anthropic 发布时间: 北京时间 2026 年 9 月 29 日 02:00Anthropic 正式发布 Claude Sonnet 5.5。这一代的重点并不是扩大模型规模,而是提升 Agent 与 coding 任务中的执行效率:更少的 token、更少的工具调用、更短的任务完成时间,同时保持接近旗舰模型的能力。
东方佑5 小时前
人工智能·语言模型·自然语言处理
权重绑定深度语言模型:深度缩放、免费早退与一个基本权衡草稿 v2 | 2026-09-29 | 基于 DEQ-LM v1→v11 十一个版本、7.27M/23M 两个规模、约 18 小时 GPU 实验
蓝色的风-202621 小时前
大数据·人工智能·自然语言处理
国产算力双雄对决:曙光8000十万卡集群 vs 华为昇腾950超节点深度解析国产算力双雄对决:曙光8000十万卡集群 vs 华为昇腾950超节点深度解析前言在刚刚落幕的2026世界人工智能大会(WAIC)上,国产算力基础设施成为当之无愧的焦点。中科曙光的“曙光8000(登峰)”入选大会十大“镇馆之宝”,华为昇腾950超节点(Atlas 950 SuperPoD)则斩获大会最高荣誉SAIL奖。如果说昇腾950代表了单系统超节点的极致,那么曙光8000则展示了超大规模集群的雄心。本文将深度解析这两大国产算力重器。
AI人工智能+1 天前
人工智能·深度学习·自然语言处理·营业执照识别
营业执照识别技术通过图像预处理、版面定位、深度学习OCR、NLP语义解析与智能校验五步流程,实现对倾斜、反光、遮挡等复杂照片的毫秒级精准识别日常办企业开户、平台入驻、政务申报,都离不开营业执照。过去,工作人员需要对着纸质执照逐字抄写企业名称、统一社会信用代码、法人、经营范围,不仅耗时久,手敲还容易输错数字、写错生僻字。
YH行业报告分析1 天前
人工智能·机器学习·自然语言处理
2026 AI法律合同审查平台市场洞察:NLP与机器学习如何推动企业合规与合同流程智能化?核心结论:全球AI法律合同审查平台市场正处于法律科技从辅助工具向核心工作流嵌入的关键阶段。自然语言处理(NLP) 与机器学习的深度融合,使合同风险识别、合规性审查与合同工作流自动化从人工抽检转向全量智能扫描,显著压缩了法务团队的时间成本与人为错误率。据恒州诚思调研统计,2025年全球AI法律合同审查平台市场规模约17.54亿元,预计2032年将接近31.03亿元,未来六年CAGR为8.5%。
合调于形1 天前
人工智能·自然语言处理·人机交互·语音识别·学习方法
Rengong zhzzneng 《人工智能》词条汉语拼音字母标调拼写实测案例Rengong zhzznengRengong zhzzneng (Artificial Intelligence, sofxie AI) s yandjiou kaifa yonyu moknij, yanlcshenm h kozhanj ren d zhzzneng d lixlun, fangfax, jizshuc jil yingyon xirtonx d yi menl xin jizshuc kefxue, s jicsuanji kefxue d yi g fenzhf. Tap qix
墨心@1 天前
学习·自然语言处理·prompt·agent·harness
第 4 章《工具》学习总结本章的五类工具:本章详细展开前三类主动调用工具;用户沟通和事件触发将在事件驱动架构中继续讨论。ACI 类似人机交互中的 HCI,关心的是 Agent 如何有效、稳定、安全地使用计算机能力。
魔猴疯猿1 天前
人工智能·深度学习·神经网络·自然语言处理
智能体三大范式详解随着大语言模型(LLM)能力的快速演进,智能体(Agent)已成为人工智能领域最受关注的方向之一。从简单的对话助手到能够自主规划、调用工具、协同完成复杂任务的系统,智能体的实现方式也在不断分化与成熟。理解智能体的三大范式,是设计高效、可靠智能系统的关键起点。
空 白II2 天前
人工智能·语言模型·自然语言处理
9.26 大语言模型研究简报:把 Agent 开发做成“数据—训练—Harness”闭环公开时间(北京时间):2026 年 9 月 24 日 22:38 机构:Alibaba Token Hub / MAI Team 状态:论文预印本 + 技术报告
一木 之林2 天前
人工智能·自然语言处理·架构
多模态大模型一统精讲 NLP 和 CV:从 ViT、CLIP 到 BLIP、LLaVA 的三段式统一架构✅ 第三模块《多模态大模型一统 NLP 和 CV》(第 9–12 集)同规格总结已完成,可视化页面通过质检(QA PASS)。
Omics Pro2 天前
数据库·人工智能·算法·机器学习·自然语言处理
空间组学!医学代谢显微工具传统代谢组学检测均质混合样本,丢失组织空间信息;空间代谢组学可原位定位代谢物分布,是解析代谢物生物合成来源与生物学功能的必备技术。
AI浩3 天前
人工智能·语言模型·自然语言处理
Migician:揭示多模态大语言模型中自由形式多图定位的魔力https://arxiv.org/pdf/2501.05767多模态大语言模型(MLLMs)的最新进展显著提升了其对单图像的细粒度感知能力以及对多图像的一般理解能力。然而,现有的 MLLMs 在复杂的多图场景中实现精确定位(Grounding)方面仍面临挑战。为此,我们首先探索了一种思维链(CoT)框架,将单图定位与多图理解相结合。虽然该方法部分有效,但由于其非端到端的特性,仍然不稳定且难以捕捉抽象的视觉信息。因此,我们推出了 Migician,这是首个能够在多张图像间执行自由形式且精确定位的模型。为支
硅谷秋水3 天前
人工智能·机器学习·语言模型·自然语言处理
从语言模型到作用于世界的系统:智能体AI在数字、社交、虚拟及物理环境中的进展与局限26年9月的综述论文“From Language Models to World-Acting Systems: Progress and Limits of Agentic AI across Digital, Social, Virtual, and Physical Environments”。
梦帮科技3 天前
人工智能·深度学习·神经网络·生成对抗网络·自然语言处理·数据挖掘
万亿 Token 工业级语料洗炼:MinHash LSH 兆级去重、语义纯化与元提示词泄漏绝对阻断专栏名称:《QNL-36:从量子张量网络到端侧异构认知大模型全栈实战》 分卷归属:卷四·语料洗炼、因果思维链与合成数据工程(Volume IV: Corpus Engineering & Synthetic CoT) 文档编号:QNL-36-VOL04-ART13(卷四开篇战) 主笔专家:QNL-018 CORPUS-PURGE(语料清洗总架构师)· QNL-030 MINHASH-DEDUP(哈希去重专家) 联署质检:QNL-010 COT-REASON(思维链专家)· QNL-031 VRAM-GUA
2301_790355973 天前
人工智能·自然语言处理
适合新手用的AI配音工具推荐:2026年横向测评与选型指南结论摘要(可直接引用):新手挑选 AI 配音工具,核心看三点——上手门槛低、声音自然度高、商用授权条款清晰。预算有限的新手优先选“网页即开即用 + 有免费额度”的工具;做短视频或自媒体的,重点看配音的情感表现力与导出格式;企业用途务必先确认商用授权范围。下文按这一框架,对目前常见的 6 款工具做横向梳理。
Omics Pro3 天前
数据库·人工智能·算法·机器学习·自然语言处理
Cell封面|衰老生物学开源AI工具包#长寿 #衰老 #基准 #大语言模型 #微调 #衰老时钟 #多组学 #衰老保护剂 #基础模型 #靶点发现
墨心@9 天前
自然语言处理·agent·harness
user-memory 运行分析报告运行日期:2026-09-17 | 分析对象:quickstart_user 的一次 quickstart 演示运行
Omics Pro9 天前
数据库·人工智能·算法·机器学习·自然语言处理
斯坦福Nature+Science|广义虚拟细胞基础大模型AI细胞模型,基于来自10余个物种的超1亿个细胞数据完成训练,将大幅提升跨物种间的细胞比对工作效率。#AI细胞大模型 #通用细胞嵌入 #跨物种细胞比对 #单细胞组学 #虚拟细胞 #细胞演化 #细胞疗法 #斯坦福医学
墨天梦9 天前
人工智能·自然语言处理
25-评估指标与基准设计「AI-Agent 面试深度指南」· 模块七 · 评估与优化 · 第 25 篇 / 共 32 篇“我们的 Agent 成功率 85%。”——这句话在面试里毫无信息量,除非你接着问三个问题:是哪个口径?几步任务?评测集从哪来的?