自然语言处理

AndrewHZ15 小时前
人工智能·gpt·深度学习·语言模型·自然语言处理·llm·多模态
【LLM技术全景】多模态大模型:当语言模型学会“看“和“听“摘要回顾本系列前 17 篇,我们一直在和文本 Token打交道:Tokenization、Embedding、Self-Attention、预训练、对齐……所有机制都建立在"一串离散文本符号"之上。
workflower17 小时前
人工智能·机器学习·设计模式·自然语言处理·机器人
情境感知系统情境感知系统(context-aware system):若一个系统运用情境,根据用户当前任务状况对用户提 供相应的信息或者服务,那么这个系统就是情境感知的。- DEY.A.K.(CMU)
EIConferenceEmma2 天前
人工智能·自然语言处理·人机交互
9月份海口站,第二届人工智能、人机交互与自然语言处理国际学术会议(ICAHN 2026)会议亮点重要信息会议官网:www.ic-ahn.net会议时间:2026年9月18-20日会议地点:中国·海口
贺国亚2 天前
自然语言处理
数据管道-训练数据集与版本化🏠 返回 README | ⬅️ 04-MLOps-CI-CD-CT流水线.md | ➡️ 09-批量推理-离线打分与回填.md
狂奔solar3 天前
人工智能·自然语言处理·word2vec
漫话Word2Vec:从离散符号到语义向量空间从离散符号到语义向量空间——一场跨越25幕的知识冒险!小可(好奇地探头):计算机看到「苹果」这个词,到底在想什么?
Summer-Bright3 天前
大数据·人工智能·ai·自然语言处理·芯片·agi
AI 芯片简报 07.21-07.24:NVIDIA Vera 亮剑、AMD 2nm GPU、Google 叛逃 CoWoS每期覆盖 3-4 天的 AI 芯片动态。个人视角,不追求面面俱到——只讲我认为重要的。周二、五更新。7 月 21 日到 24 日这四天,AI 芯片行业发生的事,放在任何一个正常的年份,都够写一个季度的头条。NVIDIA、AMD、Intel 三巨头在 72 小时内密集出牌,不是巧合——是所有人都看到了同一个信号:CPU 在 AI 系统中的角色正在从配角变主角。
workflower3 天前
人工智能·机器学习·设计模式·自然语言处理·机器人
供应链分销网络选址问题供应链管理的战略与企业的竞争战略必须匹配,即竞争战略中满足顾客需求优先的目标与供应链管理战略旨在建立的供应链的能力目标之间相互协调一致。在新的竞争环境下,制造企业为了获取竞争优势,必须高效率、低成本地响应和满足顾客的需求。供应链管理的中心逐渐向需求转移,供应链也更多的表现为由顾客和市场驱动的“需求链”。根据制造业企业竞争战略的调整,其供应链管理战略相应地更强调及时响应顾客的需求、低成本高质量的为顾客提供产品和服务。在持续多变的市场环境中,企业必须根据需要及时地将各种适当的资源集成在一起,供应链的快速重构和
就是一顿骚操作3 天前
人工智能·自然语言处理·word2vec·论文解读
词嵌入 word2vec:Skip-Gram 与 CBOW 经典解读原文:Dive into Deep Learning classic 0.17.6, Word Embedding (word2vec) 作者:Aston Zhang、Zachary C. Lipton、Mu Li、Alexander J. Smola 原页面版本信息:D2L classic 0.17.6;页面 HTTP Last-Modified 为 2022-11-13 授权说明:D2L 英文开源书正文采用 Creative Commons Attribution-ShareAlike 4.0 Int
学习中.........4 天前
人工智能·机器学习·语言模型·自然语言处理
从 Karpathy 手写 BPE 到 CS336 `train_bpe` 作业实现这次 train_bpe 的实现过程,大体分成两个阶段:参考视频是 Karpathy 的手写 tokenizer 讲解:Bilibili 视频链接。
可触的未来,发芽的智生4 天前
javascript·人工智能·python·程序人生·自然语言处理
发现-元认知技能,激起神经符号系统跃变已实现元认知技能后的系统评价:从知识库到认知主体的质变词元自动识别语义类别pcf1.cn 探索可解释AI路径
蓦然回首却已人去楼空4 天前
人工智能·语言模型·自然语言处理
Build a Large Language Model (From Scratch) 第五章 在无标签数据上进行预训练本章内容到目前为止,我们已经实现了数据采样和注意力机制,并编写了大语言模型架构的代码。是时候实现训练函数并对大语言模型进行预训练了。在本章中,我们将学习基本的模型评估技术,以衡量生成文本的质量,这是在训练过程中优化大语言模型的必要条件。此外,我们还将讨论如何加载预训练权重,为大语言模型微调奠定扎实的基础。图 5-1 概述了我们的整体计划,并强调了本章将讨论的内容。
大模型任我行4 天前
人工智能·语言模型·自然语言处理·论文笔记
蚂蚁:智能体安全护栏SingGuard-NSFA📖标题:SingGuard-NSFA: Extensible Guardrails for Agentic AI via Generative Reasoning and Real-Time Classification 🌐来源:arXiv, 2607.13081v1
我登哥MVP5 天前
人工智能·python·深度学习·神经网络·机器学习·自然语言处理·pip
Headroom 深度指南:AI Agent 上下文压缩实战一句话定位:Headroom 是一个本地优先、可逆、内容感知的 LLM 上下文压缩层。它坐在你的 AI Agent 与大模型之间,把工具输出、日志、RAG 片段、文件、对话历史这些「要喂给模型的内容」在送达 LLM 之前先做一轮智能瘦身——同样的答案,只用几分之一的 Token。
OpenApi.cc5 天前
人工智能·深度学习·目标检测·自然语言处理·语音识别
Mocode 开发文档平台Mocode Docs Platform探索 Mocode 编程语言,从基础语法到高级特性
Summer-Bright6 天前
android·人工智能·ios·ai·自然语言处理·agi
消费者 AI 变现竞争:从“一家独大“到“iOS vs Android“,谁在为 AI 买单?2026 年上半年,全球消费者 AI 市场发生了三个结构性变化,组合在一起定义了一个新时代:份额重构:ChatGPT MAU 突破 11 亿,但全球市场份额从 2024 年 3 月的 81% 跌至 46.4%——"一家独大"时代正式终结。Claude 以 640% 年增速达到 2.45 亿 MAU(10.3%),Gemini 以 132% 增速达到 6.62 亿 MAU(27.7%)。三家合计占据 89% 的使用时长。
BIGmustang7 天前
自然语言处理
战神book本地部署ollama+千问本文主要介绍部署本地模型 Ollama 是一个让你在本地电脑运行大语言模型的工具。 核心功能下面介绍在windows系统部署使用
Summer-Bright7 天前
人工智能·ai·自然语言处理
NVIDIA Vera CPU 深度解读:Olympus 自研核心为什么是 Agentic AI 的关键拼图NVIDIA 昨天(7 月 21 日)发布了 Vera CPU 的技术博客和架构白皮书。这可能是 NVIDIA 迄今为止最详细的一次 CPU 技术披露——从 Olympus 核心的微架构到双路 NUMA 拓扑,全摊开了。
大模型任我行7 天前
人工智能·语言模型·自然语言处理·论文笔记
阿里:端到端文档解析模型OvisOCR2📖标题:OvisOCR2 Technical Report 🌐来源:arXiv, 2607.13639v1
KAU的云实验台8 天前
人工智能·语言模型·自然语言处理
【研究分享】大语言模型 × 进化计算新范式? —— 以ReEvo为例拆解本文核心内容最近KAU研究了大语言模型和进化算法的结合相关论文,发现这个方向挺有意思,让我觉得LLM能够给进化计算加上“语义上的方向感”,该领域的研究进展也是日新月异。 因此,本文KAU对该研究方向作一些个人层面的梳理与分享,供大家参考讨论 (如有错漏,欢迎随时拍砖指正)
想会飞的蒲公英8 天前
人工智能·python·自然语言处理
计算机怎样读取中文文本:编码、清洗与标准化文本分类项目看起来是在训练模型,但第一步其实不是模型,而是让计算机正确读取文本。如果一开始就乱码、混入奇怪符号、空白不统一,后面的分词、TF-IDF 和模型训练都会受到影响。这一课先解决一个基础问题:中文文本进入模型之前,应该怎样读取、清洗和标准化。