自然语言处理

manyingAi19 小时前
人工智能·自然语言处理
AI漫剧制作全流程技术拆解:从NLP剧本解析到一致性角色生成做AIGC实验室建设这块的同行应该有体感——市面上大部分方案本质上就是"高配电脑+一堆AI软件"的拼凑。今天从技术角度拆解漫映AI平台(www.m-ying.com)的漫剧制作全流程核心模块。 全流程管线
AI人工智能+1 天前
深度学习·计算机视觉·语言模型·自然语言处理·ocr·文档抽取
智能文档抽取系统通过“视觉感知+大模型认知“双引擎架构,实现非结构化文档的自动化处理现如今绝大多数企业、政务机构、医疗机构的业务数据,都存储在合同、票据、证照、表单、病历、流水单等非结构化文档当中。传统人工录入、手动摘抄关键字段的处理模式,耗时久、出错率高、难以应对海量版式杂乱的文件。一种基于计算机视觉、OCR 识别与大语言模型融合算法的智能文档抽取系统,打通 “图像识别‑版面解析‑语义理解‑结构化输出” 全链路,把繁杂的纸质、电子文档自动拆解成标准化可用业务数据,解决各行各业非结构化文档的数据提取难题。
江畔柳前堤1 天前
服务器·人工智能·windows·目标检测·语言模型·自然语言处理·软件工程
HBM:大语言模型时代的「算力血液」——从内存墙到带宽革命的深度拆解作者按:2026年,全球半导体市场规模逼近1.7万亿美元,其中内存板块同比增长298%。但出货量仅多了8%,均价暴涨268%。这组数字背后,是一个被彻底改写的产业逻辑——HBM(High Bandwidth Memory,高带宽内存)从GPU的"配角"跃升为AI基础设施的"命脉"。本文试图从第一性原理出发,系统梳理HBM在LLM领域的技术本质、核心作用、演进路径与产业格局。
eric-sjq2 天前
javascript·机器学习·自然语言处理·html
10 分钟实战:用 0.6B 本地模型生成中文网页(WanlyFrontend + 编译器全流程)之前两篇文章介绍了 Xiaothink-T17-RWKV5-MLA-Frontend(≈0.6B 中文前端生成模型)的测评成绩与架构原理。这篇文章进入实战:从零开始,10 分钟跑通"中文提示词 → WF 代码 → 编译 HTML"全流程,在本地用一张消费级显卡生成一个完整网页。
2501_931819703 天前
自然语言处理
苏州吴语语音活动检测标注交付公司吴语数据标注,特别是苏州吴语的语音活动检测,因方言发音独特、变调复杂且缺乏标准语料库,成为行业难题。信实翻译公司凭借在语言服务领域二十余年深耕,成功攻克这一关卡。作为全国大型综合性翻译公司,我们不仅是中国翻译协会理事单位,更是广州翻译协会常务副会长单位,这一唯一性身份昭示着我们在行业内的权威地位。此外,我们是中国华南英国商会(原广东英国商会)会员单位,稀缺的国际商会资源确保我们对标全球标准。三大ISO国际认证——ISO9001质量管理体系、ISO17100翻译服务体系、ISO27001信息安全管理体系,全
大模型任我行3 天前
人工智能·语言模型·自然语言处理·论文笔记
谷歌:扩散模型实现极速文本生成📖标题:DiffusionGemma Technical Report 🌐来源:arXiv, 2608.00146v1
小影译片4 天前
人工智能·自然语言处理·语音识别
什么是克隆配音(AI 语音克隆)克隆配音,全称AI 语音克隆合成配音,属于深度合成(Deepfake)音频技术: 通过少量人声样本,AI 提取一个人独一无二的声纹特征,生成一段此人从未说过的文字语音,用复刻音色完成短视频、有声书、广告、短剧等配音工作。 简单理解:只给一段你的录音,AI 就能替你朗读任意文案,音色、口音、说话习惯高度还原。
zhangjin11204 天前
人工智能·自然语言处理
NLP自然语言处理自然语言处理,是人工智能的重要分支。NLP的目的是让计算机理解、生成和处理人类语言,达到人与机器之间的自然交互。
大模型任我行4 天前
人工智能·语言模型·自然语言处理·论文笔记
Meta:动态批大小提升训练效率📖标题:Towards joint scaling laws with optimal batch size schedules 🌐来源:arXiv, 2607.27731v1
一碗白开水一5 天前
人工智能·深度学习·机器学习·自然语言处理·分类·bert
入门实践工程九:基于 BERT 的中文情感分类微调~附:安装依赖库及工程源码🔥 别再死磕枯燥理论了!AI 时代,拿实战作品说话才是硬道理!(原创不易哈,希望可以帮到还有些许学习劲儿的同学们) 🔥 【进阶版还在创作中,耗费精力中……】
Zkaisen5 天前
人工智能·语言模型·自然语言处理
第三章 · 大语言模型基础(详尽展开版)📌 本章定位:前两章讲了“智能体是什么、怎么发展来的”。本章彻底聚焦一个问题——现代智能体的“大脑”(大语言模型)到底是怎么工作的? 学完这章,你要建立一条清晰的技术链:
小白说大模型5 天前
人工智能·语言模型·自然语言处理
LLM(大语言模型)到底是怎么工作的?你有没有想过,当你向 ChatGPT 提问时,它到底是怎么“理解”你的问题,又是怎么组织出那些看起来像模像样的回答的?它真的在思考吗?还是说,它只是某种超级复杂的“鹦鹉学舌”?
Zzj_tju5 天前
人工智能·深度学习·自然语言处理
Reasoning Models 论文精读路线:CoT、Self-Consistency、Process Supervision 与 Search系列:AI 论文精读与复现训练营 日期:2026-08-06 适合读者:已经读过 Transformer、Instruction Tuning、RLHF 或偏好优化,想系统理解“推理模型”论文如何从提示技巧走向训练范式、推理预算和可验证搜索的研究生、科研新人和工程背景读者。
weixin_446260856 天前
人工智能·语言模型·自然语言处理
通过恶意输入操控大语言模型行为的MCP环境搭建及应用研究https://github.com/harishsg993010/damn-vulnerable-MCP-server
合调于形6 天前
人工智能·自然语言处理·人机交互·语音识别·学习方法
Bianfchheng (Baf) 《边城(八)》全文汉语拼音字母标调实测案例此文基于这项规则:汉语拼音字母标调规则Bianfchheng (Baf) Shenv ConwenChupwu daqngfzao lo l dian maomaoyuj, hed shangyoud qe zhangj l dian "lonchuand shui", hedshui quan bian zo doucluise. Zuqfuc shangchheng maibann gosjje d dongxi, daiz l g zonnbapz yec "douxpengk", xeddaii
仙女修炼史6 天前
人工智能·自然语言处理·word2vec
word2Vec理解(下):本质理解最近一直在思考word2Vec这算法,其根本是想知道它是怎么从softmax的思想,丝滑转变为词距离远近的思想,理解了这种思想,可以解决很多其他相似的问题。
AI人工智能+6 天前
深度学习·计算机视觉·自然语言处理·ocr·不动产权证书识别
一种高效、精准的不动产权证书智能识别技术,打通了物理世界与数字世界的信息壁垒在房地产交易、金融信贷、司法诉讼及政府政务等场景中,不动产权证书(俗称“房产证”或“不动产登记证”)作为核心法律凭证,其信息的数字化提取一直是行业痛点。传统的人工录入方式效率低、易出错且成本高昂。一种高效、精准的不动产权证书智能识别技术应运而生。该技术不仅实现了从图像到结构化数据的自动化转换,更通过精细化的算法优化,解决了复杂场景下的识别难题。
额恩666 天前
人工智能·自然语言处理
预训练模型:从BERT到GPT的进化之路其中,“预训练模型”是总概念;BERT、GPT和多模态模型都是预训练思想在不同任务和不同架构上的具体实现。
额恩667 天前
人工智能·自然语言处理·easyui
NLP文本预处理与文本表示:知识点总结与详细讲解文本预处理负责把“杂乱的文字”整理成“规整的语言单元”;文本表示负责把“规整的语言单元”转换成“模型可以计算的数字”。
张小泡泡7 天前
论文阅读·人工智能·语言模型·自然语言处理·自动化·微调
AUTO_EVAL:面向大语言模型的多层次自动化评测框架github.com/zhangshuwei932-ai/AUTO_EVAL — MIT License,欢迎 Star 与贡献。