语言模型

有Li1 小时前
人工智能·笔记·算法·语言模型·医学生
【AI答疑】MR数据预处理步骤原问题MR的DICOM数据经过数据格式转换、N4矫正,我下一步应该进行标准化还是归一化是不是选一个就可以?
阡陌数智3 小时前
人工智能·语言模型·自然语言处理
基于大语言模型的通用可配置 PII 隐私数据检测方案数据合规与隐私保护已从过去的例行审计要求,转化为现代软件工程体系中的硬性实时约束。随着企业将海量的非结构化文本注入检索增强生成(RAG)管道、客户服务系统以及分析型数据湖,精准识别与脱敏个人身份信息(PII)变得至关重要。传统的命名实体识别(NER)方案(例如基于 BERT 的微调模型或依赖正则表达式的开箱即用引擎)在面对特定行业实体、隐式上下文标识符或多义词时,往往表现出极大的局限性。
user_admin_god3 小时前
java·人工智能·spring boot·语言模型
第 11 篇:实践三 —— 表单 / 合同字段抽取源码定位字段抽取做的事,是把一段非结构化文本变成一行数据库记录 —— 合同、发票、简历、病历、快递单都是这个套路。
gravity_w4 小时前
人工智能·深度学习·语言模型·llm·nlp·flops·cs336
【CS336】Lecture 2 PyTorch 与资源核算(Resource Accounting)我们的核心目标是在给定有限资源(算力、内存、数据)的情况下训练出最好的模型,数据在本课程中不是真正的瓶颈,目标是最大化训练的计算效率。在优化计算效率之前,我们需要理解某一个具体计算的效率,因此,需要理解其计算特性和内存特性。 问题 1:在 1024 张 H100 上训练一个 700 亿参数、1.5 万亿 token 的模型需要多长时间?
像素科技4 小时前
语言模型
什么是LLM大语言模型LLM = Large Language Model,大语言模型 是基于深度学习、Transformer架构,用海量文本数据训练、拥有超大规模参数(数十亿~万亿级)的人工智能模型,核心能力是理解、生成人类语言,能像人一样对话、写作、推理、翻译、总结。
硅谷秋水5 小时前
机器学习·计算机视觉·语言模型·机器人
GE-Act 2.0:面向机器人操作的“世界-动作”模型预训练与扩展26年9月来自智元机器人研究组(Agibot)的论文“GE-Act 2.0: Pretraining and Scaling a World-Action Model for Robotic Manipulation”。
Chloe.Zz6 小时前
人工智能·语言模型·自然语言处理
提示词工程在初学提示词的时候,很容易对”工程“这个词感到困惑,会觉得我和AI对话不就是输入一堆自然语言么,怎么能和工程扯上关系。
海上小飞龙17 小时前
人工智能·语言模型·自然语言处理
LangChain 模型调用:invoke、stream、batch 到底该怎么选?调模型这件事,看起来就一句话:把请求发过去,把结果拿回来。但结果怎么返回,有三种常见的调用方式。一种是等它整个生成完再给你,一种是边生成边往外送,还有一种是一次发一批。
richard_first21 小时前
人工智能·深度学习·语言模型·自然语言处理·transformer
第3章 PTQ:不用重新训练也能量化 LLM前两章我们已经知道:LLM 之所以需要量化,很大程度上是因为模型参数太多,高精度权重会带来巨大的存储和显存开销。例如一个 7B 模型,如果参数使用 FP16:
iNeuOS工业互联网1 天前
人工智能·物联网·3d·语言模型·工业互联网
大模型(DeepSeek)辅助 3D 实时建模 + 拖拽配置:业务可视化应用快速构建实践(标注、巡检与视角控制等)大模型(DeepSeek)辅助 3D 实时建模 + 拖拽配置:业务可视化应用快速构建实践(标注、巡检与视角控制等)
二炮手亮子1 天前
java·语言模型·ai编程
使用云服务+hermes+mino模型 我用微信操控服务器自己编程并部署实操下面把我的完整搭建过程记录下来,供有类似需求的朋友参考。先看整体流程:微信发中文指令Hermes 通道
sevenez1 天前
人工智能·语言模型
火山引擎 AI 云原生架构笔记:方舟、AgentKit、HiAgent 三层关系梳理适合读者:AI 产品经理、技术决策者、准备接触火山引擎体系的开发者 写作视角:以产品经理视角梳理架构逻辑,重点讲清楚"每层是干什么的、怎么选、怎么配合" 说明:本文基于火山引擎公开资料与个人项目调研整理,具体能力与计费以官方最新文档为准
user_admin_god2 天前
java·人工智能·spring boot·语言模型·devops
第 01 篇:OpenAI 兼容 API 初探 —— 用 curl 跑通第一次对话系列:《Java 大模型应用开发入门》第 01 篇。 源码范围:mock-llm-server。这一篇一行 Java 都不写。
johnsong2 天前
人工智能·语言模型
GPT-6 Astra 的能力数字与对齐声明:哪些能信近期多个来源同时描述 GPT-6 Astra。OpenAI 发布页列出“Astra在一次尝试中解决了 88.0% 的任务,在四次尝试中解决了 99.2% 的任务,而GPT‑5.6 的解决率分别为 55.9% 和 68.7%分别是Sol。” lesswrong 的《Estimating GPT-6 Astra’s no-CoT Time Horizon》把 50% TH 放在“Astra 的 50% TH 处于 [8 分钟,1 小时] 内,可能约为 15-40 分钟。” hn-frontpage 讨论循环
譕痕2 天前
java·ide·spring·语言模型
Idea 集成 智能体开发工具“千问(qwen)”一.准备工作:1.下载idea开发工具 必须2025.3版本及以上,2025.3版本以下不支持集成智能体开发。
user_admin_god2 天前
java·人工智能·spring boot·语言模型
第 09 篇:实践一 —— 文本摘要(Map-Reduce 分块)系列:《Java 大模型应用开发入门》第 09 篇。 源码定位:文本摘要看起来是最简单的 AI 场景:一段文本进去,一段摘要出来,一个提示词的事。
Behaviour2 天前
人工智能·语言模型·aigc·ai编程
豆包手机助手消费者版发布:首款量产 AI 智能体手机 9 月 16 日开售2026 年 9 月 14 日,字节跳动正式发布豆包手机助手消费者版。两天后的 9 月 16 日 14:00,首发机型努比亚 NaviX Ultra 正式发布并开售,被多家媒体称为「全球首款 AI 智能体手机」。硬件由中兴努比亚与字节联合研发。
user_admin_god2 天前
java·人工智能·spring boot·语言模型
第 05 篇:结构化输出 —— 让模型稳定返回 JSON系列:《Java 大模型应用开发入门》第 05 篇。 源码定位:com.example.llm.util.AiJsonUtils、com.example.llm.dto.chat.ResponseFormat、com.example.llm.service.AiInvoker#chatJson、com.example.llm.prompt.Prompts。
nagualky1232 天前
人工智能·机器学习·语言模型·软件工程
AI Agent上线后怎么升级?先建立一套可回滚的变更控制AI Agent 上线后,最危险的改动往往不是大规模重构,而是看起来很小的调整:换一个模型别名、改两句系统提示词、增加一个工具参数,或者替换一批知识库文档。它可能修好一个样本,同时悄悄破坏另一个场景。
AI人工智能+2 天前
深度学习·计算机视觉·语言模型·自然语言处理·ocr·文档抽取
了一种融合OCR与大模型的文档抽取系统,解决传统OCR“识字不识意”的痛点你有没有过这样的经历:周一早晨刚坐下,面对桌上堆成山的采购合同、海外发票和法律文书,还没开始喝口水,心里就一阵发慌。眼睛盯着密密麻麻的文字,手指在键盘上机械地敲击,不仅腰酸背痛,还生怕看错一个数字导致后续麻烦不断。