语言模型

硅谷秋水2 小时前
机器学习·计算机视觉·语言模型·机器人
RoboLab:用于分析机器人任务通才策略的高-保真仿真基准26年4月来自Nvidia、多伦多大学和悉尼大学的论文“RoboLab: A High-Fidelity Simulation Benchmark for Analysis of Task Generalist Policies”。
johnsong14 小时前
人工智能·语言模型
效率的边界:当推理突破遇见语言革命DeepSeek V4.1 Flash 将 KV Cache 压缩到极限,显存节省超 60%。Goose 语言实测比 C++ 快 16%,同时保证内存安全。Bend 语言要求 AI 生成代码时附带数学证明。EOS Token 蒸馏中的「长度膨胀」问题首次被系统量化——发现 AI 蒸馏出来的小模型不只是"笨一点",还可能是"啰嗦很多"。四件事指向同一个坐标:效率革命的深水区,不再只是"让大象跑得更快",而是"重新设计跑道"。
Dawson Zhu17 小时前
人工智能·语言模型·架构·aigc·agi
RAG 检索中的两个误区:高相似度不等于正确,向量检索也不能替代关键词检索摘要:在 RAG(Retrieval-Augmented Generation)系统中,"召回"是决定最终答案质量的第一道关口。本文从一个直观现象切入——Top1 相似度 0.94,但正确答案可能是 Top2——分析语义相似度与业务正确性之间的错位,并进一步讨论为何在企业级场景中,向量检索必须与传统关键词检索结合(Hybrid Search)。文中涉及 Metadata 过滤、两阶段检索(Bi-Encoder + Cross-Encoder Rerank)、结果融合策略等工程实践。
小马过河R17 小时前
人工智能·语言模型·llm·agent·ai编程·deepagent
开篇|3天从0到1入门AI应用开发AI 应用工程师 · 系列课程15 课 + 收官篇,带你走完 AI 应用工程师成长之路作者:小马过河R · 认知 → 原理 → 基础能力 → Agent 进阶 → 综合实战
牛马工作号21 小时前
人工智能·语言模型·llama
RK3588 使用 rk-llama.cpp + RKNPU2 部署 Qwen3.5:从零开始的 NPU 本地大模型实战图 1:本文以 RK3588 上的文本推理为目标。板卡为概念示意,CPU 与三核 NPU 均属于 RK3588 SoC。
书源丶1 天前
网络·语言模型·embedding·llama
Qwen3-Embedding-0.6B 纯 CPU😫 痛点引入:4 核小机器跑个 0.6B 的 embedding 模型,一条长文本要等 一百多秒? 内存常年顶满、swap 疯狂读写、CPU 明明闲着却慢得离谱? 网上一搜全是「vLLM + FP16 + FlashAttention」,可你这台机器连个独显都没有🤡?
有Li2 天前
人工智能·笔记·算法·语言模型·医学生
【AI答疑】MR数据预处理步骤原问题MR的DICOM数据经过数据格式转换、N4矫正,我下一步应该进行标准化还是归一化是不是选一个就可以?
阡陌数智2 天前
人工智能·语言模型·自然语言处理
基于大语言模型的通用可配置 PII 隐私数据检测方案数据合规与隐私保护已从过去的例行审计要求,转化为现代软件工程体系中的硬性实时约束。随着企业将海量的非结构化文本注入检索增强生成(RAG)管道、客户服务系统以及分析型数据湖,精准识别与脱敏个人身份信息(PII)变得至关重要。传统的命名实体识别(NER)方案(例如基于 BERT 的微调模型或依赖正则表达式的开箱即用引擎)在面对特定行业实体、隐式上下文标识符或多义词时,往往表现出极大的局限性。
user_admin_god2 天前
java·人工智能·spring boot·语言模型
第 11 篇:实践三 —— 表单 / 合同字段抽取源码定位字段抽取做的事,是把一段非结构化文本变成一行数据库记录 —— 合同、发票、简历、病历、快递单都是这个套路。
gravity_w2 天前
人工智能·深度学习·语言模型·llm·nlp·flops·cs336
【CS336】Lecture 2 PyTorch 与资源核算(Resource Accounting)我们的核心目标是在给定有限资源(算力、内存、数据)的情况下训练出最好的模型,数据在本课程中不是真正的瓶颈,目标是最大化训练的计算效率。在优化计算效率之前,我们需要理解某一个具体计算的效率,因此,需要理解其计算特性和内存特性。 问题 1:在 1024 张 H100 上训练一个 700 亿参数、1.5 万亿 token 的模型需要多长时间?
像素科技2 天前
语言模型
什么是LLM大语言模型LLM = Large Language Model,大语言模型 是基于深度学习、Transformer架构,用海量文本数据训练、拥有超大规模参数(数十亿~万亿级)的人工智能模型,核心能力是理解、生成人类语言,能像人一样对话、写作、推理、翻译、总结。
硅谷秋水2 天前
机器学习·计算机视觉·语言模型·机器人
GE-Act 2.0:面向机器人操作的“世界-动作”模型预训练与扩展26年9月来自智元机器人研究组(Agibot)的论文“GE-Act 2.0: Pretraining and Scaling a World-Action Model for Robotic Manipulation”。
Chloe.Zz2 天前
人工智能·语言模型·自然语言处理
提示词工程在初学提示词的时候,很容易对”工程“这个词感到困惑,会觉得我和AI对话不就是输入一堆自然语言么,怎么能和工程扯上关系。
海上小飞龙2 天前
人工智能·语言模型·自然语言处理
LangChain 模型调用:invoke、stream、batch 到底该怎么选?调模型这件事,看起来就一句话:把请求发过去,把结果拿回来。但结果怎么返回,有三种常见的调用方式。一种是等它整个生成完再给你,一种是边生成边往外送,还有一种是一次发一批。
richard_first3 天前
人工智能·深度学习·语言模型·自然语言处理·transformer
第3章 PTQ:不用重新训练也能量化 LLM前两章我们已经知道:LLM 之所以需要量化,很大程度上是因为模型参数太多,高精度权重会带来巨大的存储和显存开销。例如一个 7B 模型,如果参数使用 FP16:
iNeuOS工业互联网3 天前
人工智能·物联网·3d·语言模型·工业互联网
大模型(DeepSeek)辅助 3D 实时建模 + 拖拽配置:业务可视化应用快速构建实践(标注、巡检与视角控制等)大模型(DeepSeek)辅助 3D 实时建模 + 拖拽配置:业务可视化应用快速构建实践(标注、巡检与视角控制等)
二炮手亮子3 天前
java·语言模型·ai编程
使用云服务+hermes+mino模型 我用微信操控服务器自己编程并部署实操下面把我的完整搭建过程记录下来,供有类似需求的朋友参考。先看整体流程:微信发中文指令Hermes 通道
sevenez3 天前
人工智能·语言模型
火山引擎 AI 云原生架构笔记:方舟、AgentKit、HiAgent 三层关系梳理适合读者:AI 产品经理、技术决策者、准备接触火山引擎体系的开发者 写作视角:以产品经理视角梳理架构逻辑,重点讲清楚"每层是干什么的、怎么选、怎么配合" 说明:本文基于火山引擎公开资料与个人项目调研整理,具体能力与计费以官方最新文档为准
user_admin_god4 天前
java·人工智能·spring boot·语言模型·devops
第 01 篇:OpenAI 兼容 API 初探 —— 用 curl 跑通第一次对话系列:《Java 大模型应用开发入门》第 01 篇。 源码范围:mock-llm-server。这一篇一行 Java 都不写。
johnsong4 天前
人工智能·语言模型
GPT-6 Astra 的能力数字与对齐声明:哪些能信近期多个来源同时描述 GPT-6 Astra。OpenAI 发布页列出“Astra在一次尝试中解决了 88.0% 的任务,在四次尝试中解决了 99.2% 的任务,而GPT‑5.6 的解决率分别为 55.9% 和 68.7%分别是Sol。” lesswrong 的《Estimating GPT-6 Astra’s no-CoT Time Horizon》把 50% TH 放在“Astra 的 50% TH 处于 [8 分钟,1 小时] 内,可能约为 15-40 分钟。” hn-frontpage 讨论循环