语言模型

硅谷秋水14 小时前
人工智能·深度学习·计算机视觉·语言模型·机器人
人工智能医疗健康机器人研究综述与分析融合人工智能(AI)的医疗健康机器人已成为现代精准医疗的核心基础设施,覆盖外科手术介入、精准放射治疗、康复辅具、院内护理物流、老年长期照护全场景。本文对主流商用机器人平台与学术原型系统进行标准化分类梳理,分析美敦力、强生医疗、安科锐、Caresyntax 等头部企业代表平台的技术架构、临床流程与性能边界。基于 2018—2026 年18 篇同行评议综述与行业白皮书,将医疗机器人划分为五大标准化品类:手术机器人系统、智能放疗机器人、康复辅具机器人、院内物流陪护机器人、外科智能数据平台;并针对大语言模型(LL
A小码哥17 小时前
人工智能·语言模型
Qwen3.8-Max 模型亮点是阿里巴巴于 2026年8月3日 正式发布的新一代基座大模型。作为千问系列中规模最大、性能最强的旗舰版本,本次更新在模型架构、核心能力以及商业生态上均实现了显著突破。以下是本次更新的核心亮点及对应的测试指标数据:
硅谷秋水19 小时前
深度学习·机器学习·计算机视觉·语言模型·机器人
WAM-Nav:用于统一视觉导航的非对称潜世界动作建模26年6月来自南大、中科院自动化所、中科院大学、中科第五记(FiveAges)、国防大学和极佳科技(GigaAI)的论文“WAM-Nav: Asymmetric Latent World-Action Modeling for Unified Visual Navigation”。
大模型任我行1 天前
人工智能·语言模型·自然语言处理·论文笔记
Meta:动态批大小提升训练效率📖标题:Towards joint scaling laws with optimal batch size schedules 🌐来源:arXiv, 2607.27731v1
Zkaisen2 天前
人工智能·语言模型·自然语言处理
第三章 · 大语言模型基础(详尽展开版)📌 本章定位:前两章讲了“智能体是什么、怎么发展来的”。本章彻底聚焦一个问题——现代智能体的“大脑”(大语言模型)到底是怎么工作的? 学完这章,你要建立一条清晰的技术链:
小白说大模型2 天前
人工智能·语言模型·自然语言处理
LLM(大语言模型)到底是怎么工作的?你有没有想过,当你向 ChatGPT 提问时,它到底是怎么“理解”你的问题,又是怎么组织出那些看起来像模像样的回答的?它真的在思考吗?还是说,它只是某种超级复杂的“鹦鹉学舌”?
牧竹子2 天前
语言模型
大模型-新手安装Ollama以及大模型调用这里我用的是个人笔记本配置在官网选择对应的版本下载 https://ollama.com/download
weixin_446260853 天前
人工智能·语言模型·自然语言处理
通过恶意输入操控大语言模型行为的MCP环境搭建及应用研究https://github.com/harishsg993010/damn-vulnerable-MCP-server
大鱼>5 天前
gpt·语言模型·transformer
从零实现Transformer:手写自注意力到GPT-2级别语言模型2017年,“Attention Is All You Need” 论文以一句"Attention Is All You Need"宣告了 NLP 新时代的到来。Transformer 不依赖 RNN 的序列递归,用纯粹的注意力机制实现了并行训练,支撑了 GPT-4、Claude、Gemini 等所有现代大模型。
张小泡泡4 天前
论文阅读·人工智能·语言模型·自然语言处理·自动化·微调
AUTO_EVAL:面向大语言模型的多层次自动化评测框架github.com/zhangshuwei932-ai/AUTO_EVAL — MIT License,欢迎 Star 与贡献。
zzzll11114 天前
人工智能·语言模型·自然语言处理
Ollama:本地运行大型语言模型的轻量级解决方案Ollama 是一个开源工具,允许开发者在本地计算机上轻松运行、管理和部署大型语言模型(LLM)。它通过将模型权重、配置和数据打包到一个统一的 Modelfile 中,简化了本地 LLM 的获取和运行过程。用户只需一条简单的命令行指令,即可启动一个功能完整的模型服务。
如此这般英俊4 天前
数据结构·人工智能·python·语言模型·自然语言处理·prompt
手搓Claude Code-第十章 system_prompt例如:还记得上一章末尾那个有关prompt的问题吗?紧接着本章就是在解决它。如果你写过最简单的 LLM Agent,你的system prompt大概长这样:
liyunlong-java4 天前
语言模型
部署Qwen2.5-VL-3B-Instruc视觉模型的教程libgl1 和 libglib2.0-0 是 OpenCV / Pillow 处理图像时的运行时依赖,缺失会导致多模态图片预处理报错。
leoZ2314 天前
java·人工智能·spring·生成对抗网络·语言模型·自然语言处理·llama
本地跑大模型实战(七):llama.cpp 性能调优,让推理更快更省本文是《本地大模型搭应用实战》系列第 7 篇。前面六篇解决了"能不能用"——部署、量化、API、tool call、RAG、agent。本篇解决"用得爽不爽"。同一台机器同一个模型,配置不同,token/s 能差好几倍。
硅谷秋水4 天前
深度学习·机器学习·语言模型·机器人·音视频
EgoSteer:一种基于第一人称视角视频、实现可控灵巧操作的全栈系统26年7月来自北大、灵初智能和UPenn的论文“EgoSteer: A Full-Stack System Towards Steerable Dexterous Manipulation from Egocentric Videos”。
AndrewHZ5 天前
人工智能·深度学习·算法·语言模型·大模型·llm·芯片开发
【LLM技术全景】阶段总结:技术原理篇核心知识回顾摘要从 6月22日 到 7月30日(实际发布节奏因补稿略有顺延),技术原理篇的 11 篇文章把"一个大模型是怎样炼成、怎样跑起来、又怎样被对齐与评估"这件事讲透了。
不喝水的鱼儿6 天前
ide·vscode·语言模型·copilot·llama
本地部署 260K 上下文 Qwen-3.6-35B-A3B 与 Ornith-1.0-35B 模型及 VSCode Copilot 参数调优记录在本地构建编程 AI Agent 的过程中,算力约束始终是核心瓶颈。本文记录在 RTX 5060 Ti 16G 显存条件下,如何本地部署高上下文(260K)MoE(Mixture of Experts)模型并将其接入 VSCode Copilot 的工作流。
WA内核拾荒者5 天前
人工智能·语言模型·php
WhatsApp 多语言 AI 对话的语言模型选择与本地化适配很多团队在第一次做国际化产品时,思路是:先写好中文/英文的 prompt 模板,然后调 Google Translate / DeepL API 把用户输入翻译成英文再喂给模型,最后把输出翻译回目标语言。这个方案能跑通,但很快会遇到四类问题:
Zzj_tju5 天前
人工智能·笔记·学习·语言模型·自然语言处理
Instruction Tuning 论文精读路线:从 Supervised Fine-Tuning 到 Instruction Following系列:AI 论文盘点 / 技术趋势:AI 论文精读与复现训练营 日期:2026-08-03 适合读者:研究生、准备做大模型后训练方向的科研新人、有工程背景但想系统理解 SFT 与指令遵循的读者 建议前置:理解语言模型预训练、交叉熵损失、prompt、few-shot/zero-shot、Transformer 基本结构和常见 LLM benchmark
为啥全要学5 天前
人工智能·算法·语言模型
在大语言模型上使用 PPO 算法下面从零实现一个在大语言模型上使用 PPO 算法的完整系统。整体分为 四大模型 + 六大核心模块,每个模块都有完整的 PyTorch 代码、输入输出说明和数据流图。