nvidia

纪伊路上盛名在6 天前
nvidia·工程化·软件·蛋白质·结构预测·推理库
BioIR:生物大分子结构预测推理库参考:https://github.com/NVIDIA-BioNeMo/BioNeMo-Inference-Runtime
hanchenxing6 天前
开发语言·python·ai作画·ai绘画·nvidia
本地AI绘画网关: 用 30 行 Python 把 NVIDIA FLUX.2 Klein 接入 OpenAI 兼容客户端Python很多 AI 绘画客户端只支持 OpenAI 兼容的图片生成接口 POST /v1/images/generations,而 NVIDIA 云端 API 提供的是原生 genai 格式,两者不互通。
码流怪侠8 天前
游戏·github·nvidia
Sunshine 深度拆解:当 NVIDIA GameStream 闭源后,如何用 4 万颗 Star 重建自托管云游戏关键词:Moonlight、NVENC、AMF、Vulkan Video、RTSP、NUT、虚拟手柄、自托管串流 技术栈:C++17 / CMake / FFmpeg libav* / libvirtualhid / Web UI(Vue + Vite) 项目地址:github.com/LizardByte/…
ShallWeL10 天前
人工智能·嵌入式硬件·nvidia·orin
Orin 上多模型常驻与显存预算摘要:单模型检测跑通之后,业务常会叠第二层、第三层:跟踪、属性分类、OCR、偶发小 VLM。Orin 是 统一内存 架构,GPU 引擎、视频缓存、系统进程抢的是同一池物理内存。本文用「四路门店主机:主检 + 跟踪 + 属性 + 可选 OCR」贯穿示例,写清常驻与按需加载怎么划、怎么估预算、怎么用 tegrastats 验收,以及内存吃紧时该减路数、上 DLA 还是升 SKU。适合已跑通多路 DeepStream / 二次推理、准备叠模型的人。具体容量以模组手册与板上实测为准。
每日出拳老爷子14 天前
gpu·nvidia·cuda·ollama·本地大模型
【AI】Ollama 更新后 skipping CUDA 掉回 CPU我这次看到的是 Ollama GitHub issue 里的一组对照日志,不是我在自己 3060 上复现出来的结果。 麻烦的地方在于,Ollama 升到 0.32.14 以后,三十系 / sm_86 显卡不是直接报“CUDA 不可用”,而是日志里跳过 CUDA 设备,最后静默掉回 CPU。 这篇文章只处理这一件事:看到 skipping CUDA device - compute capability not in compiled architectures 时,先判断是不是 0.32.14 的后端库选
晨欣14 天前
笔记·学习·gpu·显卡·nvidia·英伟达
NVIDIA GPU 架构演进学习笔记(GPT-5.6 Terra 生成)更新:2026-09-04 范围:以 NVIDIA 近代独立 GPU 的架构演进为主,重点解释 GeForce RTX 4090、RTX 50 系列,以及专业卡中容易混淆的 “RTX 6000” 命名。
Akiyama_Mio-Kon14 天前
nvidia·github actions·软件供应链安全·本地 ai
计算机每日时报(2026-09-04):NVIDIA 押注开放模型平台,AI 走进天气、办公与本地电脑事件对行业意味着什么对普通人意味着什么确定性NVIDIA 拟收购 Hugging Face开放模型分发平台与算力巨头将深度结合
吴佳浩15 天前
llm·agent·nvidia
32GB 显存,凭什么跑 56GB 大模型?从 Shared Memory 到 AI 异构内存架构从 Shared GPU Memory、CPU Offload 到 GGUF,看懂消费级硬件如何突破显存限制。
Akiyama_Mio-Kon22 天前
aws·nvidia·microsoft 365·github copilot·ai 基础设施·ai agent 安全·excel python
计算机每日时报(2026-08-27):算力继续加码,Agent 先补好安全与交付边界事件行业影响普通人影响确定性NVIDIA 披露 Q2 FY2027 营收 962 亿美元,数据中心 890 亿美元
Zhu75823 天前
nvidia·cuda
GPU驱动与CUDA安装指南服务器部署深度学习 / 推理等 GPU 业务前,需要先安装 NVIDIA 驱动与 CUDA 工具包。本文覆盖:
DogDaoDao1 个月前
机器人·大语言模型·nvidia·机器人模型·智能机器人·图像生成模型·gr00t
GR00T N1 论文深度拆解:英伟达给机器人装上了“快与慢“双系统大脑论文:GR00T N1: An Open Foundation Model for Generalist Humanoid Robots 作者:NVIDIA(研究负责人 Linxi “Jim” Fan、Yuke Zhu) 出处:arXiv:2503.14734 [cs.RO],2025-03-18 开源:模型权重(HuggingFace nvidia/GR00T-N1-2B)、训练数据、仿真基准全量开放 一句话概括:一个 2.2B 参数的视觉-语言-动作(VLA)基础模型,用"System 2 推理 +
ServBay1 个月前
aigc·ai编程·nvidia
NVIDIA NeMo Switchyard 与智能模型路由趋势下,如何统一管理多供应商 API 与协议转换好消息好消息,NVIDIA 开源了 NeMo Switchyard,一个用 Rust 编写的 LLM 流量代理和路由库。Switchyard 提出,并非每个请求都需要调用顶尖模型,通过智能模型路由(Intelligent Model Routing)在多个模型之间按需分配流量,可以在保持效果的同时降低调用成本。
漂流瓶jz1 个月前
人工智能·大模型·llm·openai·nvidia·deepseek·anthropic
一文读懂大模型生态:分类/参数/结构/训练/GPU/评测/排行/社区大模型指参数规模巨大、基于深度神经网络构建的人工智能模型。主要有语言模型,图像视频模型,语音模型,多模态模型(可以同时处理文本图像语音等)。本文主要描述大语言模型,即LLM(Large Language Model)。LLM大语言模型主要使用Transformer架构,在海量文本数据上进行训练,可以理解和生成自然语言。
鬼手点金1 个月前
llm·github·nvidia·apikey·freellmapi·agnes ai·日日新
FreeLLMAPI 介绍FreeLLMAPI 是一个开源的 OpenAI 兼容 API 代理网关,由开发者 tashfeenahmed 创建并托管在 GitHub 上(github.com/tashfeenahmed/freellmapi),目前已有超过 6000 个 Star。
烟锁池塘柳01 个月前
windows·nvidia·显卡驱动
【亲测有效】Windows上更新NVIDIA显卡驱动的方法更新NVIDIA显卡驱动可以通过设备管理器、NVIDIA官网手动下载或GeForce Experience自动更新三种方式完成。本文接下来将详细介绍上述方法。
张忠琳2 个月前
云原生·容器·架构·kubernetes·nvidia
【NVIDIA】k8s-device-plugin v0.19.3 支撑模块深度代码分析之八internal/flags 包负责定义 NVIDIA k8s-device-plugin 所有命令行入口(nvidia-device-plugin、gpu-feature-discovery、mps-control-daemon)共享的基础配置标志。它包含两个文件:
张忠琳2 个月前
云原生·容器·架构·kubernetes·nvidia
【NVIDIA】k8s-device-plugin v0.19.3 标签管理模块 (internal/lm) 深度分析之六internal/lm(Label Manager)模块是 NVIDIA k8s-device-plugin 的标签生成与管理核心模块。其核心职责是:
张忠琳2 个月前
云原生·容器·架构·kubernetes·nvidia
【NVIDIA】k8s-device-plugin v0.19.3 辅助命令模块深度分析之七分析范围:cmd/gpu-feature-discovery、cmd/config-manager、cmd/mps-control-daemon(含 mps 子包及 mount 子包) 版本:v0.19.3 日期:2026-07-26
张忠琳2 个月前
云原生·容器·架构·kubernetes·nvidia
【NVIDIA】NVIDIA k8s-device-plugin v0.19.3 资源管理器模块深度分析之三模块路径: internal/rm 分析版本: v0.19.3 文件数: 11internal/rm 是 NVIDIA k8s-device-plugin 的资源管理核心模块,负责: