nvidia

wflynn2 天前
开源·c#·github·nvidia·amd·directx12
GitHub 今日推荐|SCSKiller:游戏着色器预编译消除卡顿项目地址:https://github.com/BlueHeisenberg/SCSKillerSCSKiller 在游戏未运行时预编译着色器并写入显卡驱动缓存,游戏启动后直接读取编译结果,避免首次遇到新效果时因即时编译导致的画面卡顿。仅支持 Windows 10 (version 2004) 或 11 的 64 位系统,支持 NVIDIA 和 AMD 显卡的 DirectX 12 游戏,NVIDIA 还支持 DirectX 11 游戏。
kakakahahahaha5 天前
windows·电脑·笔记本电脑·nvidia·软件需求
LoadLibrary failed with error 87 排查:ERROR_INVALID_PARAMETER、DLL路径、架构与显卡驱动1. Error 87全称是ERROR_INVALID_PARAMETER(参数不正确),表示传递给LoadLibrary函数的参数无效或格式错误
智码看视界9 天前
nvidia·模型部署·mlops·triton·gpu推理·推理服务化·动态批处理
AI 推理优化 | Triton Inference Server 架构解析:单机多模型并发推理的工业级方案一个典型的算法团队,线上跑的模型往往不止一个:CV 类、NLP 类、推荐类、自研 PyTorch 模型。最常见的"朴素部署"是:
My的梦想已实现19 天前
nvidia·显卡驱动·魔改·代工显卡
代工显卡驱动更新之前贪便宜买了一张3060 M的魔改显卡,驱动非常老,官网也不更新了,还是几年前买显卡的时候售后给发的一个驱动安装包。无论打游戏 ,还是跑个本地AI都力不从心,无意中发现了显卡驱动升级助手。非常好用!!!传送门 :显卡驱动升级助手 · 26/9/14更新 - 小南瓜的站
DeeplyMind19 天前
nvidia·uvm
Part 2.1 — uvm_va_block_t 解剖:每页位图与 PTE 状态Part 2 核心数据结构与内存管理开篇。适用代码:kernel-open/nvidia-uvm/关联源码:uvm_va_block.h、uvm_va_block_types.h、uvm_va_block.c
纪伊路上盛名在1 个月前
nvidia·工程化·软件·蛋白质·结构预测·推理库
BioIR:生物大分子结构预测推理库参考:https://github.com/NVIDIA-BioNeMo/BioNeMo-Inference-Runtime
hanchenxing1 个月前
开发语言·python·ai作画·ai绘画·nvidia
本地AI绘画网关: 用 30 行 Python 把 NVIDIA FLUX.2 Klein 接入 OpenAI 兼容客户端Python很多 AI 绘画客户端只支持 OpenAI 兼容的图片生成接口 POST /v1/images/generations,而 NVIDIA 云端 API 提供的是原生 genai 格式,两者不互通。
码流怪侠1 个月前
游戏·github·nvidia
Sunshine 深度拆解:当 NVIDIA GameStream 闭源后,如何用 4 万颗 Star 重建自托管云游戏关键词:Moonlight、NVENC、AMF、Vulkan Video、RTSP、NUT、虚拟手柄、自托管串流 技术栈:C++17 / CMake / FFmpeg libav* / libvirtualhid / Web UI(Vue + Vite) 项目地址:github.com/LizardByte/…
ShallWeL1 个月前
人工智能·嵌入式硬件·nvidia·orin
Orin 上多模型常驻与显存预算摘要:单模型检测跑通之后,业务常会叠第二层、第三层:跟踪、属性分类、OCR、偶发小 VLM。Orin 是 统一内存 架构,GPU 引擎、视频缓存、系统进程抢的是同一池物理内存。本文用「四路门店主机:主检 + 跟踪 + 属性 + 可选 OCR」贯穿示例,写清常驻与按需加载怎么划、怎么估预算、怎么用 tegrastats 验收,以及内存吃紧时该减路数、上 DLA 还是升 SKU。适合已跑通多路 DeepStream / 二次推理、准备叠模型的人。具体容量以模组手册与板上实测为准。
每日出拳老爷子1 个月前
gpu·nvidia·cuda·ollama·本地大模型
【AI】Ollama 更新后 skipping CUDA 掉回 CPU我这次看到的是 Ollama GitHub issue 里的一组对照日志,不是我在自己 3060 上复现出来的结果。 麻烦的地方在于,Ollama 升到 0.32.14 以后,三十系 / sm_86 显卡不是直接报“CUDA 不可用”,而是日志里跳过 CUDA 设备,最后静默掉回 CPU。 这篇文章只处理这一件事:看到 skipping CUDA device - compute capability not in compiled architectures 时,先判断是不是 0.32.14 的后端库选
晨欣1 个月前
笔记·学习·gpu·显卡·nvidia·英伟达
NVIDIA GPU 架构演进学习笔记(GPT-5.6 Terra 生成)更新:2026-09-04 范围:以 NVIDIA 近代独立 GPU 的架构演进为主,重点解释 GeForce RTX 4090、RTX 50 系列,以及专业卡中容易混淆的 “RTX 6000” 命名。
Akiyama_Mio-Kon1 个月前
nvidia·github actions·软件供应链安全·本地 ai
计算机每日时报(2026-09-04):NVIDIA 押注开放模型平台,AI 走进天气、办公与本地电脑事件对行业意味着什么对普通人意味着什么确定性NVIDIA 拟收购 Hugging Face开放模型分发平台与算力巨头将深度结合
吴佳浩1 个月前
llm·agent·nvidia
32GB 显存,凭什么跑 56GB 大模型?从 Shared Memory 到 AI 异构内存架构从 Shared GPU Memory、CPU Offload 到 GGUF,看懂消费级硬件如何突破显存限制。
Akiyama_Mio-Kon1 个月前
aws·nvidia·microsoft 365·github copilot·ai 基础设施·ai agent 安全·excel python
计算机每日时报(2026-08-27):算力继续加码,Agent 先补好安全与交付边界事件行业影响普通人影响确定性NVIDIA 披露 Q2 FY2027 营收 962 亿美元,数据中心 890 亿美元
Zhu7581 个月前
nvidia·cuda
GPU驱动与CUDA安装指南服务器部署深度学习 / 推理等 GPU 业务前,需要先安装 NVIDIA 驱动与 CUDA 工具包。本文覆盖:
DogDaoDao2 个月前
机器人·大语言模型·nvidia·机器人模型·智能机器人·图像生成模型·gr00t
GR00T N1 论文深度拆解:英伟达给机器人装上了“快与慢“双系统大脑论文:GR00T N1: An Open Foundation Model for Generalist Humanoid Robots 作者:NVIDIA(研究负责人 Linxi “Jim” Fan、Yuke Zhu) 出处:arXiv:2503.14734 [cs.RO],2025-03-18 开源:模型权重(HuggingFace nvidia/GR00T-N1-2B)、训练数据、仿真基准全量开放 一句话概括:一个 2.2B 参数的视觉-语言-动作(VLA)基础模型,用"System 2 推理 +
ServBay2 个月前
aigc·ai编程·nvidia
NVIDIA NeMo Switchyard 与智能模型路由趋势下,如何统一管理多供应商 API 与协议转换好消息好消息,NVIDIA 开源了 NeMo Switchyard,一个用 Rust 编写的 LLM 流量代理和路由库。Switchyard 提出,并非每个请求都需要调用顶尖模型,通过智能模型路由(Intelligent Model Routing)在多个模型之间按需分配流量,可以在保持效果的同时降低调用成本。
漂流瓶jz2 个月前
人工智能·大模型·llm·openai·nvidia·deepseek·anthropic
一文读懂大模型生态:分类/参数/结构/训练/GPU/评测/排行/社区大模型指参数规模巨大、基于深度神经网络构建的人工智能模型。主要有语言模型,图像视频模型,语音模型,多模态模型(可以同时处理文本图像语音等)。本文主要描述大语言模型,即LLM(Large Language Model)。LLM大语言模型主要使用Transformer架构,在海量文本数据上进行训练,可以理解和生成自然语言。
鬼手点金2 个月前
llm·github·nvidia·apikey·freellmapi·agnes ai·日日新
FreeLLMAPI 介绍FreeLLMAPI 是一个开源的 OpenAI 兼容 API 代理网关,由开发者 tashfeenahmed 创建并托管在 GitHub 上(github.com/tashfeenahmed/freellmapi),目前已有超过 6000 个 Star。