技术栈
a100
智码看视界
10 天前
大模型推理
·
推理加速
·
a100
·
tensorrt-llm
·
fp8量化
AI 推理优化实践-TensorRT-LLM 部署:A100 上 Llama-3-70B 吞吐量提升 8 倍
先看 HuggingFace transformers 默认推理路径的瓶颈:问题清单:TensorRT-LLM 就是为消灭这些瓶颈而生的。
程序猿000001号
2 年前
大模型
·
显卡
·
a100
英伟达计算卡概览:显存、性能与NVLink支持
英伟达(NVIDIA)作为全球领先的GPU制造商,其产品不仅在游戏领域占据主导地位,在专业计算、深度学习、科学计算等领域也发挥着重要作用。本文将详细介绍英伟达目前主流的计算卡系列,包括它们的主要规格如显存大小、是否支持NVLink等,并探讨它们各自的应用场景。
我是有底线的