fp8 量化笔记

你的 RTX 5060 Ti 依然属于 Ada Lovelace 架构 (消费级 GPU),和 RTX 5060 类似,它 没有 Hopper 架构的 FP8 Tensor Core。

FP8 张量运算目前 只在 NVIDIA Hopper GPU(H100)和部分 A100 Tensor Core 上得到硬件支持。

各代 GPU 精度支持总结:

架构 / 系列 FP32 FP16 BF16 INT8 FP8
30 系 (Ampere, 3060/3070/3080/3090) ✅ ✅ ❌(需要模拟) ✅ ❌
40 系 (Ada Lovelace, 4060/4070/4080/4090) ✅ ✅ ❌(模拟) ✅ ❌
50 系 (Ada Lovelace 消费级, 5060/5060 Ti) ✅ ✅ ❌ ✅ ❌
100 系 (Hopper, H100) ✅ ✅ ✅ ✅ ✅
相关推荐
liron718 小时前
技术的诞生与演化--技术自举及其冷启动
人工智能·深度学习·神经网络·自然语言处理
知产xiao_xin8 小时前
商标权的内容和限制
经验分享·笔记·知识产权
知几蜗牛8 小时前
Java 17 视觉识别结果的金额与字段门禁实现
人工智能
嘻嘻的AI日记8 小时前
人工合规审查有盲区,智能合规如何补足文件风险识别短板
人工智能
UBIX泛联8 小时前
机器人展风采,存储筑根基——泛联应邀参展电子科技大学70周年校庆展
人工智能·机器人·ai算力基础设施
知几蜗牛8 小时前
Python + JSON Schema 实现工单结构化输出与本地复核
人工智能
陈年老古董8 小时前
Hive 函数学习笔记(上):单行函数与炸裂函数
hive·笔记·学习
Purple Coder8 小时前
Jc的图像分析
人工智能
楚楚2518 小时前
2026企业AI办公工具选型指南:从需求匹配到平台评估
大数据·人工智能
三小河8 小时前
从 Markdown 到 Generative UI:AI 如何从“生成答案”进化到“生成界面”?
前端·人工智能·后端