GPU加速与非加速的深度学习张量计算对比Demo,使用PyTorch展示关键差异

import torch

import time

创建大型随机张量 (10000x10000)

tensor_size = 10000

x_cpu = torch.randn(tensor_size, tensor_size)

x_gpu = x_cpu.cuda() # 转移到GPU

CPU矩阵乘法

start = time.time()

result_cpu = torch.mm(x_cpu, x_cpu.t())

cpu_time = time.time() - start

GPU矩阵乘法

torch.cuda.synchronize() # 确保GPU计时准确

start = time.time()

result_gpu = torch.mm(x_gpu, x_gpu.t())

torch.cuda.synchronize()

gpu_time = time.time() - start

print(f"CPU计算时间: {cpu_time:.4f}秒")

print(f"GPU计算时间: {gpu_time:.4f}秒")

print(f"加速比: {cpu_time/gpu_time:.1f}倍")

相关推荐
luckystar513~2 分钟前
自己动手写Agent Harness【agent tools】:给它装手和眼睛(工具注册与执行流水线)
人工智能
工具分享13 分钟前
陪跑跟品爆单AI选品助手,高效跟品会赔本吗?
人工智能·python
COOLMO研究AI26 分钟前
Python 如何实现 AI API 的提示词(Prompt)版本管理与热更新
人工智能·python·prompt
官乐28 分钟前
AI面试指南(多agent开发流程)
人工智能·面试·职场和发展
学习zhao极致it30 分钟前
AI量化交易训练营(完结)
人工智能
老郑聊AI业财智造30 分钟前
Transformer 技术架构与源码分析
人工智能·python·深度学习·语言模型·架构·transformer·软件工程
Summer-Bright36 分钟前
Hot Chips 开幕、NVIDIA 财报 8/26、Rubin 首验 —— AI 芯片简报 08.20-08.22
人工智能·英伟达·财报·hot chip·rubin
RAOY的AI笔记1 小时前
ChatGPT账号安全设置教程:MFA、活跃会话、数据导出与异常登录处理
人工智能·安全·chatgpt
水如烟1 小时前
孤能子视角:华夏“科学”回望·04兵法与治理–––“处”的关系场感知
人工智能
招财小梗1 小时前
AI矩阵获客,品牌连锁落地方案揭秘
大数据·人工智能·矩阵