GPU加速与非加速的深度学习张量计算对比Demo,使用PyTorch展示关键差异

import torch

import time

创建大型随机张量 (10000x10000)

tensor_size = 10000

x_cpu = torch.randn(tensor_size, tensor_size)

x_gpu = x_cpu.cuda() # 转移到GPU

CPU矩阵乘法

start = time.time()

result_cpu = torch.mm(x_cpu, x_cpu.t())

cpu_time = time.time() - start

GPU矩阵乘法

torch.cuda.synchronize() # 确保GPU计时准确

start = time.time()

result_gpu = torch.mm(x_gpu, x_gpu.t())

torch.cuda.synchronize()

gpu_time = time.time() - start

print(f"CPU计算时间: {cpu_time:.4f}秒")

print(f"GPU计算时间: {gpu_time:.4f}秒")

print(f"加速比: {cpu_time/gpu_time:.1f}倍")

相关推荐
合米AI SOP系统1 分钟前
3C 电子|手机模组装配工位,合米科技AI SOP 视觉防错破解错漏困局。
人工智能·科技
三小河2 分钟前
AI 对话 "打字机" 是怎么实现的?从 SSE 流式、Markdown 组件到 Nginx 防粘连
前端·人工智能·面试
海浪仙人掌4 分钟前
速动比率怎么分析?速动比率分析有哪些注意事项?
大数据·数据库·人工智能
武子康6 分钟前
SGLang 一加并发就出问题,先查显存还是队列
人工智能·llm·agent
Jared_devin11 分钟前
单头、多头 Self-Attention可视化
人工智能·pytorch·深度学习·算法·机器学习·pycharm
七爷数码AI12 分钟前
通知播报与作业配音:4款文字转语音工具怎么选?
人工智能·语音识别
天国梦17 分钟前
同步课本单词APP怎么选?实测3款才知道真实差距
人工智能·机器学习
昇腾CANN17 分钟前
9月14日直播丨人芯对话:昇腾950算力落地算子的编程范式探索
人工智能·昇腾·cann·cann开源
lucas_AI24 分钟前
TableParseMap:榜单 93 分的表格解析,真实复杂表格只有 85 分
人工智能
还是奇怪24 分钟前
OpenAI GPT-5.6 构建指南拆解:创业公司如何用模型选择与 Responses API 降低 Agent 成本
java·数据库·人工智能·gpt