NumPy 数组 vs PyTorch Tensor

🔍 一、核心区别对比

特性 NumPy 数组 (numpy.ndarray) PyTorch Tensor (torch.Tensor)
诞生背景 传统科学计算、数据分析 深度学习、神经网络
运行设备 只能在 CPU 上运行 既能在 CPU,也能在 GPU/NPU 上加速运行
自动求导 ❌ 不支持(需要自己写反向传播公式) 支持自动求导(AutoGrad)
典型生态 Pandas, SciPy, Matplotlib, Scikit-learn PyTorch, Hugging Face, OpenMMLab

一句话总结

NumPy 是 CPU 上的普通计算工具 ;Tensor 是专为深度学习设计的硬件加速 + 自动求导版"超级 NumPy"


💻 二、具体长什么样子?

我们来看一下它们在 Python 里的代码表现和实际输出:

1. 它们长得有多像?(创建与打印)

python 复制代码
import numpy as np
import torch

# 创建一个 2x3 的 NumPy 数组
arr = np.array([[1.0, 2.0, 3.0], [4.0, 5.0, 6.0]])

# 创建一个 2x3 的 PyTorch Tensor
tensor = torch.tensor([[1.0, 2.0, 3.0], [4.0, 5.0, 6.0]])

print("--- 1. 打印外观 ---")
print("NumPy 数组:\n", arr)
print("\nPyTorch Tensor:\n", tensor)

运行输出长这样:

text 复制代码
--- 1. 打印外观 ---
NumPy 数组:
 [[1. 2. 3.]
  [4. 5. 6.]]

PyTorch Tensor:
 tensor([[1., 2., 3.],
        [4., 5., 6.]])

(可以看到,Tensor 打印出来时外面会多一个 tensor(...) 的包裹标记。)


2. 区别一:能否放到 GPU 上跑?

这是深度学习模型训练速度相差成百上千倍的关键原因。

python 复制代码
# NumPy 数组:只能呆在 CPU 里,无法移到 GPU
# arr.to('cuda')  # ❌ 报错!NumPy 没有这个方法

# PyTorch Tensor:可以随时切换到 GPU
if torch.cuda.is_available():
    tensor_gpu = tensor.to("cuda")  # 🚀 移到 GPU 上运行
    print("\nGPU 上的 Tensor:\n", tensor_gpu)

3. 区别二:自动求导(深度学习的核心)

NumPy 只负责算数值;而 Tensor 可以记录计算过程并自动算导数(梯度)

python 复制代码
# 让 tensor 能够追踪梯度(requires_grad=True)
x = torch.tensor([3.0], requires_grad=True)

# 定义一个函数 y = x^2 + 5
y = x**2 + 5

# 自动进行反向传播(求导 dy/dx = 2x)
y.backward()

print("x 的导数 (dy/dx):", x.grad)  # 当 x=3 时,2*3 = 6

运行输出:

text 复制代码
x 的导数 (dy/dx): tensor([6.])

(如果用 NumPy,你就必须自己手动推导 y′=2xy' = 2xy′=2x 并写代码计算。)


🔄 三、它们之间怎么互相转换?

在日常开发中(比如使用 torch.utils.data.Dataset),我们经常需要让它们相互转换:

1. NumPy 转换为 Tensor

python 复制代码
# 方法 A:torch.from_numpy() ------ 共享内存,效率最高
arr = np.array([1, 2, 3])
tensor_a = torch.from_numpy(arr)

# 方法 B:torch.tensor() ------ 复制一份新的数据
tensor_b = torch.tensor(arr)

2. Tensor 转换为 NumPy

python 复制代码
# 直接调用 .numpy() 即可
tensor = torch.tensor([1.0, 2.0, 3.0])
arr = tensor.numpy()

# ⚠️ 注意:如果在 GPU 上,或者开启了求导,需要先切断关联并移回 CPU
# arr = tensor.detach().cpu().numpy()

  1. 做传统数据处理、绘图时 :用 NumPy(比如读取 CSV 文本、用 Matplotlib 画图)。
  2. 喂给神经网络模型训练时 :必须用 PyTorch Tensor(因为模型需要 GPU 加速和更新权重参数)。
相关推荐
一只小菜鸡..1 小时前
南京大学 操作系统 (JYY) 学习笔记:CPU 的局限、GPU 与 AI 时代的算力革命
人工智能·笔记·学习
AI创界者1 小时前
开源硬核LTX-Video 本地部署整合包教程:超低显存生成高清AI视频,告别云端排队!
人工智能·aigc·音视频
Bruce_Liuxiaowei1 小时前
当AI以可验证的方式攻克数学难题——它如何重写了“科研“的成本与门槛
人工智能·智能体
deepseek232 小时前
MiniMax H3 全模态模型拆解:2K 视频成本被腰斩背后,H3-VAE 和 In-context Regeneration 做了什么
人工智能·多模态·视频生成
智道天成2 小时前
杭州智道天成信息科技有限公司:助力浙江企业合规高效落地
大数据·人工智能·科技
董员外2 小时前
RAG 系统进化论(五):Corrective RAG 与 Self-RAG,让系统发现并纠正错误
人工智能·后端·设计模式
MistyStar2 小时前
Fast 模式为什么更快也更贵:从 Prefill/Decode 到 Batch 经济学
人工智能
小罗水2 小时前
第 20 章 高级 RAG 技术与检索优化
人工智能·python·机器学习
维克兜率天2 小时前
【维克】正则化回归:从Lasso到Ridge:防止过拟合的数学魔法
人工智能·数据挖掘·回归