【深度学习教程——01_深度基石(Foundation)】05_数据太多怎么吃?Mini-batch训练的设计模式

05_数据太多怎么吃?Mini-batch训练的设计模式

本章目标:解决"数据量太大,显存放不下"的问题。从全量训练 (Batch) 进化到分批训练 (Mini-batch)。


📖 目录

  1. [Epoch, Batch, Iteration](#Epoch, Batch, Iteration)
  2. [DataLoader 流水线](#DataLoader 流水线)
  3. [实战:自定义 Dataset](#实战:自定义 Dataset)
  4. [实战:使用 DataLoader](#实战:使用 DataLoader)

1. Epoch, Batch, Iteration

  • Epoch: 所有样本训练一次。
  • Batch Size: 每次喂给模型多少个样本。
  • Iteration: 更新一次参数。

2. DataLoader 流水线

PyTorch 的数据加载是多线程的。

  1. Disk: 数据在硬盘。
  2. Workers:多进程读取。
  3. Queue: 放入内存队列。
  4. Collate: 拼成 Batch Tensor。
  5. GPU: 模型计算。

3. 实战:自定义 Dataset

python 复制代码
from torch.utils.data import Dataset, DataLoader
import torch
import numpy as np

class DiabetesDataset(Dataset):
    def __init__(self, filepath):
        xy = np.loadtxt(filepath, delimiter=',', dtype=np.float32)
        self.len = xy.shape[0]
        self.x_data = torch.from_numpy(xy[:, :-1])
        self.y_data = torch.from_numpy(xy[:, [-1]])

    def __getitem__(self, index):
        return self.x_data[index], self.y_data[index]

    def __len__(self):
        return self.len

dataset = DiabetesDataset('diabetes.csv.gz')
train_loader = DataLoader(dataset=dataset, batch_size=32, shuffle=True, num_workers=2)

4. 实战:使用 DataLoader

python 复制代码
for epoch in range(100):
    for i, data in enumerate(train_loader, 0):
        # 1. Prepare data
        inputs, labels = data
        # 2. Forward
        y_pred = model(inputs)
        loss = criterion(y_pred, labels)
        # 3. Backward
        optimizer.zero_grad()
        loss.backward()
        # 4. Update
        optimizer.step()

➡️ 下一章:06_一层不够怎么办?多层感知机与万能逼近

相关推荐
zhangfeng113310 小时前
国家超算中心 命令行是否会消耗算力卡,找不到显卡,是否需要退出
人工智能·深度学习
renhongxia110 小时前
PostTrainBench:LLM 代理能否自动化 LLM 后培训?
运维·人工智能·深度学习·机器学习·架构·自动化·transformer
吴佳浩11 小时前
Kimi 注意力残差(Attention Residuals)技术深度解读
人工智能·深度学习·llm
向哆哆12 小时前
PCB电路板缺陷检测数据集(近千张图片已划分、已标注)适用于YOLO系列深度学习检测任务
人工智能·深度学习·yolo
Learn Beyond Limits13 小时前
循环神经网络的问题:梯度消失与梯度爆炸|Problems with RNNs: Vanishing and Exploding Gradients
人工智能·rnn·深度学习·神经网络·机器学习·自然语言处理·nlp
龙腾AI白云15 小时前
数字孪生底层逻辑和技术
深度学习·django·flask·fastapi·tornado
Alsian15 小时前
Day45 神经网络调参
深度学习·神经网络·机器学习
sevenlin15 小时前
Spring Boot 经典九设计模式全览
java·spring boot·设计模式
Yeats_Liao15 小时前
OpenClaw(二):配置教程
大数据·网络·人工智能·深度学习·机器学习
忧郁的橙子.15 小时前
03-Hugging Face 模型微调训练(基于 BERT 的中文评价情感分析)
人工智能·深度学习·bert