day37简单的神经网络@浙大疏锦行

day37简单的神经网络@浙大疏锦行

使用 sklearn 的 load_digits 数据集 (8x8 像素的手写数字) 进行 MLP 训练。

python 复制代码
import torch
import torch.nn as nn
import torch.optim as optim
from sklearn.datasets import load_digits
from sklearn.model_selection import train_test_split
from sklearn.preprocessing import MinMaxScaler
import numpy as np
import matplotlib.pyplot as plt

# 1. 加载数据
digits = load_digits()
X = digits.data
y = digits.target

print(f"数据形状: {X.shape}")
print(f"标签形状: {y.shape}")

# 查看一张图片
plt.imshow(digits.images[0], cmap='gray')
plt.title(f"Label: {y[0]}")
plt.show()

数据形状: (1797, 64) 标签形状: (1797,)

python 复制代码
# 2. 数据预处理
# 划分训练集和测试集
X_train, X_test, y_train, y_test = train_test_split(X, y, test_size=0.2, random_state=42)

# 归一化
scaler = MinMaxScaler()
X_train = scaler.fit_transform(X_train)
X_test = scaler.transform(X_test)

# 转换为 Tensor
X_train = torch.FloatTensor(X_train)
y_train = torch.LongTensor(y_train)
X_test = torch.FloatTensor(X_test)
y_test = torch.LongTensor(y_test)

print("训练集 Tensor 形状:", X_train.shape)
print("测试集 Tensor 形状:", X_test.shape)

训练集 Tensor 形状: torch.Size(1437, 64)

测试集 Tensor 形状: torch.Size(360, 64)

python 复制代码
# 3. 定义模型
class MLP(nn.Module):
    def __init__(self):
        super(MLP, self).__init__()
        # 输入层 64 (8*8像素) -> 隐藏层 32 -> 输出层 10 (0-9数字)
        self.fc1 = nn.Linear(64, 32)
        self.relu = nn.ReLU()
        self.fc2 = nn.Linear(32, 10) 
    
    def forward(self, x):
        out = self.fc1(x)
        out = self.relu(out)
        out = self.fc2(out)
        return out

model = MLP()
print(model)

MLP(

(fc1): Linear(in_features=64, out_features=32, bias=True) (relu): ReLU()

(fc2): Linear(in_features=32, out_features=10, bias=True)

)

python 复制代码
# 4. 定义损失函数和优化器
criterion = nn.CrossEntropyLoss()
optimizer = optim.SGD(model.parameters(), lr=0.1) # 学习率稍微调大一点,或者增加epoch
python 复制代码
# 5. 训练模型
num_epochs = 2000
losses = []

for epoch in range(num_epochs):
    # 前向传播
    outputs = model(X_train)
    loss = criterion(outputs, y_train)
    
    # 反向传播和优化
    optimizer.zero_grad()
    loss.backward()
    optimizer.step()
    
    losses.append(loss.item())
    
    if (epoch + 1) % 100 == 0:
        print(f'Epoch [{epoch+1}/{num_epochs}], Loss: {loss.item():.4f}')
python 复制代码
# 6. 可视化损失
plt.plot(range(num_epochs), losses)
plt.xlabel('Epoch')
plt.ylabel('Loss')
plt.title('Training Loss')
plt.show()
python 复制代码
# 7. 模型评估
with torch.no_grad():
    # 训练集准确率
    outputs_train = model(X_train)
    _, predicted_train = torch.max(outputs_train, 1)
    accuracy_train = (predicted_train == y_train).sum().item() / y_train.size(0)
    
    # 测试集准确率
    outputs_test = model(X_test)
    _, predicted_test = torch.max(outputs_test, 1)
    accuracy_test = (predicted_test == y_test).sum().item() / y_test.size(0)
    
    print(f'训练集准确率: {accuracy_train:.4f}')
    print(f'测试集准确率: {accuracy_test:.4f}')

@浙大疏锦行

相关推荐
我就是不信3 分钟前
深入理解 Python 虚拟机:字典(dict)的优化
开发语言·python·哈希算法
晚风醉蝶5 分钟前
YOLO11图标点选验证码识别实战
python·目标检测·验证码识别·yolo11
打工仔折腾 AI16 分钟前
多台服务器日志分散难查?用Promtail+Loki+Grafana搭建集中检索平台
服务器·人工智能·后端·python·性能优化·django·grafana
ysu_031417 分钟前
uv实战指南-从Python版本虚拟环境到pyproject依赖管理
开发语言·python·pip·uv·虚拟环境·包管理·依赖管理
打工仔折腾 AI28 分钟前
DiPlay 实测:iPhone 绕过硬件盒子直连 BYD 车机的思路拆解
android·人工智能·后端·python·gradle·iphone·ai agent 实战
老歌老听老掉牙5 小时前
空间曲线数据的拼接与几何变换分析
python·曲线
databook9 小时前
使用 SciPy 库进行时间序列分析
python·数据分析·scipy
java资料站9 小时前
十一、评估测试
开发语言·人工智能·python
szial9 小时前
网络爬虫与 CDP 实战(二):浏览器能访问,Python 却被拒绝?拆开登录态与 CSRF
爬虫·python·csrf
青少儿编程课堂10 小时前
后缀自动机解析:本质不同子串与最长重复片段统计
c++·python·算法·bfs·信息学竞赛