【P19 机器学习-分类算法及应用实践】手写数字识别(KNN)

手写字识别

  • 1 手写字的识别 (KNN)
    • 1.1 读取训练集
    • 1.2 读取测试集
    • 1.3 完整程序

1 手写字的识别 (KNN)

通过0,1二值化把手写数字,变化成矩阵

32*32

1.1 读取训练集

python 复制代码
import numpy as np 
from os import listdir  # 读取文件夹下的所有文件,形成一个文件列表

# 图片转矩阵
def img2vector(filename):
    returnVect = np.zeros((1,1024)) # 每个图片矩阵32*32,存为1行
    fr = open(filename)
    for i in range(32):
        lineStr = fr.readline()
        for j in range(32):
            returnVect[0,32*i+j] = int(lineStr[j])
    return returnVect

#读取数据
hwLabels = []
trainingFileList = listdir('E:\\Progarm\\Py_Program\\HandwritingRecognition\\trainingDigits')
m = len(trainingFileList)
trainingMat = np.zeros((m,1024))
for i in  range(m):
    fileNameStr=trainingFileList[i]
    fileStr = fileNameStr.split('.')[0]
    classNumStr = int(fileStr.split('_')[0])
    hwLabels.append(classNumStr)
    trainingMat[i,:] = img2vector('E:\\Progarm\\Py_Program\\HandwritingRecognition\\trainingDigits\\%s' % fileNameStr)
python 复制代码
print(trainingFileList)
print(hwLabels)
print(trainingMat)



1.2 读取测试集

python 复制代码
# 读取测试集,执行KNN分类
testFileList = listdir('E:\\Progarm\\Py_Program\\HandwritingRecognition\\testDigits')
k = 3
errorCount = 0.0
mTest = len(testFileList)
for i in range(mTest):
    fileNameStr = testFileList[i]
    fileStr = fileNameStr.split('.')[0]
    classNumStr = int(fileStr.split('_')[0])
    vectorUnderTest = img2vector('E:\\Progarm\\Py_Program\\HandwritingRecognition\\testDigits\\%s' % fileNameStr)
    classifierResult = K.knn(vectorUnderTest,trainingMat,hwLabels,k)
    print('KNN识别的结果是: %d , 实际是: %d' % (classifierResult,classNumStr))
    if classifierResult != classNumStr:
        errorCount +=1.0
python 复制代码
print('训练集数量: %d ,测试集数量: %d' % (m,mTest))
print('错误识别数 : %d , 正确率 : %f ' % (errorCount , (1-errorCount/float(mTest))*100))

1.3 完整程序

python 复制代码
import numpy as np 
from os import listdir # 读取文件夹下的所有文件
import knn as K

# 图片转矩阵
def img2vector(filename):
    returnVect = np.zeros((1,1024)) # 每个图片矩阵32*32,存为1行
    fr = open(filename)
    for i in range(32):
        lineStr = fr.readline()
        for j in range(32):
            returnVect[0,32*i+j] = int(lineStr[j])
    return returnVect

#读取训练集数据
hwLabels = []
trainingFileList = listdir('E:\\Progarm\\Py_Program\\HandwritingRecognition\\trainingDigits')
m = len(trainingFileList)
trainingMat = np.zeros((m,1024))
for i in  range(m):
    fileNameStr = trainingFileList[i]
    fileStr = fileNameStr.split('.')[0]
    classNumStr = int(fileStr.split('_')[0])
    hwLabels.append(classNumStr)
    trainingMat[i,:] = img2vector('E:\\Progarm\\Py_Program\\HandwritingRecognition\\trainingDigits\\%s' % fileNameStr)


#print(trainingFileList)
#print(hwLabels)
#print(trainingMat)


# 读取测试集,执行KNN分类
testFileList = listdir('E:\\Progarm\\Py_Program\\HandwritingRecognition\\testDigits')
k = 3
errorCount = 0.0
mTest = len(testFileList)
for i in range(mTest):
    fileNameStr = testFileList[i]
    fileStr = fileNameStr.split('.')[0]
    classNumStr = int(fileStr.split('_')[0])
    vectorUnderTest = img2vector('E:\\Progarm\\Py_Program\\HandwritingRecognition\\testDigits\\%s' % fileNameStr)
    classifierResult = K.knn(vectorUnderTest,trainingMat,hwLabels,k)
    print('KNN识别的结果是: %d , 实际是: %d' % (classifierResult,classNumStr))
    if classifierResult != classNumStr:
        errorCount +=1.0
  
print('训练集数量: %d ,测试集数量: %d' % (m,mTest))
print('错误识别数 : %d , 正确率 : %f ' % (errorCount , (1-errorCount/float(mTest))*100))
相关推荐
毕竟是shy哥2 小时前
计算YOLO数据集中每个类的目标数
算法·yolo·机器学习
VL——MOESR3 小时前
【具身智能】VLA论文阅读随笔
论文阅读·人工智能·机器学习·具身智能·vla
傲笑风3 小时前
【openvino】tinybert基于openvino服务化部署(四)
人工智能·python·自然语言处理·nlp·bert·openvino
方银的技术分享4 小时前
十五、AI训练师:机器学习-过拟合与欠拟合
人工智能·深度学习·机器学习
维基框架4 小时前
WIKI 知识库 v1.1.1 正式发布
人工智能·python
罗西的思考4 小时前
【OpenClaw具身硬件】ZeroClaw 源码阅读笔记(3)--- RAG
人工智能·算法·机器学习
戴西软件6 小时前
戴西iDWS.3DViz Suite数据轻量化可视化软件,从传统桌面软件向云端协同的重大突破
大数据·运维·网络·人工智能·机器学习·3d
谢白羽8 小时前
SGLang的AWQ量化笔记
笔记·python·sglang
迷迭香yy8 小时前
基金档案数据工程实战从收入分析到持仓穿透的Python解析 IG50免费开源股票数据API接口
开发语言·python
清水白石0088 小时前
Python 类型设计深度解析:TypedDict 能否替代 dataclass?从 JSON 数据边界到 API 设计的最佳实践
java·python·json