【Python机器学习】线性模型——用于多分类的线性模型

很多线性分类模型只使用与二分类问题,将二分类算法推广到多分类算法的一种常见方法是"一对其余"方法。在"一对其余"方法中,对每个类别都学习一个二分类模型,将这个类别和其他类别尽量区分,这样就生成了与类别数相同的二分类模型数。在测试点上运行所有分类器进行预测,在对应类别上分数最高的分类器"胜出",将这个类别标签范围作为预测结果。

多分类Logistics回归背后的数学与"一对其余"方法稍有不同,但也是对每个类别都有一个系数向量和一个截距,也使用了同样的预测方法。

以一个三分类的二维数据集为例:

python 复制代码
from sklearn.datasets import make_blobs
import matplotlib.pyplot as plt
import mglearn
from sklearn.svm import LinearSVC
import numpy as np


plt.rcParams['font.sans-serif']=['SimHei']
X,y=make_blobs(random_state=42)
mglearn.discrete_scatter(X[:,0],X[:,1],y)
plt.ylim(-10,15)
plt.xlim(-10,10)
plt.xlabel('0')
plt.ylabel('1')
plt.legend(['类别0','类别1','类别2'],loc=(1.01,0.3))

plt.show()

在这个数据集上训练LinearSVC分类器:

python 复制代码
line_svc=LinearSVC().fit(X,y)
print('coef_形状:{}'.format(line_svc.coef_.shape))
print('intercept_形状:{}'.format(line_svc.intercept_.shape))

可以看到coef_的形状是(3,2),说明coef_每行包括三个分类之一的系数向量,每列包含某个特征对应的系数值。

对3个二类分类器给出可视化:

训练集中所有属于类别0的点都在与类别0对应的直线上方,说明他们位于这个二类分类器属于类别0的那一侧。没有直接和某类点在同一个区域的点,属于"其余"部分。"其余"部分,属于分类方程结果最大的那个类别,即最近的的那条线对应的类别:

相关推荐
江畔柳前堤4 小时前
AgentScope 设计与原理全解:从消息原语到分布式智能体工程底座
大数据·人工智能·分布式·目标检测·机器学习·语言模型·架构
北斗落凡尘4 小时前
LangGraph 入门实战(10)--时光回溯
python·langchain
今天AI了吗4 小时前
Agent & AI 名词大扫盲
数据库·人工智能·python·sql·rust
张张123y4 小时前
Hermes Agent 是什么?它能做什么,以及如何部署到飞书
人工智能·python·飞书
SamChan904 小时前
用Playwright端到端测试PDF翻译功能:Web自动化测试实战
前端·python·ai·pdf·wpf
袁袁袁袁满4 小时前
Python爬虫实战:利用巨量IP获取跨境电商数据
爬虫·python·网络爬虫·爬虫实战·跨境电商·电商爬虫
jufeng13075 小时前
【系列:TDengine 工业物联网实战:从零搭起可运行系统 · 第 4 篇】
python·时序数据库·tdengine·asyncio
努力搬砖的咸鱼5 小时前
意图理解:让Agent从需求描述自动生成Pytest测试策略
人工智能·python·ai·单元测试·pytest·agent
2601_956319885 小时前
2026年下半年,量化学习要把交易认知和技术实现接起来
人工智能·python
EW Frontier5 小时前
【雷达信号处理】5 个阵元追平 16 个阵元:稀疏阵列 STAP 的实测报告【附python+matlab代码】
python·matlab·信号处理·雷达·mimo·稀疏阵列·stap