黑马AI大模型机器学习课程笔记(个人记录、仅供参考)

https://blog.csdn.net/2301_80558092/article/details/155315078

二、机器学习概述

1、机器学习_大纲介绍

2、机器学习_相关概述目录介绍

3、机器学习_AI_ML_DL介绍

4、机器学习_基于规则和模型的介绍

5、机器学习_应用领域和发展史介绍

6、机器学习_名词介绍

7、机器学习_算法分类

8、机器学习_建模流程

9、机器学习_特征工程介绍

机器学习与人工智能

10、上午内容回顾

11、机器学习_模型拟合问题

12、机器学习_环境搭建

13、KNN算法_简介

14、KNN算法_思路分析

15、KNN算法_分类思想代码实现

16、KNN算法_回归思想代码实现

三、KNN算法

1、常用的距离度量方式

2、特征预处理_归一化

3、特征预处理_标准化

4、鸢尾花案例_查看数据集

5、鸢尾花案例_数据集可视化

6、鸢尾花案例_切分训练集和数据集

7、鸢尾花案例_模型的评估和预测

8、交叉验证和网格搜索_介绍

9、交叉验证和网格搜索_代码实现​编辑

10、手写数字识别_数据集介绍

11、手写数字识别_绘制数字

12、手写数字识别_训练和保存模型

13、手写数字识别_加载和使用模型

14、解决预测错误的Bug

四、线性回归

1、今日内容大纲介绍

2、线性回归简介

3、线性回归API_入门

4、损失函数介绍

5、导数_复习

6、偏导数_复习

7、上午内容回顾

8、矩阵_复习

9、一元线性回归_正规方程法

10、多元线性回归_正规方程法(上)

11、多元线性回归_正规方程法(下)

12、补充_转换时为啥是Xw

13、单变量_梯度下降法

14、多变量_梯度下降法

五、线性回归

1、银行信贷案例_梯度下降法

2、梯度下降算法分类

3、回归模型_评估方法

4、正规方程_线性回归对象API介绍

5、梯度下降_线性回归对象API介绍

6、代码演示_欠拟合

7、代码演示_正好拟合

8、代码演示_过拟合

9、L1和L2正则化介绍

六、逻辑回归

1、今日内容大纲介绍

2、逻辑回归_简介

3、概率相关知识回顾

4、逻辑回归_原理介绍

5、逻辑回归案例_癌症预测

6、混淆矩阵及精确率,召回率,F1值介绍

数学

7、混淆矩阵_精确率_召回率_F1值_代码演示

8、混淆矩阵_总结

9、ROC曲线和AUC指标介绍(了解)

10、ROC曲线_案例(了解)

七、决策树

1、逻辑回归_电信用户流失预测_数据预处理

2、逻辑回归_电信用户流失预测_数据可视化

3、逻辑回归_电信用户流失预测_模型训练预测评估

4、决策树_简介

5、决策树_信息熵简介

6、决策树_信息增益计算

7、ID3决策树_搭建

8、上午内容回顾

9、C4.5树_信息增益率

10、Cart树原理介绍

11、3种决策树总结

12、泰坦尼克号案例_数据集介绍

13、泰坦尼克号案例_代码演示

14、CART决策树_回归用法

八、集成学习

1、回归决策树和线性回归对比

2、决策树_剪枝介绍

3、集成学习_大纲介绍

4、集成学习_简介

5、集成学习_Bagging和Boosting思想介绍

6、Bagging思想_随机森林算法介绍

7、随机森林API_泰坦尼克号案例

8、Boosting思想_AdaBoost自适应提升树介绍

9、AdaBoost算法_推导过程

10、AdaBoost算法_葡萄酒案例

11、GBDT算法_梯度提升树介绍

12、GBDT算法_推导过程

13、GBDT算法_泰坦尼克号案例

九、KMeans算法

1、XGBoost极限梯度提升树_简介

2、XGBoost极限梯度提升树_推导

3、XGBoost API介绍

4、XGBoost案例_红酒品质分类_数据预处理

5、XGBoost案例_红酒品质分类_模型训练

6、XGBoost案例_红酒品质分类_模型评测

7、朴素贝叶斯_简介

8、商品评论情感分析_思路分析

9、商品评论情感分析_数据预处理

10、商品评论情感分析_模型训练和预测

11、聚类算法_简介

12、聚类算法_API初识

13、聚类算法_推导流程

十、数据挖掘实战项目

1、聚类算法评估指标_SSE介绍

2、聚类算法评估指标_SSE代码实现

数学

3、聚类算法评估指标_sc,ch轮廓系数介绍

4、sc,ch轮廓系数_代码演示

5、用户分群_求解最优K值

6、用户分群_代码实现

7、时序数据介绍

8、时序数据分类介绍

9、时序预测_算法介绍

10、电力负荷预测案例_背景介绍

11、电力负荷预测案例_项目搭建

12、电力负荷预测案例_日志功能介绍

13、电力负荷预测案例_数据预处理

14、电力负荷预测案例_定义电力负荷模型类

15、电力负荷预测案例_查看数据整体和各小时负荷分布

16、自己后补的内容_特征工程

17、自己后补的内容_模型训练、评估、保存

18、自己后补的内容_模型预测模块前置代码

19、自己后补的内容_模型预测模块重点代码

20、自己后补的代码_模型预测模块结果评价代码


一、前言

这个课程我学习的时间还是比较长的,一是和比较早的期末考试撞上了,所以分心效率有点低。然后这个机器学习的课程的话,因为我确实没有看过其他的机器学习课程,所以评价可能不够全面。我个人感觉这个课程在数学推导方面讲的比较一般,很多算法的公式直接看当然看不懂,所以有很多口语化的解释很正常,但是老师确实一到数学就会混淆或者讲错一些小点。然后我感觉在数学基础知识的部分篇幅过长,而在比较复杂的推导感觉讲的有点乱,整体有点头重脚轻。但是这个老师一路跟过来,我认为代码水平和讲解都还是可以的,只能说培训班模式对于这种牵扯数学可能还是比不上纯讲代码吧

最后提醒一下,最后的项目案例是缺失了一部分视频的,不过有完整的项目代码。结合ai看懂还是可以的,然后评论区说机器学习还有向量机啥的知识点。我后面去网上找资源是有看到的(网上几块钱也能买到网盘资源),后续如果我学习就补充在这里面吧

二、机器学习概述

1、机器学习_大纲介绍

2、机器学习_相关概述目录介绍

3、机器学习_AI_ML_DL介绍

4、机器学习_基于规则和模型的介绍

5、机器学习_应用领域和发展史介绍

6、机器学习_名词介绍

7、机器学习_算法分类

假设序号1~5就是5个临近的邻居,数类型发现爱情片票数最多有3票,则预测类型就是爱情片

8、机器学习_建模流程

9、机器学习_特征工程介绍

10、上午内容回顾

11、机器学习_模型拟合问题

12、机器学习_环境搭建

13、KNN算法_简介

14、KNN算法_思路分析

15、KNN算法_分类思想代码实现

16、KNN算法_回归思想代码实现

三、KNN算法

1、常用的距离度量方式

平方,再开平方根就是欧氏距离

2、特征预处理_归一化

归一化适用于小数据集的处理,因为假设数据集有300W条数据,但是实际影响结果的主要是最大值和最小值,与数据条数没有关系。同时因为主要由最大值和最小值影响,所以如果出现恰好最大值和最小值是异常值的情况归一化就很不准确了。最常用的是标准化,并且标准化适用于大数据集的处理

统计信息

3、特征预处理_标准化

4、 鸢尾花 案例_查看数据集

5、鸢尾花案例_数据集可视化

6、鸢尾花案例_切分训练集和数据集

7、鸢尾花案例_模型的评估和预测

8、交叉验证和网格搜索_介绍

9、交叉验证和网格搜索_代码实现

10、手写数字识别_数据集介绍

11、手写数字识别_绘制数字

12、手写数字识别_训练和保存模型

13、手写数字识别_加载和使用模型

显然预测结果是错误的,下一个视频讲解了为什么出错

14、解决预测错误的Bug

我跟着老师一样做把 / 255去掉了,结果发现预测结果依旧是1

后续看了弹幕和评论区,我把随机种子从23改为了22,然后解开训练并保持模型的注释,重新跑又预测成功了。至于为什么我也不是很懂,不过评论区好像也没看到正经回答

四、线性回归

1、今日内容大纲介绍

2、线性回归简介

3、线性回归API_入门

4、损失函数介绍

5、导数_复习

6、偏导数_复习

7、上午内容回顾

8、 矩阵 _复习

矩阵乘法最后是2行2列,ppt打错了

数学

9、一元线性回归_正规方程法

10、多元线性回归_正规方程法(上)

这里乘上X的转置矩阵是为了化成方阵(非方阵一定没有逆矩阵),然后再乘上逆矩阵化为单位阵1(前提是逆矩阵存在,这里假设存在)

数学

11、多元线性回归_正规方程法(下)

12、补充_转换时为啥是Xw

13、单变量_梯度下降法

老师公式的写法是:下个点 = 当前点 - 学习率 * 损失函数,其实老师讲解的是没有问题的,但是这个公式会有点误导,我自己当前也是混淆了一下。这里混淆了损失函数和损失函数对当前参数的梯度,正确的公式为:下一个参数值 = 当前参数值 - 学习率 * 损失函数对当前参数的梯度(至于什么是梯度在下图讲的很清楚了)

教育资源

14、多变量_梯度下降法

五、线性回归

1、银行信贷案例_梯度下降法

2、梯度下降算法分类

3、回归模型_评估方法

4、正规方程_线性回归对象API介绍

5、梯度下降_线性回归对象API介绍

6、代码演示_欠拟合

7、代码演示_正好拟合

8、代码演示_过拟合

9、L1和L2正则化介绍

将L2正则化的惩罚系数从0.1改为10

六、逻辑回归

1、今日内容大纲介绍

2、逻辑回归_简介

接下来讲的条件概率公式是错的,正确的条件概率公式为:P(B | A) = P(AB) / P(A),表示事件B在事件A已经发生条件下的发生概率

3、概率相关知识回顾

下面这个条件概率也是错的

这里还不如自己推一下,这老师讲代码还行,讲数学知识挺一般的

4、逻辑回归_原理介绍

这个地方的y也是错的,下面案例明显可以看出y是真实结果的类别,而不是逻辑回归预估的类别

下面是我结合ai纠正后的总结

C选项有瑕疵,应该是0, 1

5、逻辑回归案例_癌症预测

6、混淆矩阵及精确率,召回率,F1值介绍

记录一下弹幕的总结:

真、正看成1,假、反看成-1。乘起来是实际真假,靠后的是预测的真假

带P都是预测为真,带N都是预测为假。带T就是预测正确,带F就是预测错误

7、混淆矩阵_精确率_召回率_F1值_代码演示

8、混淆矩阵_总结

9、ROC曲线和AUC指标介绍(了解)

10、ROC曲线_案例(了解)

七、决策树

1、逻辑回归_电信用户流失预测_数据预处理

2、逻辑回归_电信用户流失预测_数据可视化

3、逻辑回归_电信用户流失预测_模型训练预测评估

4、决策树_简介

蓝色勾是面试可能要问的,红色勾是重点内容需要掌握

叶子节点:没有子节点的节点

5、决策树_信息熵简介

大白话解释熵:代表数据的混乱程度

6、决策树_信息增益计算

原图分类占比右边标错了,正确应该是标特征熵。这部分我个人对信息熵、条件熵、特征熵这三个概念不太清晰,所以下面给出我询问ai得到的总结,有助于理解这三个概念

7、ID3决策树_搭建

8、上午内容回顾

9、C4.5树_信息增益率

特征熵的倒数 = 惩罚系数,老师那里打的还是有点问题的,但是结合起来看不难理解,单纯不严谨而已

10、Cart树原理介绍

第1轮结果,婚姻状况和年收入的最小基尼指数并列为0.3,此时根据奥卡姆剃刀原则选择简单的,所以根节点选择婚姻状况。到第2轮的节点时,数据集已经改变,所以此时又得根据新的数据集计算是否有房和年收入的最小基尼指数(不能使用第1轮的基尼指数进行比较)

11、3种决策树总结

12、 泰坦尼克号 案例_数据集介绍

13、泰坦尼克号案例_代码演示

14、CART决策树_回归用法

八、集成学习

1、回归决策树和线性回归对比

2、决策树_剪枝介绍

后剪枝更消耗资源但是更精准

3、集成学习_大纲介绍

4、集成学习_简介

5、集成学习_Bagging和Boosting思想介绍

6、Bagging思想_随机森林算法介绍

7、随机森林API_泰坦尼克号案例

8、Boosting思想_AdaBoost自适应提升树介绍

9、AdaBoost算法_推导过程

错误率最小为0.3,有两个分裂点并列为0.3,一个是2.5的分裂点,另一个是8.5的位置。根据奥卡姆剃刀,选择2.5这个分裂点

样本x,这个x数字是按序号来说的,所以有样本10

下图种2.当以0.5为分裂点时,后面错误率写错了

10、AdaBoost算法_葡萄酒案例

11、GBDT算法_梯度提升树介绍

12、GBDT算法_推导过程

下图倒数第二行写的:残差 = 真实值求和,求平均值是错的

应该是预测值 = 真实值求和,求平均值

第一次构建,直接以原数据目标值的均值作为预测值

构建第2个弱学习器时,把上次的负梯度直接当作这次的目标值。然后本次的预测值是基于本次的目标值(上次的负梯度)结合上次切分点的位置再进行求和平均填入的。然后才是算本次的负梯度,本次的平方损失,确认本次的切分点

13、GBDT算法_泰坦尼克号案例

九、KMeans算法

1、XGBoost极限梯度提升树_简介

2、XGBoost极限梯度提升树_推导

要求:能用自己的话讲解下面四句话

3、XGBoost API介绍

4、XGBoost案例_红酒品质分类_数据预处理

5、XGBoost案例_红酒品质分类_模型训练

6、XGBoost案例_红酒品质分类_模型评测

平衡权重这个参数如果按老师的填是会报错的,修改一下

7、朴素贝叶斯_简介

样本是每一行的数据,样本之间本来就是独立的。朴素贝叶斯是假设特征之间是相互独立的

字典与百科全书

8、商品评论情感分析_思路分析

9、商品评论情感分析_数据预处理

10、商品评论情感分析_模型训练和预测

11、聚类算法_简介

12、聚类算法_API初识

13、聚类算法_推导流程

十、数据挖掘实战项目

1、聚类算法评估指标_SSE介绍

2、聚类算法评估指标_SSE代码实现

我画这个图画的挺慢的,感觉画了几分钟,不知道是电脑配置问题还是啥

3、聚类算法评估指标_sc,ch轮廓系数介绍

4、sc,ch轮廓系数_代码演示

5、用户分群_求解最优K值

6、用户分群_代码实现

7、时序数据介绍

8、时序数据分类介绍

9、时序预测_算法介绍

10、电力负荷预测案例_背景介绍

11、电力负荷预测案例_项目搭建

12、电力负荷预测案例_日志功能介绍

13、电力负荷预测案例_数据预处理

14、电力负荷预测案例_定义电力负荷模型类

这里多提一嘴,之前我一直都是按照自己的方式来创建目录的。如下图day1啥的都是在D:/25heima-AI-LargeModel-MachineLearning-code下直接创建,所以一开始的load_predict_project我也是直接复制放到和day08平级的位置了,后面死活from utils import Logger爆红而且拷打ai半天一直解决不了(ai一直叫我尝试用os、sys啥的配根目录路径啥的)。最后我回去翻了一下22年的Python基础视频(因为我印象中那里有讲解自定义包),然后发现正确的应该就是得按老师那种方式,相当于创建一个新项目才行,如下我新建一个项目而不是在原来项目加目录就解决了

机器学习与人工智能

15、电力负荷预测案例_查看数据整体和各小时负荷分布

各月份的平均负荷趋势和老师写的各个小时的平均负荷趋势一样,如下图将索引5、6的部分截取出来充当月份

然后到此B站原视频就完结了,大概率是遗漏后面的视频。不过提供了完整的项目代码资料,所以后续我就结合ai和资料自行补充代码,同时会添加更多的注释,有需要的可以参考我的代码

字典与百科全书

由于四个画出的图挤在一张图片中,所以在PyCharm中显示会比较小,不过放大看还是很清晰的。如果想得到够大且清晰的图片,可以打开项目文件夹下的图片打开,会比PyCharm更清晰且好放大

16、自己后补的内容_特征工程

原B站视频遗漏了特征工程和后面的模型训练、评估,但是资料中有完整的项目代码,所以以下代码都是参考完整代码,我只是在原代码基础上看懂并加了一些注释

字典与百科全书

对于代码中的shift()函数和删除空值的部分,我结合ai理解了一下,下面给出总结方便梳理

机器学习与人工智能

特征工程的代码不好展示效果,所以在测试的时候,打印一下返回的processed_data和feature_cols数据验证一下

字典与百科全书

17、自己后补的内容_模型训练、评估、保存

从参考代码的大片注释不难看出,这里应该是先进行网格化搜索寻找最优超参组合,所以我也先复制一部分代码验证一下

自己跑一遍发现超参组合确实就是logger.info打印的,然后原代码时间是2024-11-26,我还看了一下老师注释网格搜索跑了一分钟,我跑了23秒还比老师快一点

下面就是完整的代码了

评估的误差和ppt差不多,反正代码也是复制过来的,应该没问题

模型也成功保存了

18、自己后补的内容_模型预测模块前置代码

我大概看了一眼代码和ppt,预测模块内容也是很多的,所以我也模仿老师的节奏先实现1、2、3步

复制到加载模型的代码之后,我运行测试发现报错了,然后发现这里要先修改utils包下的common.py代码。因为这个common.py还是跟着老师视频一起完成的,当时他是直接把加载数据集的路径写死了并测试看一看效果的。实际上我们这里要改为传入路径

统计信息

修改之后的common.py代码如下,资料中的common还有另一个函数。但是我版本比较新应该不用写,总之这个common自己改一下或者是直接复制资料里的代码都可以

然后就是predict.py的代码,先从资料里复制到加载模块为止

字典与百科全书

也可以跑一下先看看有没有问题,不报错同时log下出现predict_时间的日志文件就可以了。如果有输出就回去common里面看看是不是有没注释的打印语句,打印问题也不大

19、自己后补的内容_模型预测模块重点代码

在刚刚定义电力负荷预测类的下面加入如下的代码(从资料里复制的)

字典与百科全书

在测试中在加载模型的下面加入如下代码,最后我加了个打印语句看看evaluate_df

20、自己后补的代码_模型预测模块结果评价代码

复制代码同理

运行成功之后可以对比一下自己的图和老师资料里的参考图

资料里的图我改了个名,对比发现差不多有一点点不一样

字典与百科全书

第一个是我的,前面黄色的波峰对比起来低一点点

这个是参考图

标签

#人工智能 #笔记 #机器学习

​编辑 YuforiaCode

关注

  • 39

  • 37

  • 0

  • 分享

专栏目录

通义千问对接FreeSWITCH实现大模型呼叫中心

技术永不眠 Q:53195017

1463

通义千问是由阿里云开发的大规模语言模型,具备优秀的自然语言处理能力,支持文本生成、问答对话、摘要提取等多种任务。它不仅拥有丰富的知识储备,还能根据上下文灵活调整回答策略,适用于各种复杂场景下的自动化交流。FreeSWITCH是一个开源的多媒体通信服务器,提供了包括VoIP通话、即时消息传递在内的多种通信服务。它的模块化设计允许开发者根据实际需求定制功能,广泛应用于企业级通信系统中。通过集成通义千问,FreeSWITCH能够实现更智能的客户服务体验。

黑马程序员3天快速入门python机器学习-day01笔记_机器学习黑马

8-21

1、入门 学会分析问题,使用机器学习算法的目的:想要算法完成何种任务 掌握算法基本思想,学会对问题用相应的算法解决 学会利用库或者框架解决问题(pytorch、sklearn、...) 2、实战类书籍 机器学习 -"西瓜书"- 周志华... 统计学习方法 - 李航 深度学习 - "花书" Lobster AI 1 2 3 4 5 6 7 8 9 10 11 ...

基于B站黑马程序员Python教程整理笔记_python快速编程入门第2版...

8-20

基于B站黑马程序员Python教程整理笔记 (319个子文件) ch_06_抛出异常 532B img56.gif 342KB ch_message-1.0.tar.gz 973B img47.jpg 256KB img49.jpg 61KB img6.jpg 49KB img5.jpg 42KB MANIFEST 132B README.md 207KB 26.vim.md 17KB

黑马python机器学习入门笔记

08-21

个人黑马机器学习入门笔记

重磅首发!天花板级别大模型LLM学习路线图来了!

youmaob的博客

1034

可以同时处理多种类型的模态数据,如文本、图像、语音等,实现跨模态搜索、跨模态生成等任务,已有的渗透应用具体包括搜索引擎、办公工具、金融电商等,例如谷歌的Vision Transformer模型。LLM为NLP大模型的一种,主要用于处理自然语言文本数据,具备强大的语言理解和生成能力,帮助人类完成问答、创作、文本等工作,例如Open AI的GPT系列模型。以大模型平台应用与开发为主,通过星火大模型,文心大模型等成熟大模型构建大模型行业应用。大模型微调开发借助以大健康、新零售、新媒体领域构建适合当前领域大模型;

黑马程序员教程资源代码资源

8-4

黑马程序员系列教程资源是一套内容丰富的编程和软件开发学习资料,为编程爱好者和专业人士提供了全面的学习平台。这些资源包括了多个主流编程语言和开发领域的教程,其中包括Java语言,它是当前企业级应用开发中最常用的编程语言之一;HTML和JavaScript,它们是构建现代网页和实现前端交互的基础技术;UI/UE设计,指导用户如何设计...

黑马程序员 Python学习笔记之 程序执行原理(科普)_黑马程序员python课程讲...

8-17

程序执行的原理 程序的作用 01. 计算机中的三大件 计算机中包含有较多的硬件,但是一个程序...

基于YOLO的智能机器人视觉识别系统.zip

基于YOLO的智能机器人视觉识别系统.zip

机器学习-day1

bwcx_51的博客

446

这里写自定义目录标题欢迎使用Markdown编辑器新的改变功能快捷键合理的创建标题,有助于目录的生成如何改变文本的样式插入链接与图片如何插入一段漂亮的代码片生成一个适合你的列表创建一个表格设定内容居中、居左、居右SmartyPants创建一个自定义列表如何创建一个注脚注释也是必不可少的KaTeX数学公式新的甘特图功能,丰富你的文章UML 图表FLowchart流程图导出与导入导出导入 欢迎使用Markdown编辑器 你好! 这是你第一次使用 Markdown编辑器 所展示的欢迎页。如果你想学习如何使用Mar

黑马程序员-C语言 第一篇:运算符、程序结构总结

8-23

概念:运算符是告诉编译程序执行特定算术或逻辑操作的符号。 分类: 1)按功能分类:算术运算符、逻辑运算符、和关系运算符和按位运算符。 2) 按操作说划分:单目运算、双目运算和三目运算。 算术运算符分为:+ (加)、-(减)、 *(乘)、 /(取整)、 %(取余) ...

黑马程序员大模型RAG与Agent智能体项目实战教程,基于主流的Lang...

8-5

天天生鲜是传智播客黑马出品的python实战项目, 项目的在线视频教程, 项目的讲义被放在了Python24期整套视频的讲义中的**第20章节**,具体的天天生鲜 在线讲义查看,除了天天生鲜项目之外,传智播客&黑马出品的Python24期人工智能整套代码和讲义集合,项目... 黑马程序员大模型RAG与Agent智能体项目实战教程以LangChain...

AI学习笔记(较全)

猛码Memmat

695

machine-learning-notes

AI 学习笔记(持续更新)

weixin_43501634的博客

2123

通过让大模型逐步参与将一个复杂问题分解为一步一步的子问题并依次进行求解的过程可以显著提升大模型的性能。而这一系列推理的中间步骤就被称为思维链(Chain of Thought)。

HackCat:HackGT2017_HackCat Android笔记生成应用资源

8-21

对于无法上课的人和讲师发送笔记的人来说,这款Android应用程序将是一个很好的帮助。我们是如何建造的我们将Android开发(使用Java编程)用于该应用程序的前端,该应用程序是一个移动应用程序,用于展示我们工作的物理结构。 我们还使用python开发了托管机器学习结果应用程序的后端服务器。我们遇到的挑战我们遇到了一些问题,包括...

黑马人工智能AI就业班之机器学习概述 网盘下载

牛牛

1100

1.知道特征工程是什么?2.理解特征提取的作用3.理解特征预处理的作用4.了解特征降维、特征选择、特征组合。

机器学习入门笔记 人工智能 黑马程序员

ZhuanShangNiDeXin的博客

1170

机器学习入门笔记 前言 这个是根据"黑马程序员"的一套机器学习课程编写的博客。这篇博客上的案例均为课程里面的,但并没有包含所有案例,只是记录了部分个人认为比较重要的部分。 B站视频地址 文章目录机器学习入门笔记前言特征工程Tf-idf文本特征提取Tf-idf介绍Tf-idf的重要性无量纲化处理---标准化为什么我们要进行标准化?定义API标准化总结PCA降维什么是主成分分析(PCA)API分类算法数据集划分定义APIK-近邻算法K-近邻算法定义距离公式API模型选择与调优API朴素贝叶斯算法API决策树A

我认为苹果将在AI竞赛中成为黑马的5个原因

为不同的业务场景定制多个配置,释放创造力,实现个性化需求

888

现在,要找到一款没有宣传自己人工智能优势的手机或电脑,比找到一款拥有这些功能的设备更难。AI无处不在,几乎在所有东西里都有应用 --- 常常让人找不到明显的理由 --- 而苹果公司在即将推出的iPhone 16中也不例外。尽管苹果在生成式AI领域起步较晚,落后于谷歌、微软及新兴企业,但他们正在迅速赶上,很可能超越当前的行业领袖。虽然与谷歌和微软不同,苹果在ChatGPT推出后并未立即跟进大语言模型,但这家位于库比蒂诺的公司多年来一直深耕机器学习及各种形式的人工智能,在其操作系统中广泛应用。

2021-08--黑马旅游网学习记录

weixin_43317534的博客

535

提示:文章写完后,目录可以自动生成,如何生成可参考右边的帮助文档 黑马旅游网学习记录前言 记录一下大小错误一、黑马旅游网day01二、使用步骤1.引入库2.读入数据总结 前言 记录一下大小错误 提示:这里可以添加本文要记录的大概内容: 例如:随着人工智能的不断发展,机器学习这门技术也越来越重要,很多人都开启了学习机器学习,本文就介绍了机器学习的基础内容。 提示:以下是本篇文章正文内容,下面案例可供参考 一、黑马旅游网day01 示例:pandas 是基于NumPy 的一种工具,该工具是为了解决数据分析

【2025首发】AI大模型学习路线:适合新手和大学生的详细指南与技巧!

最新发布

qkh1234567的博客

1040

本文为零基础学习者提供AI大模型高效学习路径,涵盖编程、数学、数据处理等基础技能,逐步深入机器学习、深度学习直至大模型实战。在当前大模型人才缺口超47万、初级工程师月薪28K的背景下,文章详细拆解从Python入门到Transformer核心技术的7个阶段学习框架,配套主流课程资源和实战项目建议。特别强调"学以致用"原则,指导构建作品集、准备面试题及参与开源项目,并针对大学生群体给出学习规划建议。随文附赠104G学习礼包,帮助学习者在6-12个月内系统掌握大模型技术,抓住2025年AI行

黑马程序员机器学习Day1学习笔记

文鸿开源工作室

1429

1.数据集的介绍字典特征抽取文本特征提取1.根据词频2.根据词的重要性特征预处理1.归一化标准化特征降维Filter过滤式:低方差过滤法PCA降维 机器学习第一天 基础不牢,地动山摇。直接上手tf,连很多机器学习的基础包都不会使用。比如sklearn, pandas (使用sklearn 来做特征工程 , pandas 用于数据的清洗和数据的处理)这些数据处理库,因此回去回炉重造,学习机器学习先。 学习的视频是黑马程序员的机器学习视频。 视频和资料链接 提取码:1234 本篇文章内容: 开发流程

HTML学习,b站黑马程序员课程笔记

Ming_julao的博客

2118

HTML基础,网页设计必学,简单易懂。黑马前端课程笔记。

高薪进大厂,最高薪资25k!现在上车还不晚!

传智播客的专栏

297

在5G时代背景下,人工智能产业高速发展,国家政策红利不断叠加,人才需求呈现爆炸式增长。据第三方招聘平台统计,人工智能人才缺口高达500万,远高于其他岗位。根据职友集数据显示,北京地区人工智...

牛市下 AI + Web3 叙事引关注,Verasity 或成又一黑马项目?

weixin_53694853的博客

997

VeraViews 的 AI 和 ML 技术可以分析过去活动的大量数据,其能够实时的验证并记录每个广告的观看量,并利用 200个触点和 AI ,根据用户的观看行为分辨出到底是真人还是机器人在观看,简单来说就是,对每个用户的观看行为进行多纬度记录和分析,并根据每个广告展示的表现调整出价和定位,有助于提高广告相关性并提高点击通过率(CTR)。通过推出 VeraViews ,一个基于 AI 的实时阻止广告欺诈的独特解决方案,正在为广告价值链中的所有各方提供完全透明的信息,并以保护个人信息的隐私合规方式进行。

黑马程序员3天快速入门python机器学习-day01笔记

qyk666的博客

1311

2.2 特征工程介绍 2.2.1 为什么需要特征工程(Feature Engineering) 2.2.2 什么是特征工程 2.2.3 如何进行特征工程 2.2.4 特征工程包含 2.3 特征提取/特征提取 2.3.1 什么是特征提取(将文本或者类别 用数值表示 以便计算机能更好理解) 2.3.2 字典特征提取案例 2.3.3 文本特征提取 方法1:CountVectorizer 方法2:TfidfVectorizer 2.4特征预处理 2.4.1 什么是特征预处理 2.4.2 归一化 2.4.3 标准化

AI学习笔记(一)

jennycisp的博客

1301

人工智能(Artificial Intelligence),英文缩写为AI。它是计算机科学的一个分支,研究用于模拟延伸和扩展人的智能的理论或方法、技术及应用系统。它企图了解智能的实质,并生产出一种能与人类智能相似的智能机器,该领域的研究包括机器人、语言识别与处理、图像识别与处理、自然语言处理和专家系统等。

ai学习笔记-入门

窦再兴的博客

1393

👉主要是指在各类机器载体(手机、电脑、交通工具、机器人、机械设备等)上模拟并拥有类似生物/超越生物的智能(感知、学习、推理、交流等)。👉人工智能初期属于计算机科学的分支,研究领域涉及计算机视觉、自然语言处理、机器学习、语音处理等,同时又与多个学科紧密相关,包括自动控制、电子技术、数学、心理学、语言学、哲学等。

黑马程序员-3天快速入门机器学习

m0_61281610的博客

1451

黑马程序员---三天快速入门Python机器学习(第三天)_黑马 python 机器学习 第三天-CSDN博客。黑马程序员---三天快速入门Python机器学习(第二天)_黑马程序员机器学习课件-CSDN博客。黑马程序员---三天快速入门Python机器学习(第一天)_黑马程序员机器学习-CSDN博客。

【机器学习-黑马程序员】人工智能、机器学习概述

你的博客

629

Python机器学习入门课程笔记

【大厂AI课学习笔记】【1.6 人工智能基础知识】(2)机器学习

AI人人懂

2007

机器学习123

​编辑

YuforiaCode

博客等级

码龄3年

130

原创

2471

点赞

2062

收藏

850

粉丝

关注

私信

热门文章

大家在看

最新文章

2025年130篇

目录

  1. 一、前言
  2. 二、机器学习概述
    1. 1、机器学习_大纲介绍
    2. 2、机器学习_相关概述目录介绍
    3. 3、机器学习_AI_ML_DL介绍
    4. 4、机器学习_基于规则和模型的介绍
    5. 5、机器学习_应用领域和发展史介绍
    6. 6、机器学习_名词介绍
    7. 7、机器学习_算法分类
    8. 8、机器学习_建模流程
    9. 9、机器学习_特征工程介绍
    10. 10、上午内容回顾
    11. 11、机器学习_模型拟合问题
    12. 12、机器学习_环境搭建
    13. 13、KNN算法_简介
    14. 14、KNN算法_思路分析
    15. 15、KNN算法_分类思想代码实现
    16. 16、KNN算法_回归思想代码实现
  3. 三、KNN算法
    1. 1、常用的距离度量方式
    2. 2、特征预处理_归一化
    3. 3、特征预处理_标准化
    4. 4、鸢尾花案例_查看数据集
    5. 5、鸢尾花案例_数据集可视化
    6. 6、鸢尾花案例_切分训练集和数据集
    7. 7、鸢尾花案例_模型的评估和预测
    8. 8、交叉验证和网格搜索_介绍
    9. 9、交叉验证和网格搜索_代码实现
    10. 10、手写数字识别_数据集介绍
    11. 11、手写数字识别_绘制数字
    12. 12、手写数字识别_训练和保存模型
    13. 13、手写数字识别_加载和使用模型
    14. 14、解决预测错误的Bug
  4. 四、线性回归
    1. 1、今日内容大纲介绍
    2. 2、线性回归简介
    3. 3、线性回归API_入门
    4. 4、损失函数介绍
    5. 5、导数_复习
    6. 6、偏导数_复习
    7. 7、上午内容回顾
    8. 8、矩阵_复习
    9. 9、一元线性回归_正规方程法
    10. 10、多元线性回归_正规方程法(上)
    11. 11、多元线性回归_正规方程法(下)
    12. 12、补充_转换时为啥是Xw
    13. 13、单变量_梯度下降法
    14. 14、多变量_梯度下降法
  5. 五、线性回归
    1. 1、银行信贷案例_梯度下降法
    2. 2、梯度下降算法分类
    3. 3、回归模型_评估方法
    4. 4、正规方程_线性回归对象API介绍
    5. 5、梯度下降_线性回归对象API介绍
    6. 6、代码演示_欠拟合
    7. 7、代码演示_正好拟合
    8. 8、代码演示_过拟合
    9. 9、L1和L2正则化介绍
  6. 六、逻辑回归
    1. 1、今日内容大纲介绍
    2. 2、逻辑回归_简介
    3. 3、概率相关知识回顾
    4. 4、逻辑回归_原理介绍
    5. 5、逻辑回归案例_癌症预测
    6. 6、混淆矩阵及精确率,召回率,F1值介绍
    7. 7、混淆矩阵_精确率_召回率_F1值_代码演示
    8. 8、混淆矩阵_总结
    9. 9、ROC曲线和AUC指标介绍(了解)
    10. 10、ROC曲线_案例(了解)
  7. 七、决策树
    1. 1、逻辑回归_电信用户流失预测_数据预处理
    2. 2、逻辑回归_电信用户流失预测_数据可视化
    3. 3、逻辑回归_电信用户流失预测_模型训练预测评估
    4. 4、决策树_简介
    5. 5、决策树_信息熵简介
    6. 6、决策树_信息增益计算
    7. 7、ID3决策树_搭建
    8. 8、上午内容回顾
    9. 9、C4.5树_信息增益率
    10. 10、Cart树原理介绍
    11. 11、3种决策树总结
    12. 12、泰坦尼克号案例_数据集介绍
    13. 13、泰坦尼克号案例_代码演示
    14. 14、CART决策树_回归用法
  8. 八、集成学习
    1. 1、回归决策树和线性回归对比
    2. 2、决策树_剪枝介绍
    3. 3、集成学习_大纲介绍
    4. 4、集成学习_简介
    5. 5、集成学习_Bagging和Boosting思想介绍
    6. 6、Bagging思想_随机森林算法介绍
    7. 7、随机森林API_泰坦尼克号案例
    8. 8、Boosting思想_AdaBoost自适应提升树介绍
    9. 9、AdaBoost算法_推导过程
    10. 10、AdaBoost算法_葡萄酒案例
    11. 11、GBDT算法_梯度提升树介绍
    12. 12、GBDT算法_推导过程
    13. 13、GBDT算法_泰坦尼克号案例
  9. 九、KMeans算法
    1. 1、XGBoost极限梯度提升树_简介
    2. 2、XGBoost极限梯度提升树_推导
    3. 3、XGBoost API介绍
    4. 4、XGBoost案例_红酒品质分类_数据预处理
    5. 5、XGBoost案例_红酒品质分类_模型训练
    6. 6、XGBoost案例_红酒品质分类_模型评测
    7. 7、朴素贝叶斯_简介
    8. 8、商品评论情感分析_思路分析
    9. 9、商品评论情感分析_数据预处理
    10. 10、商品评论情感分析_模型训练和预测
    11. 11、聚类算法_简介
    12. 12、聚类算法_API初识
    13. 13、聚类算法_推导流程
  10. 十、数据挖掘实战项目
    1. 1、聚类算法评估指标_SSE介绍
    2. 2、聚类算法评估指标_SSE代码实现
    3. 3、聚类算法评估指标_sc,ch轮廓系数介绍
    4. 4、sc,ch轮廓系数_代码演示
    5. 5、用户分群_求解最优K值
    6. 6、用户分群_代码实现
    7. 7、时序数据介绍
    8. 8、时序数据分类介绍
    9. 9、时序预测_算法介绍
    10. 10、电力负荷预测案例_背景介绍
    11. 11、电力负荷预测案例_项目搭建
    12. 12、电力负荷预测案例_日志功能介绍
    13. 13、电力负荷预测案例_数据预处理
    14. 14、电力负荷预测案例_定义电力负荷模型类
    15. 15、电力负荷预测案例_查看数据整体和各小时负荷分布
    16. 16、自己后补的内容_特征工程
    17. 17、自己后补的内容_模型训练、评估、保存
    18. 18、自己后补的内容_模型预测模块前置代码
    19. 19、自己后补的内容_模型预测模块重点代码
    20. 20、自己后补的代码_模型预测模块结果评价代码

收起

上一篇:

黑马Python数据分析课程笔记(个人记录、仅供参考)

下一篇:

黑马AI大模型神经网络与深度学习课程笔记(个人记录、仅供参考)

分类专栏

展开全部

​编辑​编辑

相关推荐
计科杨某人18 分钟前
从复杂系统到大语言模型:理解 AI 中的“涌现”
人工智能·语言模型·自然语言处理·ai涌现
GFDAGDS18 分钟前
从课程设置看近屿智能AI培训:直播教学、AI互动学习与项目实战如何结合
人工智能·大模型应用·近屿智能
蒸蒸yyyyzwd22 分钟前
cpp选手备战秋招学习笔记day17
笔记·学习
hy56856926 分钟前
2027赛逸展聚焦机器视觉技术,提升机器人环境感知能力
人工智能·机器人
AndrewHZ30 分钟前
图像处理入门018 | 简易图像浏览器开发:用 OpenCV + Tkinter 打造你的第一个图像 GUI 工具
图像处理·人工智能·opencv·canvas·tkinter·事件绑定
智恒百亿30 分钟前
企业 AI 推理本地化部署:GPU 服务器选型技术分析(2026 年 8 月)
大数据·服务器·人工智能
黎阳之光31 分钟前
软硬协同国产化 | 黎阳之光矩阵式视频融合管理系统完成摩尔线程国产GPU兼容适配
大数据·人工智能·物联网·安全·数字孪生
水管在开花.33 分钟前
RAG:知识库问答系统教学②-零基础保姆级教程
人工智能·面试·agent·rag