什么是机器学习

机器学习,英文Machine learning,是人工智能(AI,artificial intelligence)的一个分支。旨在使机器或计算机像人一样学习,通过让其接触更多的数据,以期其能够自动执行任务,提高其性能和准确性。

机器学习算法的学习系统一般分为三个部分:

  1. 决策过程:一般,机器学习算法都是用来做预测或分类。基于一些输入数据,这些数据可能被标记或没被标记,做出关于数据模式的推测
  2. 误差函数:误差函数是用来评估预测模型的。比如说,如果有一些已知的例子,那么误差函数就可以与这些已知例子做比较,以此来评估预测模型的准确性。
  3. 模型优化过程:如果模型可以更好拟合训练集中的数据点,那么就可以调整权重,减少已知例子与模型预测之间的差距。机器算法会重复这个过程------评估和优化,自动更新权重,直到达到某个准确性的阈值。

误差函数是必须的,如果模型没有被评估过,那么我们就不知道这个模型到底可不可靠或者说可靠到什么程度。典型的做法就是拿已知的和预测值做比较。

模型优化过程也是必须的,在这个模型能够拿来用之前,必须完成这个过程,这个过程利用训练数据集中的数据点,通过不断读取数据点,评估预测值与实际值的差距,不断调整权重,将函数的输入和输出值,尽可能符合训练集中的映射关系,这就是所谓的拟合。要一个模型百分百预测正确,其实是很困难的,随着训练数据集越大,拟合过程就越久,因为要不断的评估与优化,每一次权重的调整都可能会影响前面的数据点。这个过程在预测的准确率达到某个预期值就可以结束了。否则就很难结束了。

决策过程就是在模型"成品"时拿来用时的事情了。

相关推荐
yychen_java3 分钟前
九:Text-to-SQL 智能数据查询与 Human-in-the-Loop 人机协作
java·人工智能·架构
AI科技先锋报4 分钟前
AI数据资产管理平台全景洞察:从治理基座到智能体应用
大数据·人工智能
章老师说16 分钟前
BFE v1.8.6 正式发布:AI 网关计费精细化、Claude 协议与会话亲和性升级
运维·人工智能·ai·负载均衡·ai-native
冬奇Lab30 分钟前
一天一个开源项目(第206篇):T3 Code - AI 编程 Agent 的统一控制台
人工智能·开源·资讯
IT古董30 分钟前
AI 资讯日报 | 2026年9月1日 :混元 Hy4 开源、DeepSeek 多模态登顶、可灵获国家队 14 亿注资
人工智能·开源
冬奇Lab30 分钟前
Code Agent 解剖(18):AgentTeams——TeamFanout 与 TeamCollect 的并行机制
人工智能
ai小陈36 分钟前
FramePack图生视频云端部署实战:从单图输入到视频输出的完整流程
服务器·人工智能·安全·ai·音视频·gpu算力
程序员-Benothing1 小时前
OpenAI断供Cursor:当AI巨头开始“清理门户“,开源生态的中立性还能撑多久?
人工智能·开源·大模型
光锥智能1 小时前
机器人走进大众时代加速到来:郎朗跨界合作启元机器人,消费级人形机器人开启直播发售
人工智能
Jialu.1 小时前
中文 BERT 多任务分类项目:从模型结构到训练细节
人工智能·pytorch·分类·微软·nlp·bert