我觉得万事万物都逃不过y=f(x)这个关系,输入在某种法则作用下变成了输出,这个用来理解宇宙,就是我们知道宇宙的现状,就是y,知道自然法则,就是f,我们不知道的是x,其实深度学习也是如此,模型要找的是f,通过不断减小预测和真实值的 损失来找最好的w和b,而这个就是f,最好的f应该是方之四海而皆准的,而且深度学习中很多都是分类问题,图像分类,文本分类是分类,图像分割也可以看成分类,是对像素的分类,还有翻译,就是预测下一个字的概率分布,也是分类,看这个词元属于词汇表中的哪一个,图片可以看成序列,因为它是由像素值有序排成的,文本就是序列,所谓词嵌入就是为单个词元用数学向量表示,这样可以把这些问题归结为一个东西y=f(x),输入都是实际事物的抽象,是实际事物的数字表示,已知的是输入和结果,要找的是f,我们用损失来引导模型学习,模型在减小损失的过程中,逐渐接近本质,我之所以说翻译是分类,是因为模型要预测的是当前词元是词汇表中的那个词,就是一个词汇表大小的分类,最重要的是建摸,抽象出有用的数据
相关推荐
其美杰布-富贵-李26 分钟前
为什么注意力分数要除以 $\sqrt{d_k}$ZENERGY-众壹38 分钟前
AI 诊断光伏组件热斑:从 10% 功率偏差到深度学习建模的实战复盘今心上2 小时前
关于d2l中train_ch3以及softmax中图在pycharm中显示不出来的解决方案大鱼>18 小时前
深入Real-ESRGAN架构:RRDBNet设计精髓与ONNX/TensorRT部署优化2zcode19 小时前
项目文档:基于MATLAB深度卷积神经网络的肺癌CT影像智能检测系统设计与实现m沐沐20 小时前
【深度学习】卷积神经网络 数据增强、保存最优模型实现,详细解读硅谷秋水20 小时前
PhyGround:生成式世界模型中的物理推理基准测试coder_zrx20 小时前
大语言模型训练范式:从 GPT 到 Llama 的 RLHF 演进不懒不懒20 小时前
Windows 深度学习环境配置(CUDA12.8 + cuDNN9.x + PyTorch)最简避坑指南(2026 最新)Kobebryant-Manba21 小时前
Hugging Face中transformers库