设计普遍逼近的深度神经网络:一阶优化方法

论文地址:https://ieeexplore.ieee.org/document/10477580

传统的基于优化的神经网络设计方法通常从一个具有显式表示的目标函数出发,采用特定的优化算法进行求解,再将优化迭代格式映射为神经网络架构,例如著名的 LISTA-NN 就是利用 LISTA 算法求解 LASSO 问题所得 4,这种方法受限于目标函数的显式表达式,可设计得到的网络结构有限。一些研究者尝试通过自定义目标函数,再利用算法展开等方法设计网络结构,但他们也需要如权重绑定等与实际情况可能不符的假设。

论文提出的易于操作的网络架构设计方法从一阶优化算法的更新格式出发,将梯度或邻近点算法写成如下的更新格式:

再将梯度项替换为神经网络中的可学习模块 T,即可得到 L 层神经网络的骨架。

链接

相关推荐
大模型丫丫7 分钟前
Transformer架构详解:从Attention到GPT的演进之路
gpt·深度学习·transformer
aichitang202411 分钟前
快乐泛函每一天!内积空间
c++·python·数学·算法·机器学习·ai·泛函分析
是上好佳佳佳呀31 分钟前
【深度学习|DAY05】卷积神经网络深度学习笔记
笔记·深度学习·cnn
茜茜数模1 小时前
2026年天府杯大学生数学建模A题全套资源
人工智能·算法·机器学习
盼小辉丶1 小时前
PyTorch强化学习实战——用预训练语言模型和ChatGPT玩转文本游戏
pytorch·深度学习·语言模型·chatgpt·强化学习
空堂与归13 小时前
分类问题怎么建模?用逻辑回归实现概率预测
人工智能·机器学习·分类·逻辑回归
SomeB1oody14 小时前
【RustyML入门】6.0. 数学工具
开发语言·后端·机器学习·rust·教程
菜冻鱼15 小时前
Python-pytorch-高级技巧
开发语言·人工智能·pytorch·python·深度学习·神经网络·聚类
菜冻鱼16 小时前
Python-pytorch-模型保存与加载
开发语言·人工智能·pytorch·python·深度学习·机器学习
root_123456_16 小时前
注意力机制的诞生:从 Seq2Seq Attention 到注意力的本质
rnn·lstm·transformer·自学ai