山东大学2024深度学习期末考试回忆

2024.6.17考

整体来说比往年难了些,没有考计算图。LSTM看上去必考了,LSTM的图一定要会画。

名词解释(24分,一个3分)

分布式表示

超参数

共现矩阵

截断BPTT

attention机制

梯度确认

语言模型

困惑度

简答题(48分,一个8分)

1.简述训练数据、测试数据、验证数据的作用,为什么要划分训练数据测试数据

2.为什么激活函数不能使用非线性激活函数

3.为什么dropout能抑制过拟合

4.简述神经网络的学习过程

5.简述batch normalization的三个优点

6.word2vec计算哪里有瓶颈,给出方法减小计算量

综合分析(28)

一、

1.计算全连接层,给一张256*256的输入图像,只有一个隐藏层,隐藏层有10个神经元,输出层有1000个神经元,在不考虑偏置的情况下,参数数量是多少,给出计算过程(6分)

2.卷积神经网络的特点(3分)

3.随机梯度下降低效的根本原因,给出除随机梯度下降以外的3种参数更新方法(4)

二、

1.画出LSTM的内部图(5)

2.LSTM三个门的作用(5)

3.改进RNNLM的三个措施(5)

相关推荐
HIT_Weston21 小时前
45、【Agent】【OpenCode】本地代理分析(请求&接收回调)
人工智能·agent·opencode
逻辑君1 天前
认知神经科学研究报告【20260010】
人工智能·深度学习·神经网络·机器学习
星河耀银海1 天前
远控体验分享:安全与实用性参考
人工智能·安全·微服务
企业架构师老王1 天前
2026企业架构演进:科普Agent(龙虾)如何从“极客玩具”走向实在Agent规模化落地?
人工智能·ai·架构
GreenTea1 天前
一文搞懂Harness Engineering与Meta-Harness
前端·人工智能·后端
鬼先生_sir1 天前
Spring AI Alibaba 1.1.2.2 完整知识点库
人工智能·ai·agent·源码解析·springai
深念Y1 天前
豆包AI能力集成方案:基于会话管理的API网关设计
人工智能
龙文浩_1 天前
Attention Mechanism: From Theory to Code
人工智能·深度学习·神经网络·学习·自然语言处理
ulimate_1 天前
八卡算力、三个Baseline算法(WALLOSS、pi0、DreamZero)
人工智能
深小乐1 天前
AI 周刊【2026.04.06-04.12】:Anthropic 藏起最强模型、AI 社会矛盾激化、"欢乐马"登顶
人工智能