国科大2025秋自然语言处理基础与大模型期末

一、标注题

----一段文字-----

1、用斜线对这段文字分词

2、标出这段文字里的命名实体,说明其类型

3、----一句话----- 画出这句话的短语结构树

4、----一句话---- 画出这句话的依存关系

二、简答题

1、与前馈神经网络、循环神经网络、自注意力网络相比,卷积神经网络能做语言模型吗?如果能做,说明优势和不足,如果不能,说明理由。

2、ELMO由两层LSTM构成,与Bert、GPT等Transformer预训练结构相比,有什么优势和不足。

3、词表V的大小对于效率和性能的影响。

4、简要说明Zero1/2/3的原理,并说明它们在工作时要同步的信息分别是什么。

5、指令微调和基于人类反馈的对齐分别的目的是什么?基于人类反馈的对齐中,如何才能将人类价值观内化到参数里?

三、计算题

1、给出一个词表{----------},用该词表对下面的句子进行切分。计算压缩比。

2、--------------一个译文句子,两个参考答案句子----------------------------------------------

(1)计算译文与答案的编辑距离。

(2)按照BLEU中的一元、二元、三元、四元文法,计算译文的精确率。

四、大模型会不知道自己不知道什么,有幻觉,设计一个算法解决这个问题

相关推荐
火山引擎开发者社区6 小时前
没有长期记忆,Agent 谈何持续进化?一图看懂火山 Mem0:解锁 Agent 持续学习与进化之路
人工智能
冬奇Lab9 小时前
Workflow 系列(06):安全——跨步骤注入传播与四层防御
人工智能·工作流引擎
冬奇Lab9 小时前
每日一个开源项目(第149篇):RAG-Anything - 把图片、表格、公式当成一等公民的多模态 RAG 框架
人工智能·开源
米小虾9 小时前
AI Agent 安全实战指南:当智能体开始"不听话",开发者该如何应对?
人工智能·安全·agent
IT_陈寒11 小时前
Vite的热更新突然不香了,排查三小时差点砸键盘
前端·人工智能·后端
阿里云大数据AI技术13 小时前
构建高转化海外电商搜索:阿里云OpenSearch行业算法版的全链路智能优化策略实战
人工智能·搜索引擎
Awu122713 小时前
⚡从零开发 Agent CLI(五)实现一个可治理、可扩展的工具系统
前端·人工智能·claude
字节跳动视频云技术团队13 小时前
让 Agent 成为音视频工作台:AI MediaKit CLI + Skill 发布
人工智能·音视频开发
魏祖潇13 小时前
framework 整合实战——DDD/TDD/SDD 三件套在 framework 仓的真实落地
人工智能·后端