面了唯品会 NLP 算法岗,这次学到了很多!

节前,我们组织了一场算法岗技术&面试讨论会,邀请了一些互联网大厂同学、参加社招和校招面试的同学,针对大模型技术趋势、大模型落地项目经验分享、新手如何入门算法岗、该如何备战、面试常考点分享等热门话题进行了深入的讨论。

今天整理我们社群一个同学面试唯品会 NLP 算法方向的面试题,分享给大家,希望对后续找工作的有所帮助。喜欢记得点赞、收藏、关注。更多技术交流&面经学习,可以加入我们。

  1. 目前实习工作, 为什要用聚类来评估文本向量化表示?
  2. DBSCAN算法原理(简历有)
  3. 生成模型的的Category不存在预定义集合怎么办
  4. UIE+Category具体流程 (实习)
  5. 分类评估用的是什么指标
  6. bert模型中文本到id转化的过程是怎么样?
  7. 现有流行的模型相对于transformer,多头注意力有哪些改进/不同
  8. 现有流行的模型相对于transformer,layernorm 层改进/不同
    a. 正态度分布
  9. 现有流行的模型相对于transformer,embedding的改进/不同
  10. 现有模型之间(chatglm baichuan llama)的不同主要是哪些方面
  11. 常见的高效微调方法有哪些(p-tuning v1/v2 prompt-tuning prefix_tuning), 他们是如何做到节省GPU的,GPU上存放的是什么
  12. 怎么进行梯度更新的, 有哪些优化函数
  13. 现有流行的各个模型的编码方法有了解吗, 有什么不同呢, 简单介绍一下
  14. ChatGLM和transformer在编码和注意力方面有哪些区别
  15. Lora的降秩是所有都降吗, 还是降哪些?
  16. 一般用高效微调来干嘛
  17. 序列标注有了解吗, CRF有了解吗
  18. 场景题 现有三个词 权重分别是0.2 0.3 0.5 可以使用random, 进行k次(亿级别)采样, 设计一个采样算法

反问

高效微调, GPU是如何存储的?1. 优化参数 2. 梯度参数 3. 模型参数

总结

面试官人挺好的 和之前面试的感觉不一样 面试过程可以学到很多东西。

还是自己太菜了 还是得练得沉淀

技术交流群

前沿技术资讯、算法交流、求职内推、算法竞赛、面试交流(校招、社招、实习)等、与 10000+来自港科大、北大、清华、中科院、CMU、腾讯、百度等名校名企开发者互动交流~

我们建了算法岗技术与面试交流群, 想要进交流群、需要源码&资料、提升技术的同学,可以直接加微信号:mlc2060。加的时候备注一下:研究方向 +学校/公司+CSDN,即可。然后就可以拉你进群了。

方式①、微信搜索公众号:机器学习社区,后台回复:加群

方式②、添加微信号:mlc2060,备注:技术交流

用通俗易懂方式讲解系列

相关推荐
m4Rk_2 小时前
【论文阅读】Agent 记忆机制(83):Inside Out——用可演化 PersonaTree 构建 Agent 的核心长期记忆
论文阅读·人工智能·学习·开源·github
不会就选b2 小时前
算法日常・每日刷题--<贪心>25
数据结构·算法
运行时异常2 小时前
【WMS 仓储系统集成 AI Agent 实战】第 8 讲(终篇):生产部署与并发安全——Semaphore 放进 Flux.defer 的坑,压测抓了一晚上
人工智能·安全
杨杨杨大侠2 小时前
Jev、Kev、Laya:决策模型怎么选,什么时候需要微调?
人工智能·python·agent
代码方舟2 小时前
零信任架构实战:基于天远人企关联构建自动化供应链金融网关
运维·人工智能·架构·自动化
虹科网络安全2 小时前
“顶会”看安全(十八):超越越狱:揭示由能力边界模糊引发的 LLM 应用安全风险
人工智能·安全
Maiko Star2 小时前
* LangChain 提示词模板详解:ChatPromptTemplate 的使用与高级特性
java·人工智能·langchain
段一凡-华北理工大学3 小时前
大模型应用开发 100 天:Python + LLM 从入门到精通 day26~Prompt 调试与优化——A/B 测试与效果评估
windows·python·大模型·prompt·智能体·提示词工程·高炉智能化
鬓戈3 小时前
Rust 语言与 AI 应用生态调研及学习路径
人工智能·学习·rust
天远API3 小时前
零信任架构实战:基于天远人企关联构建自动化图谱网关
网络·人工智能·架构·自动化