视觉/深度学习/机器学习相关面经总结(2)(持续更新)

目录

    • 1、跨模态对齐的方案
    • 2、位置编码方式
      • [1. **正弦和余弦位置编码(Sinusoidal Positional Encoding)**](#1. 正弦和余弦位置编码(Sinusoidal Positional Encoding))
      • [2. **可学习的位置编码(Learnable Positional Encoding)**](#2. 可学习的位置编码(Learnable Positional Encoding))
      • [3. **相对位置编码(Relative Positional Encoding)**](#3. 相对位置编码(Relative Positional Encoding))
      • [4. **线性位置编码(Linear Positional Encoding)**](#4. 线性位置编码(Linear Positional Encoding))
      • [5. **一热编码(One-hot Encoding)**](#5. 一热编码(One-hot Encoding))
      • [6. **动态位置编码(Dynamic Positional Encoding)**](#6. 动态位置编码(Dynamic Positional Encoding))
    • 3、

1、跨模态对齐的方案

  • 嵌入空间对齐
    来自不同模态的数据(如图像和文本)被映射到一个共享的嵌入空间,例如CLIP通过对图像和文本进行对比学习,使得图像和文本的嵌入向量在同一空间中更具可比性,从而实现跨模态对齐。
  • 多模态注意力机制
    注意力机制,模型能够聚焦于不同模态中最相关的部分,并对其进行对齐融合。
    Q(查询):表示我们希望学习到的特征。
    K, V(键值):表示我们用来计算注意力的特征。
  • 。。。。。

2、位置编码方式

1. 正弦和余弦位置编码(Sinusoidal Positional Encoding)

  • 概述:由Vaswani等人在Transformer模型中提出,正弦和余弦位置编码通过不同频率的正弦和余弦函数对序列中的每个位置进行编码。
  • 计算方式 :对每个位置i和维度2k,使用正弦函数和余弦函数进行编码:
  • 优点:位置编码是固定的,不依赖于训练数据,可以适用于任意长度的序列。编码的顺序信息是通过周期性函数显式表达的。

2. 可学习的位置编码(Learnable Positional Encoding)

  • 概述:可学习的位置编码将位置编码作为可训练的参数直接嵌入到模型中。这些编码通过反向传播进行优化,随着训练的进行不断调整。
  • 计算方式:每个位置对应一个向量,和模型中的其他权重一样,这些位置向量通过训练进行优化。
  • 优点:通过学习获得的位置编码可以根据具体任务进行优化,能够更好地适应特定任务的需求。

3. 相对位置编码(Relative Positional Encoding)

  • 概述:相对位置编码通过编码序列中元素之间的相对位置,而不是绝对位置。它在一些Transformer变种(如Transformer-XL)中被使用,旨在改进长序列建模。
  • 计算方式:对于序列中的任意两个位置 ( i ) 和 ( j ),编码表示它们之间的相对位置 ( |i - j| )。
  • 优点:适合处理长序列,尤其是在序列长度较大时,相对位置编码比绝对位置编码表现更好。

4. 线性位置编码(Linear Positional Encoding)

  • 概述:线性位置编码是一种简单的编码方法,通过线性增加的位置向量来表达位置关系。
  • 计算方式:位置编码可以简单地通过位置的线性映射(例如直接使用位置作为编码向量)来完成。
  • 优点:实现简单,但通常效果不如其他复杂的编码方式。

5. 一热编码(One-hot Encoding)

  • 概述:对于每个位置,使用一个独热向量来表示该位置的存在。这种编码方式是最简单的一种,但通常只用于短序列或其他简单任务。
  • 计算方式:每个位置有一个对应的独热向量,表示该位置的唯一性。
  • 优点:简单直观,但不保留位置信息的连贯性和顺序。

6. 动态位置编码(Dynamic Positional Encoding)

  • 概述:与固定位置编码不同,动态位置编码基于输入的序列动态计算位置编码,通常结合其他特征(如上下文信息)。
  • 优点:更加灵活,可以根据具体输入序列的上下文动态调整。

3、

相关推荐
紧固视界1 分钟前
2026上海紧固件专业展,紧固件设备集中展示平台
大数据·人工智能·上海紧固件展·紧固件展·上海紧固件专业展
杨夏同学9 分钟前
AI入门——如何计算神经网络的参数
人工智能·深度学习·神经网络
好运的阿财13 分钟前
大模型热切换功能完整实现指南
人工智能·python·程序人生·开源·ai编程
互联网江湖19 分钟前
千问闯关AI混沌期:阿里画靶,吴嘉张弓,马云射箭?
人工智能
AI品信智慧数智人26 分钟前
景区AI伴游革新!山东品信数字人智能语音交互系统,重构文旅智慧体验✨
人工智能
大喵桑丶28 分钟前
ZABBIX7二次开发AI监控数据调取杂记
大数据·人工智能·python
龙文浩_42 分钟前
AI中NLP的注意力机制的计算公式解析
人工智能·pytorch·深度学习·神经网络·自然语言处理
北京软秦科技有限公司43 分钟前
物流运输环境检测进入AI报告审核时代:IACheck如何重塑报告精准性与全流程质量把控?
大数据·人工智能
鬼先生_sir1 小时前
Spring AI Alibaba 用户使用手册
java·人工智能·springai
w_t_y_y1 小时前
模型和算法篇(一)监督学习回归问题(2)树形回归
机器学习