Self-attention与Word2Vec

Self-attention (自注意力)和 Word2Vec 是两种不同的词嵌入技术,用于将单词映射到低维向量空间。它们之间的区别:

  1. Word2Vec:

    • Word2Vec 是一种传统的词嵌入(word embedding)方法,旨在为每个单词学习一个全局的向量表示。
    • 它通过分析大量文本数据,将单词映射到一个连续的向量空间中,使得相似的单词在向量空间中距离较近。
    • Word2Vec 忽略了单词在不同上下文中的含义,因此对于多义词(例如,"left"在不同语境中有不同含义)只学习了一个表示。
  2. Self-attention:

    • Self-attention 是一种用于序列数据的机制,特别在 Transformer,BERT, GPT模型中广泛应用。
    • 它允许模型根据输入序列的上下文动态调整不同元素的影响。
    • Self-attention 考虑了每个输入元素与其他元素之间的关联度,从而生成不同的表示。
    • 在自然语言处理中,Self-attention 可以根据单词在句子中的上下文生成不同的表示(contextual embedding),解决了多义词的问题。

总之,Word2Vec 是一种全局的词嵌入方法,而Self-attention 允许根据上下文动态生成不同的表示,更适合处理多义词和序列数据。

相关推荐
桃西西呀2 小时前
Laya 源码级原理拆解之四:路由检测与服务部署
人工智能·llm·ai编程
桃西西呀2 小时前
Laya 源码级原理拆解之三:字段编译与业务胶水
人工智能·llm·ai编程
stereohomology3 小时前
我对大模型训练的两个态度
llm
柒和远方3 小时前
DocResearch 项目面试:把每个模块讲明白,而不是背术语
python·llm·agent
柒和远方4 小时前
DocResearch 项目理解:从一条命令到一份有出处的报告
python·llm·agent
the局外人4 小时前
读懂LangGraph 的分支执行逻辑
后端·langchain·llm
空 白II5 小时前
9.26 大语言模型研究简报:CLM-8B 用对比学习替代 Agent 中大量生成式决策
人工智能·大语言模型·clm
Omics Pro5 小时前
空间组学!医学代谢显微工具
数据库·人工智能·算法·机器学习·自然语言处理
爱上纯净的蓝天15 小时前
只输出选项和概率的模型:判别层的接口契约与阈值工程
人工智能·大模型·llm·模型评估·架构设计
流浪00116 小时前
大模型技术全景(十二):人工介入 HITL、HOTL 与 HOOTL
llm·hitl·人工介入·hotl·hootl