Self-attention与Word2Vec

Self-attention (自注意力)和 Word2Vec 是两种不同的词嵌入技术,用于将单词映射到低维向量空间。它们之间的区别:

  1. Word2Vec

    • Word2Vec 是一种传统的词嵌入(word embedding)方法,旨在为每个单词学习一个全局的向量表示。
    • 它通过分析大量文本数据,将单词映射到一个连续的向量空间中,使得相似的单词在向量空间中距离较近。
    • Word2Vec 忽略了单词在不同上下文中的含义,因此对于多义词(例如,"left"在不同语境中有不同含义)只学习了一个表示。
  2. Self-attention

    • Self-attention 是一种用于序列数据的机制,特别在 Transformer,BERT, GPT模型中广泛应用。
    • 它允许模型根据输入序列的上下文动态调整不同元素的影响。
    • Self-attention 考虑了每个输入元素与其他元素之间的关联度,从而生成不同的表示。
    • 在自然语言处理中,Self-attention 可以根据单词在句子中的上下文生成不同的表示(contextual embedding),解决了多义词的问题。

总之,Word2Vec 是一种全局的词嵌入方法,而Self-attention 允许根据上下文动态生成不同的表示,更适合处理多义词和序列数据。

相关推荐
扯蛋4382 小时前
从脱敏到审批:我用 LangChain 11 个中间件给羽毛球 AI 助手装了一整套"安全阀"
langchain·llm·agent
uncle_ll5 小时前
LangGraph 深度解析:用图结构构建下一代智能代理与多智能体系统
langchain·llm·agent·graph·langgraph
陳陈陳7 小时前
大模型界的“高考状元”可信吗?一文带你读懂Benchmark的潜规则 📚🤖
机器学习·llm
元直数字电路验证7 小时前
从一次 API 调用到完整 Agent Loop:上下文到底如何流动
llm·ai agent·智能体·agent loop
Misnearch8 小时前
mcp-server
llm·jenkins·mcp
Summer-Bright8 小时前
AI 芯片简报 07.21-07.24:NVIDIA Vera 亮剑、AMD 2nm GPU、Google 叛逃 CoWoS
大数据·人工智能·ai·自然语言处理·芯片·agi
uncle_ll9 小时前
深入探索 Hugging Face核心组件及实践
llm·nlp·bert·huggingface·hf-mirror·hf
CoovallyAIHub9 小时前
当制造业遇上 AI 智能体:Coco 把工艺知识留在了工厂里
llm·agent
拾年2759 小时前
从"AI写代码我喝咖啡"到 Harness Engineering:Vibe Coding 不翻车的工程化生存指南
llm
CoderJia程序员甲10 小时前
GitHub 热榜项目 - 周榜(2026-07-26)
ai·大模型·llm·github·ai教程