神经网络之特征值与特征向量

1. 定义

给定一个方阵 (A∈Rn×n)(A \in \mathbb{R}^{n \times n})(A∈Rn×n),如果存在一个非零向量 (v≠0)(v \neq 0)(v=0) 和一个标量 (λ)(\lambda)(λ),满足
Av=λv A v = \lambda v Av=λv

那么:

  • (v)(v)(v) 称为矩阵 (A)(A)(A) 的特征向量
  • (λ)(\lambda)(λ) 称为矩阵 (A)(A)(A) 的特征值

直观理解

特征向量是经过矩阵变换 (A)(A)(A) 后,只被拉伸或缩放,而不改变方向 的向量。

特征值就是这个拉伸/缩放的倍数。


2. 几何意义

  • 对称矩阵 (A)(A)(A) 可以看作一个线性变换:把空间中的向量映射到另一个向量。

  • 特征向量对应的是变换中保持方向不变的方向。

  • 特征值告诉我们沿这个方向的伸缩程度:

    • (∣λ∣>1)(|\lambda| > 1)(∣λ∣>1):向量被拉长
    • (0<∣λ∣<1)(0 < |\lambda| < 1)(0<∣λ∣<1):向量被缩短
    • (λ<0)(\lambda < 0)(λ<0):方向反向并缩放

例如:
A=[20 03],v1=[1 0], v2=[0 1] A = \begin{bmatrix} 2 & 0 \ 0 & 3 \end{bmatrix}, \quad v_1 = \begin{bmatrix} 1 \ 0 \end{bmatrix}, \ v_2 = \begin{bmatrix} 0 \ 1 \end{bmatrix} A=[20 03],v1=[1 0], v2=[0 1]

这里:
Av1=2v1,Av2=3v2 A v_1 = 2 v_1, \quad A v_2 = 3 v_2 Av1=2v1,Av2=3v2

所以 (v1,v2)(v_1, v_2)(v1,v2) 是特征向量,2 和 3 是特征值。几何上就是 x 方向被拉伸 2 倍,y 方向被拉伸 3 倍。


3. 计算方法

  1. 写出特征方程:
    det⁡(A−λI)=0 \det(A - \lambda I) = 0 det(A−λI)=0

    这里 (I)(I)(I) 是单位矩阵。

  2. 解这个多项式方程得到 (λ1,λ2,...,λn)(\lambda_1, \lambda_2, \dots, \lambda_n)(λ1,λ2,...,λn)(特征值)。

  3. 对每个特征值 (λ)(\lambda)(λ),解线性方程组:
    (A−λI)v=0 (A - \lambda I)v = 0 (A−λI)v=0

    得到对应的特征向量 (v)(v)(v)。


4. 特点

  • (n×n)(n \times n)(n×n) 矩阵最多有 (n)(n)(n) 个特征值(可能有重根)。

  • 对称矩阵:

    • 特征值都是实数
    • 不同特征值对应的特征向量是正交的
相关推荐
喜欢吃豆12 小时前
使用 OpenAI Responses API 构建生产级应用的终极指南—— 状态、流式、异步与文件处理
网络·人工智能·自然语言处理·大模型
Q同学12 小时前
verl进行Agentic-RL多工具数据集字段匹配问题记录
人工智能
亚马逊云开发者12 小时前
Amazon Q Developer 结合 MCP 实现智能邮件和日程管理
人工智能
Coding茶水间12 小时前
基于深度学习的路面坑洞检测系统演示与介绍(YOLOv12/v11/v8/v5模型+Pyqt5界面+训练代码+数据集)
图像处理·人工智能·深度学习·yolo·目标检测·计算机视觉
梵得儿SHI12 小时前
AI Agent 深度解析:高级架构、优化策略与行业实战指南(多智能体 + 分层决策 + 人类在环)
人工智能·多智能体系统·aiagent·分层决策系统·人类在环机制·agent系统完整解决方案·aiagent底层原理
哥布林学者12 小时前
吴恩达深度学习课程三: 结构化机器学习项目 第二周:误差分析与学习方法(一)误差分析与快速迭代
深度学习·ai
Peter_Monster13 小时前
大语言模型(LLM)架构核心解析(干货篇)
人工智能·语言模型·架构
Ma04071313 小时前
【机器学习】监督学习、无监督学习、半监督学习、自监督学习、弱监督学习、强化学习
人工智能·学习·机器学习
cooldream200913 小时前
LlamaIndex 存储体系深度解析
人工智能·rag·llamaindex
CoovallyAIHub13 小时前
如何在手机上轻松识别多种鸟类?我们发现了更简单的秘密……
深度学习·算法·计算机视觉