小白1分钟安装flash-attn

  1. 先在终端查看自己的python、torch、cuda的版本

  2. 在网站上查找对应的文件,下载下来:

Releases · Dao-AILab/flash-attention · GitHub

比如:我是python3.12、torch2.4、cuda 12.1、False

所以我下载的是这个文件:

【python 3.12,下载第三个文件,文件名:cp312对应的python3.12】

  1. 把这个文件传到你的文件夹里,然后直接

pip install flash_attn-2.8.3.post1+cu12torch2.4cxx11abiFALSE-cp312-cp312-linux_x86_64.whl.zip【也就是pip install 文件名】就ok啦!

相关推荐
言乐63 小时前
Python游戏水平测试辅助系统
开发语言·python·游戏·django·pygame
从零开始学习人工智能9 小时前
【踩坑实录】WSL2 解决 onnxruntime\-gpu ImportError: libcudart\.so\.13 无 CUDA13 运行库问题
python
WWJA王文举10 小时前
I²C通信完整流程详解:START、地址、ACK、数据、Repeated START和STOP一次讲透
c语言·开发语言
卷无止境10 小时前
在 awesome-fastapi 里,哪些库值得一看?
后端·python
zhanghaha131410 小时前
Python进阶教程:6_JSON 数据解析 —— 新手完全指南
开发语言·python·json
Python私教10 小时前
API 输出模型怎么设计:从 model_dump() 到显式展示层
python·fastapi
Python私教11 小时前
本地 AI 工具服务该绑定 127.0.0.1 还是 0.0.0.0?
python·fastapi
卷无止境11 小时前
FastAPI 的Admin面板生态
后端·python
qq_4480111611 小时前
C语言中的动态内存分配
c语言·开发语言·php
ctlover12 小时前
Streamlit 框架
python