Unsloth Studio 使用问题记录

离线环境,官方docker镜像,k8s环境使用

1、导出模型时从github克隆llama.cpp处理

手动下载源码https://github.com/ggml-org/llama.cpp传到unsloth内

根据报错日志的路径,创建目录

dart 复制代码
mkdir /home/unsloth/.unsloth/llama.cpp -p

把llama.cpp源码放进去

dart 复制代码
/opt/venv/bin/python3 -m pip install gguf protobuf sentencepiece mistral_common   #自己指定源处理下,或者加变量

重试,就不会从github自动拉了,pip源记得配,或者人工干预,ps -ef 看下他在装什么包

可以看到已经完成了llama.cpp的源码构建安装

手动转换,不依赖Unsloth

dart 复制代码
# 转换并输出 f16 GGUF
cd llama.cpp
python convert_hf_to_gguf.py ./my_unsloth_model \
    --outtype f16 \
    --outfile my_model_f16.gguf

后面还有代码写死从github下载https://github.com/ggerganov/llama.cpp/raw/refs/heads/master/convert_hf_to_gguf.py

改变量没测,直接改代码

dart 复制代码
unsloth@unsloth-studio-7fd9b89dcd-mjd8x:/workspace/llama.cpp$ python -m http.server 8081
Serving HTTP on 0.0.0.0 port 8081 (http://0.0.0.0:8081/) ...
127.0.0.1 - - [26/Apr/2026 13:40:37] "GET /convert_hf_to_gguf.py HTTP/1.1" 200 -
127.0.0.1 - - [26/Apr/2026 13:42:35] "GET /convert_hf_to_gguf.py HTTP/1.1" 200 -
dart 复制代码
vim /opt/venv/lib/python3.12/site-packages/unsloth_zoo/llama_cpp.py   #报错代码55行

成功转GGUF并量化

2、数据集生成报错

index-CY5egRSv.js:73 POST http://10.103.184.147:8000/api/data-recipe/validate 500 (Internal Server Error)

持久化的workspace目录要给unsloth用户权限

要选Full Run

根据 Unsloth Studio 的官方设计:

Preview Run(预览运行):仅用于快速调试,不会生成持久化的本地数据集文件,因此不会出现在Train页面的数据集列表里。

Full Run(完整运行):才会生成可被训练页面识别的、持久化的数据集文件,之后会自动出现在Local标签的列表中。

你的第三张截图里,所有运行记录都标着Preview,说明你只跑了预览,没有执行完整的数据集生成流程,所以 Train 页面自然找不到数据集。

相关推荐
阡之尘埃2 天前
Python数据分析案例85——大模型微调全流程(SFT的LoRA微调)
人工智能·python·深度学习·语言模型·llm·微调·千问
weixin_440213293 天前
大模型训练、微调、对齐、推理、量化、优化、数据集等
微调·数据集·sft·预训练·模型量化·gptq·kv cache
Lee_jerome4 天前
python神经网络编程入门(四十四)——微调预训练 BERT 做下游任务
微调·bert·迁移学习·文本分类·预训练·小样本·冻结特征
像风一样自由20205 天前
14.什么时候用pgvector什么时候单独部署Milvus
postgresql·大模型·微调·milvus
孙启超12 天前
【大模型应用开发】LLM 到底是什么,以及它是怎么训练的
人工智能·lora·llm·微调·sft·token·rlhf
XLYcmy15 天前
京东 算法实习一面 下+手撕
c++·python·llm·概率论·数据处理·训练·codebert
XLYcmy17 天前
京东 算法实习一面 上
rnn·神经网络·llm·微调·transformer·训练·对齐
犀思云1 个月前
算力网络怎么建?训练、推理、采集、调度——四类场景架构与选型完全指南
训练·推理·ai原生·算力网络
张小泡泡1 个月前
AUTO_EVAL:面向大语言模型的多层次自动化评测框架
论文阅读·人工智能·语言模型·自然语言处理·自动化·微调
西西弗Sisyphus1 个月前
部署模型的优化:图像标准化预处理从三步到一步乘加(2)
人工智能·机器学习·分类·训练·推理·imagenet