Unsloth Studio 使用问题记录

离线环境,官方docker镜像,k8s环境使用

1、导出模型时从github克隆llama.cpp处理

手动下载源码https://github.com/ggml-org/llama.cpp传到unsloth内

根据报错日志的路径,创建目录

dart 复制代码
mkdir /home/unsloth/.unsloth/llama.cpp -p

把llama.cpp源码放进去

dart 复制代码
/opt/venv/bin/python3 -m pip install gguf protobuf sentencepiece mistral_common   #自己指定源处理下,或者加变量

重试,就不会从github自动拉了,pip源记得配,或者人工干预,ps -ef 看下他在装什么包

可以看到已经完成了llama.cpp的源码构建安装

手动转换,不依赖Unsloth

dart 复制代码
# 转换并输出 f16 GGUF
cd llama.cpp
python convert_hf_to_gguf.py ./my_unsloth_model \
    --outtype f16 \
    --outfile my_model_f16.gguf

后面还有代码写死从github下载https://github.com/ggerganov/llama.cpp/raw/refs/heads/master/convert_hf_to_gguf.py

改变量没测,直接改代码

dart 复制代码
unsloth@unsloth-studio-7fd9b89dcd-mjd8x:/workspace/llama.cpp$ python -m http.server 8081
Serving HTTP on 0.0.0.0 port 8081 (http://0.0.0.0:8081/) ...
127.0.0.1 - - [26/Apr/2026 13:40:37] "GET /convert_hf_to_gguf.py HTTP/1.1" 200 -
127.0.0.1 - - [26/Apr/2026 13:42:35] "GET /convert_hf_to_gguf.py HTTP/1.1" 200 -
dart 复制代码
vim /opt/venv/lib/python3.12/site-packages/unsloth_zoo/llama_cpp.py   #报错代码55行

成功转GGUF并量化

2、数据集生成报错

index-CY5egRSv.js:73 POST http://10.103.184.147:8000/api/data-recipe/validate 500 (Internal Server Error)

持久化的workspace目录要给unsloth用户权限

要选Full Run

根据 Unsloth Studio 的官方设计:

Preview Run(预览运行):仅用于快速调试,不会生成持久化的本地数据集文件,因此不会出现在Train页面的数据集列表里。

Full Run(完整运行):才会生成可被训练页面识别的、持久化的数据集文件,之后会自动出现在Local标签的列表中。

你的第三张截图里,所有运行记录都标着Preview,说明你只跑了预览,没有执行完整的数据集生成流程,所以 Train 页面自然找不到数据集。

相关推荐
犀思云5 天前
算力网络怎么建?训练、推理、采集、调度——四类场景架构与选型完全指南
训练·推理·ai原生·算力网络
张小泡泡6 天前
AUTO_EVAL:面向大语言模型的多层次自动化评测框架
论文阅读·人工智能·语言模型·自然语言处理·自动化·微调
西西弗Sisyphus11 天前
部署模型的优化:图像标准化预处理从三步到一步乘加(2)
人工智能·机器学习·分类·训练·推理·imagenet
薛定谔的猫198219 天前
LLaMA Factory微调中的模版在vLLM或LMDeploy框架部署中对齐
大模型·微调·vllm·模版·llama factory·lmdeploy·对话模板
冷小鱼23 天前
Agent 大模型的后训练、微调、评估与迭代优化:从理论到工程实践
大模型·微调·优化·迭代·评估
程序员正茂1 个月前
YOLOX训练自己的COCO数据集
数据集·yolox·coco·训练
ybdesire1 个月前
微调LLM提升工具调用能力的ShareGPT数据格式
运维·服务器·人工智能·大模型·微调
虎妞05002 个月前
大模型微调实战:LoRA 与 QLoRA 原理精讲
深度学习·lora·大模型·微调·qlora
AndrewHZ2 个月前
【LLM技术全景】预训练与微调:大模型如何“学习“
人工智能·深度学习·大模型·llm·微调·预训练·rlhf
qqxhb3 个月前
30|什么时候需要 RAG:直接 Prompt/微调/RAG 的决策
微调·prompt·rag