llama微调后大模型测评

一:自行问答

加载微调后的模型,问答

同问题复现

1.微调模型

复制代码
llamafactory-cli chat \
--model_name_or_path /mnt/c/Users/hsp/.cache/modelscope/hub/models/Qwen/Qwen2.5-7B-Instruct \
--model_type qwen2 \
--template qwen \
--finetuning_type lora \
--lora_dir ./lora_qwen

2,原模型

复制代码
llamafactory-cli chat \
--model_name_or_path /mnt/c/Users/hsp/.cache/modelscope/hub/models/Qwen/Qwen2.5-7B-Instruct \
--model_type qwen2 \
--template qwen

二:自动化指标测评(llama内置)

复制代码
llamafactory-cli eval \
--model_name_or_path 你的本地模型路径 \
--finetuning_type lora \
--lora_dir ./lora_qwen \
--eval_tasks ceval,cmmlu

跑完自动输出:准确率、得分、各项指标

ceval:中文能力测评;cmmlu:多学科综合测评

相关推荐
Vd7H20A716 小时前
Windows 下用 llama.cpp 运行 Qwen3.8-27B 并开启 512K 上下文 完全指南
windows·llama
jason.zeng@15022071 天前
(六)Prompt 优化
python·ai·langchain·prompt·ai编程·llama
jason.zeng@15022071 天前
(八)现有架构上新增一个通用Excel导出工具
python·架构·langchain·excel·llama
jason.zeng@15022071 天前
(九)多轮对话式新增维修记录实现方案
python·prompt·交互·llama
jason.zeng@15022071 天前
(五)多轮对话上下文,实现交互。
python·交互·llama
jason.zeng@15022071 天前
(十)分层架构的多文件工程
python·架构·prompt·交互·ai编程·llama
n112124 天前
4G 显存老显卡怎么跑模型:llama.cpp 加 GGUF 配置
llama·llama.cpp·本地大模型·gguf
打工仔折腾 AI5 天前
LLaMA 1 到 LLaMA 3 架构演进拆解:从 RoPE、GQA 到词表扩张
人工智能·后端·python·深度学习·langchain·llama
倔强的石头1065 天前
LLaMA系列架构详解_Meta开源大模型的技术演进
开源·大模型·llama
梅雅达编程笔记10 天前
开源模型的安全悖论——越开放,越危险?
llama·qwen·开源大模型·ai安全·模型越狱·权重投毒·大模型治理