llama微调后大模型测评

一:自行问答

加载微调后的模型,问答

同问题复现

1.微调模型

复制代码
llamafactory-cli chat \
--model_name_or_path /mnt/c/Users/hsp/.cache/modelscope/hub/models/Qwen/Qwen2.5-7B-Instruct \
--model_type qwen2 \
--template qwen \
--finetuning_type lora \
--lora_dir ./lora_qwen

2,原模型

复制代码
llamafactory-cli chat \
--model_name_or_path /mnt/c/Users/hsp/.cache/modelscope/hub/models/Qwen/Qwen2.5-7B-Instruct \
--model_type qwen2 \
--template qwen

二:自动化指标测评(llama内置)

复制代码
llamafactory-cli eval \
--model_name_or_path 你的本地模型路径 \
--finetuning_type lora \
--lora_dir ./lora_qwen \
--eval_tasks ceval,cmmlu

跑完自动输出:准确率、得分、各项指标

ceval:中文能力测评;cmmlu:多学科综合测评

相关推荐
qyyyyy5701 天前
PDF 转 JSON 怎么做?从表格和元数据提取到 LLM 结构化处理
数据库·pdf·json·erlang·llama
薛定e的猫咪1 天前
【大模型量化】使用 llama.cpp 完成量化、本地推理与服务化部署
人工智能·深度学习·算法·llama
CODER03041 天前
win11系统编译安装cuda版llama-cpp-python(踩完所有的坑)
开发语言·python·llama
今天吃饺子2 天前
超高创新模型!TF-SAX-Llama 轴承故障诊断
大语言模型·llama·故障诊断
明月千里赴迢遥3 天前
Node搭建代理清洗API请求
llama
Rei22483 天前
使用llama.cpp的Qwen3.6-27B-Q8本地部署详解【Linux GPU】
linux·运维·llama
蛋先生DX4 天前
大模型本地部署神器的瘦身进阶原理,就这两招?
llm·llama·ollama
爱学习的小白柏5 天前
【AI问数技术】多Agent协同架构:查询规划/SQL生成/洞察分析/报告生成
java·网络·人工智能·windows·sql·架构·llama
qy2016skq5 天前
OpenClaw 源码解读——入门与破局9 双插件协同:Quota Guard 负责“停“,Model Router 负责“绕“
langchain·prompt·aigc·embedding·ai编程·llama·agi
CHPCWWHSU5 天前
llama.cpp + DeepSeek-Harness 构建本地大模型推理与Agent智能体系统
llama