qwen微调

复制代码
# env
apt-get update
apt-get install git-lfs
git init
git lfs install
mkdir Qwen
cd Qwen
git clone https://huggingface.co/Qwen/Qwen-7B
cd ..
git clone https://gitee.com/meijunhui0917/LLaMA-Efficient-Tuning.git
git clone "huanhuan": {
    "file_name": "huanhuan.json",
    "columns": {
      "prompt": "instruction",
      "query": "input",
      "response": "output"
    }
  },
复制代码
CUDA_VISIBLE_DEVICES=0 python src/train_bash.py \
    --stage sft \
    --model_name_or_path ../Qwen/Qwen-7B\
    --do_train \
    --dataset huanhuan \
    --template default \
    --finetuning_type lora \
    --lora_target c_attn \
    --output_dir ./model \
    --overwrite_cache \
    --per_device_train_batch_size 4 \
    --gradient_accumulation_steps 4 \
    --lr_scheduler_type cosine \
    --logging_steps 10 \
    --save_steps 1000 \
    --learning_rate 5e-5 \
    --num_train_epochs 3.0 \
    --plot_loss \
    --fp16
python 复制代码
CUDA_VISIBLE_DEVICES=0 python  src/train_bash.py \
    --stage sft \
    --model_name_or_path ../Qwen/Qwen-7B \
    --do_train True \
    --overwrite_cache True \
    --finetuning_type lora \
    --template chatml \
    --dataset huanhuan \
    --max_source_length 512 \
    --max_target_length 512 \
    --learning_rate 5e-05 \
    --num_train_epochs 3.0 \
    --max_samples 100000 \
    --per_device_train_batch_size 1 \
    --gradient_accumulation_steps 4 \
    --lr_scheduler_type cosine \
    --max_grad_norm 1.0 \
    --logging_steps 5 \
    --save_steps 100 \
    --warmup_steps 0 \
    --padding_side left \
    --lora_rank 8 \
    --lora_dropout 0.1 \
    --lora_target c_attn \
    --resume_lora_training True \
    --output_dir saves/Qwen-7B-chat/lora/2023-08-22-17-23-51 \
    --fp16 True \
    --plot_loss True 
复制代码
复制代码
复制代码
复制代码
复制代码
复制代码
相关推荐
量子位14 小时前
我们都错怪GPT-5了,路由统一算力,免费用户也能创造收益
gpt·ai编程
哪吒编程18 小时前
GPT-5发布引发用户强烈反弹,OpenAI紧急回应
gpt·chatgpt·openai
晨欣18 小时前
orjson 与 json:实战对比与选型指南(含示例)(GPT-5 回答)
gpt·json
Leinwin1 天前
微软发布GPT-5赋能的Copilot:重构办公场景的智能革命
gpt·microsoft·copilot
zhurui_xiaozhuzaizai1 天前
OpenAI官方写的GPT-5 prompt指南
gpt·prompt
星际码仔1 天前
图解 GPT-5 提示词:这可能是全网最“直观”的《 GPT-5 提示词指南》拆解
gpt·ai编程
不焦躁的程序员2 天前
选择gpt-5还是claude-4-sonnect
人工智能·gpt·cursor
陈敬雷-充电了么-CEO兼CTO2 天前
OpenAI开源大模型 GPT-OSS 开放权重语言模型解析:技术特性、部署应用及产业影响
人工智能·gpt·ai·语言模型·自然语言处理·chatgpt·大模型
阿里云大数据AI技术3 天前
【新模型速递】PAI-Model Gallery云上一键部署gpt-oss系列模型
人工智能·gpt·llm
哪吒编程4 天前
重磅更新!满血GPT-5上线,全方位提升,很强
gpt·chatgpt·openai