【大模型微调】使用Llama Factory实现中文llama3微调

【大模型微调】使用Llama Factory实现中文llama3微调
github链接

为什么不用基座模型:95%用的英文数据训练,训练效果不好

所以用的Llama3-99-Chinese-Chat(别人微调过的再微调)

相关推荐
Canace4 分钟前
为了给视频里的人脸打码,我让 Claude 做了个 Skill
前端·人工智能
武子康5 分钟前
Prompt 之外,生产级 Agent Harness 到底在控制什么
人工智能·llm·agent
ltqvibe8 分钟前
企业智能问数落地:从一句话到跨系统完整答案
java·人工智能·本体语义平台
懂好多的工业电源工程师9 分钟前
F2424S-1WR3 适配优选 钡特电源 DF1-24S24LS|1W 工业24V转24V模块电源参数技术性能解析
网络·人工智能·电源模块
计算机魔术师16 分钟前
Replit Design 发布:AI 赋能设计愿景
人工智能·ai编程·编程语言
wangxin20826 分钟前
同一只股票三个 AI 写出三种段位:CoordClaw 多智能体如何产出投研级股评
人工智能·多智能体·团队协作·管理学·组织管理·coordclaw·ai数字社会
程序员cxuan27 分钟前
Codex 接入 DeepSeek-V4-Flash,丝滑的一批
人工智能·后端·程序员
大鱼>27 分钟前
DSPy:LLM程序自动编译与提示词优化
开发语言·人工智能·python·深度学习
AI科技星28 分钟前
全域光速运动理论体系 (GAQ-UFT)——范式重构、核心方程与传统物理的本质分野
人工智能·线性代数·机器学习·重构·数据挖掘·回归·ai科技星