一、端侧能力迁移:后训练、压缩与蒸馏
目标很明确:把大模型已经具备的规划、工具调用、推理链能力,迁移到 1B-10B 级端侧模型上,并且性能不明显下降。
涉及的技术点包括:知识蒸馏、量化、剪枝等模型压缩技术;RLHF/DPO;小模型数据配比与合成数据构造;以及 on-device 部署,比如 Gemma、Phi 级别模型或手机端推理优化。
工程上的难点主要在能力保持、数据配比、量化损失和端侧延迟。不是简单跑通一个蒸馏脚本,而是要让小模型在真实端侧环境里稳定可用。
二、Agent 自迭代与长程自主
另一个方向更偏 Agent 系统本身。核心不是让 Agent 跑一次 demo,而是解决长 workloop 中的错误累积与自我纠偏。
常见技术栈包括:Agentic RL、self-improving agent;memory/reflection;self-reward/verifier;multi-step reasoning 评估体系;以及"什么算成功"的自动化判定。
难点在于:如何从执行轨迹中自动总结经验,如何生成自己的训练信号,如何在多轮任务中稳定推进而不跑偏。评估体系也很关键,否则很难判断 Agent 是否真的在变好。
三、能力画像
从行业交流看,这类角色通常有几个共同点:
博士学历是常见门槛;
全球 AI 头部团队或大厂实战背景更匹配;
两个方向可以二选一,也可以兼修;
对技术路线有判断力,能独立推进,能和一号位对话;
不是管理岗,更接近专家/核心贡献者;
工作节奏灵活,尊重个人安排。
四、行业观察:回报与团队文化
这类专家档角色,市场定位通常在高级专家/核心贡献者区间,回报结构多为现金 + 长期激励,现金占比较高。保障方面,规范团队通常公积金实缴并有补充,假期按国家标准,工作节奏灵活。
某 AI 跨境出海服务方向的团队近期在搭建相关能力,业务增长较快,文化上比较尊重人才。
五、学习路径建议
后训练方向:从蒸馏、量化、剪枝入手,复现小模型端侧部署;
Agent 方向:从 multi-step reasoning 评估、memory/reflection、verifier 入手;
交叉方向:把 Agent 能力蒸馏到小模型,或让 Agent 自动生成训练数据。
敲门敲门辽。。。