1.摘要
自动启发式设计(AHD)旨在自动生成适配组合优化问题的启发式规则,但现有大语言模型(LLM)方法多依赖单一角色,生成结果的稳定性和多样性有限。论文提出 RoCo(Role-based LLMs Collaboration),将探索者、开发者、批评者和整合者组织成多轮协作系统,并耦合结构化协作、目标驱动反思、跨代记忆和进化搜索。探索者负责产生多样方案,开发者进行保守改进,批评者根据目标值变化反馈优缺点,整合者融合两类候选;跨代记忆进一步指导精英变异。
2. 问题定义与基础框架
见个人简介