VisCoder2:构建多语言可视化编码智能体(翻译与解读)大型语言模型(LLMs)近期已使编码智能体能够生成、执行和修正可视化代码。然而,由于语言覆盖有限、执行不可靠以及缺乏迭代修正机制,现有模型在实际工作流中经常失败。进展受到狭窄的数据集和基准测试的限制,这些资源强调单轮生成和单语言任务。为应对这些挑战,该研究引入了三个互补资源来推进可视化编码智能体的发展。VisCode-Multi-679K 是一个大规模监督数据集,包含 67.9 万个已验证的可执行可视化样本和多轮修正对话,覆盖 12 种编程语言。VisPlotBench 是一个用于系统评估的基准测试,包含