让ai执行多轮行动可以把任务变成限定长度的操作,让ai填空,比如我3d模型可以参数化全部给ai,ai返回修改后完全的模型

这个思路其实在多个领域都有对应的研究工作。我找到了一些相关的论文:

Paper Authors Summary
CraftsMan3D: High-fidelity Mesh Generation with 3D Native Generation and Interactive Geometry Refiner Tencent AI Lab et al. 用迭代refiner来优化3D几何------生成初始mesh后通过多轮交互式修正逼近目标
ReFit: Recurrent Fitting Network for 3D Human Recovery --- 用循环网络实现"反馈-更新"循环,每轮输出参数化的3D人体mesh
Outline, Then Details: Syntactically Guided Coarse-To-Fine Code Generation UT Austin 代码生成的多轮策略:先生成轮廓AST,再逐步填充细节------本质是参数化的语法树迭代
PICARD: Parsing Incrementally for Constrained Auto-Regressive Decoding from Language Models ServiceNow, ElementAI 约束解码的经典工作,通过语法规则限制token选择,保证输出始终是有效结构
CRANE: Reasoning with constrained LLM generation --- 代码/symbolic math的约束生成,用上下文无关文法强制输出符合语法
ChopChop: a Programmable Framework for Semantically Constraining the Output of Language Models UC San Diego 用类型系统和程序不变式来约束LM输出,确保语义正确性

关键的 insight 是:把"生成文本"变成"在参数空间搜索",这通常通过以下方式实现:

  1. 约束解码(Constrained Decoding) ------ 用语法/类型系统限制每一步的token选择,保证输出始终是可解析的结构(JSON、代码AST、mesh参数等)

  2. 迭代Refinement ------ 像Diffusion模型或CraftsMan那样,不是一次生成最终答案,而是多轮逐步修正,每轮输出完整的参数向量

  3. 神经反馈循环 ------ ReFit那种结构:当前参数 → 网络 → 修正后的完整参数

你想深入了解哪个方向?比如约束解码的具体实现,或者3D参数化表示的论文?

相关推荐
阿部多瑞 ABU4 小时前
泛二次元问题舆论战与问题诸论
大数据·人工智能·ai写作
一切皆是因缘际会5 小时前
掌控信息论:同源星际通信基础理论
人工智能·算法·ai
库拉大叔5 小时前
知漫剧、豆包、可灵,角色一致性谁更强
人工智能·aigc
飞哥数智坊5 小时前
AI 帮我把 Mac 下的 3D 鱼缸搬到了 Windows
人工智能·ai编程
飞猫的边缘AI5 小时前
边缘AI为什么加速上车了?
人工智能·自动驾驶·辅助驾驶·vla·noa·边缘ai·ai场景
goujunwe5 小时前
GEO 内容写作标准:4 套可直接复制、更容易被 AI 采信的结构化模板
人工智能
看浪的路人5 小时前
第4讲:数据投毒与模型完整性保护
人工智能
通信瓦工6 小时前
高功率密度AI数据中心的Mega AALC(高级辅助液体冷却)解决方案
大数据·人工智能
u1301306 小时前
GitHub 热榜项目:日榜(2026-10-06)
人工智能·github
DongQiShanRen6 小时前
裁决台账双向互校(中):五向一致性链——②向解读与③向实现
人工智能·深度学习·自然语言处理·集成学习·vllm