EditHero:连续改三维部件时,如何识别“没改好”和“改坏了别处”
457条可重放编辑链;代码代理更能保住未修改部分,但新几何精度、耗时和材质评测仍有限
EditHero以部件装配日志生成逐轮精确目标,包含252个宿主、457条链和2755次增删、替换、重贴图。每一步接着方法自己的输出做,分别衡量本轮完成的改变和未编辑区域的保留。在55条共享比较链中,六个语言/视觉代理更善于保留原资产,多数更遵从指令,但新增形状仍粗糙,每次编辑约1.5–6分钟。
图解主要方法
连续增加、删除、替换和重贴图后,资产有没有完成本轮要求,同时保住之前的工作?

- 1
以可命名部件生成可重放编辑链
把宿主部件归为槽位,按文字检索新部件,经视觉筛选与接触、尺度、连通、穿透检查,记录每轮部件、位姿和纹理。人工逐轮审阅修复后,JSON配方可恢复每一轮精确目标;评测方法看不到配方。
- 2
将几何操作与材质操作分开
增删、替换改变部件几何;重贴图先用Qwen编辑部件渲染,再由TRELLIS.2纹理模块写回不变几何。发布说明指出可烘焙到新UV布局,所以数据目标几何不变不等于UV原封不动。
- 3
每轮接着自身输出编辑
输入是方法自己的上一轮网格、当前指令和一个目标视图,VoxHammer还得到真值编辑掩码。失败会阻断后续轮次,不用真值悄悄重启;另有重置诊断明确独立报告。
- 4
按区域和实际仍需改变的内容评分
编辑区域取指定部件前后表面的并集并膨胀一格;64立方网格计算IF与保留IoU。新增只计上一轮尚缺的目标体素,删除只计仍存在的待删体素,替换取二者调和平均;本来已消失的东西不会再算一次成功删除。
- 5
同时看局部保留、累积损伤与材质图像
本轮CC比较自身前后状态,累积CC比较至今从未被要求编辑的初始区域。重贴图不定义几何IF,以固定四视角的图像和改变幅度诊断;再用不操作、每轮重生成两端基线识别指标偏差。
实验与证据
完整正文及7–22节附录已读;图1核验;代码递归文件树、数据实际文件清单、数据卡与混合许可已检查。未运行数据引擎或评测。
来源证据457链2755次编辑,252宿主;链长3–30,中位数6。 统计及表9 ↗
我的解读长链尾部样本稀少:共同完成集的11–30轮组仅11链,不能把30轮上限当作普遍长程表现。
来源证据全量非代理比较:IF为0.12–0.32,整物体F-score最高0.71;不操作基线F-score0.77。 表2 ↗
我的解读整体保真度混合了不做操作的奖励,应并读IF与保留率;IF不是逐条指令二元成功率。
来源证据55链416次:Opus 5.5的IF0.62、CC前态0.98;Nano3D为0.34、0.90。 表3及表6 ↗
我的解读同一个比较子集,但前者有效IF299轮、后者274轮,材质轮不计;不能说62%的所有编辑成功。
来源证据全量VoxHammer完成2569/2755轮、418/457链;Nano3D2749轮、455链。 表5 ↗
我的解读完成只表示网格可加载,不表示内容正确。失败/阻断轮次未进入指标均值,覆盖率应和分数并列。
来源证据200链重置诊断,Nano3D第5轮目标IoU从自回滚0.518到真值输入0.681。 表10 ↗
我的解读支持继承误差的重要性;真值输入下保留自身状态的指标反而更低,说明高保留率也可能在稳定保留错误。
来源证据重贴图Nano3D变化幅度只有目标的0.31倍,目标残差0.209,对照不编辑0.210。 附录12及表11 ↗
我的解读它没有材质模式,实验以replace模式适配;高几何IoU并不能证明完成了材质修改。
来源证据代理每次编辑中位耗时87–358秒;四生成方法单H100为20–49秒。 表12及预算说明 ↗
我的解读代理时间含模型与工具延迟且预算不同,不可换算为同硬件加速比。部分代理完成补跑无上限。
来源证据四视角平均之外,编辑区Opus的LPIPS条件视图0.215、未见视图0.246。 表15 ↗
我的解读存在未见视角退化;这些视角仍在同一高度与固定照明下,不验证完整材质重光照。
来源证据数据许可列出33个CC BY-NC与11个CC BY-NC-SA源对象,另有CC BY-SA资产。 LICENSE-DATA.md ↗
我的解读研究代码可用不等于所有组合资产可自由商用;应沿配方追踪每个部件的来源。
开放情况与使用许可
10月8日发布数据引擎和数据。仓库有装配、检索、重建、渲染、标注实现;Hugging Face列出状态、配方、掩码、渲染和部件tar及示例。已确认不是空仓库;未在文件树中确认论文全部方法适配器与评分代码齐备。
LICENSE引擎MIT、论文CC BY 4.0;自有配方和标注CC BY 4.0。网格、纹理、渲染继承源对象的CC BY、CC0、CC BY-NC、CC BY-SA及CC BY-NC-SA等许可,详见逐对象署名表。
我的判断
独立分析 · 未复现实验正方 · 为什么值得投入
全局相似指标中不做操作反而胜过四种生成式编辑器,证明必须拆开编辑区域与保留区域。
重置到真值上一状态的诊断显著缓解后续误差,支持自回滚中错误会累积,而不只是后面的指令更难。
可重放配方、逐轮目标和真实发布的数据为独立复查提供基础,且附录明确给出了失败和评分有定义的次数。
反方 · 哪些结论还不够
代理比较仅55条416次编辑,非全部457条;运行工具、时间预算及模型调用次数不统一,不能解释成单一模型能力的公平排序。
IF是几何指标,重贴图没有定义;只统计已完成且有效的轮次,不是全部计划操作成功率。
资产已分部件且目标图像可见,固定四视角与灯光没有检验UV接缝、去光照、物理材质一致性和生产拓扑。
综合判断
这是一套有用的连续资产编辑评测与数据引擎,证据支持代码式局部修改更易保住其余部分;尚不足以宣称代理已能替代高质量建模或材质制作。
我会先做的验证
建议实验(尚未执行):在完整457链固定工具与预算,按全体计划轮次计入失败,同时报告有效IF分母;增加无预分割资产、统一UV保持检查、接缝误差、PBR通道与多光照渲染,并用新的独立资产检验排名。