最初发表(日文)于former.workstyle.tech.
你是否曾因实施基于模拟的UI而被一波焦虑所打击?
你可能会想,“我尽量忠实地建造它,但它真的符合设计吗?” 作为执行者,很容易忽略在编码过程中作出的小妥协或模型中遗漏的细节。
这是自我审查自己代码的固有限制.
当人类一起工作时,让多人参与其中会增加视角的数量.
我在本篇文章中介绍的方法是通过运行多个人工智能代理来复制它。
通过由几个独立的审查代理人来评价你的执行如何忠实地与模型相匹配(在布局结构,定位和组件映射方面),你就可以用多角的验证来加强单一的审查.
为什么"一"被原执行者自我审查还不够有结构性弱点:确认比亚斯——由于你已经拥有"你是如何建造的"的记忆,你倾向于以证明自己执行有正当理由的方式来看待模型.
复制监督 - 如果在实施过程中错过了模型中的某个具体要素,那么在审查期间,由于同样的原因,你很可能再次错过。
固定视角——独自一人会导致认知偏差;例如,你可能过于关注"颜色是否正确",而忽略"布局的等级结构".
即使你要求一个AI代理"比较模拟和执行",你也会遇到类似的问题,尽管程度较小.
单一的回答往往倾向于偏向一个视角;如果你要求它同时看太多的事情,那么每个单项检查就会变得肤浅.
解决之道是将观点分出来,分配给多个代理人.
与其要求一名特工观察一切,不如指派每个特工一个专门的角色,让他们独立运作.
工作流程:通过分割视角平行审查
1.
定义"轴"审查第一,分解模拟忠诚评价标准.
对于UI的设计坚持性,您可以这样划分它:布局结构——总体网格,列配置,和分区是否匹配? (例如:骨架:由右柱再垂直分出的一个二列布局).
要素设置和等级——哪些要素被置于哪个领域,以什么顺序/取消?
构件映射——模拟图(滑动图、图表、预览、清单等)的所有部件是否都在执行中没有过剩或不足?
视觉通音—— 视觉品质,如颜色,间距,和打字.
关键是明确分离出这些轴.
由于每个特工都只关注其指定的轴线,因此可以进行深潜.
2.
向每个轴心国派遣独立代理人,为每个轴心国发射一个专门审查代理人。
尽管你向每个人提供同样的材料——模拟(图像或规格)和执行(相关组件代码或实际渲染的屏幕),但指示(瞬间)必须专门适用于指定的轴.
例如,对于布局结构代理,您可以指示:"忽略颜色和文字.
只比较模拟和执行之间的区域结构划分,并列出任何差异".
这迫使特工严格关注骨架,而不会被其他细节所分心.
关键是你必须独立管理特工 如果他们能看到对方的结论,就会受到对方的影响,挫败了拥有独立观点的目的.
这是人类代码评论中使用的同样逻辑:先写下你自己的评论,然后再看别人说的话.
3.
核对和综合结果A人(或融合代理人),然后核对每个代理人提供的反馈。
你应该寻找三种主要的发现: 多个代理人独立报告的调查结果