以 skill 自身的术语
该 skill 对视觉重要的网页任务强制执行图像先行的工作流。Agent 必须先自行生成设计图像,再编写任何代码,然后深入分析这些图像以提取字体排印、间距、按钮、颜色和布局逻辑。在 Codex 中,它默认为每个板块生成一张较大、清晰可读的图像,而不是压缩多个板块到一张图上,并且在需要板块或细节视图时会创建全新的独立图像,而不是裁剪。
它严格避免嵌套框式布局、虚假 UI 标签、细小的胶囊标签以及拥挤的 hero 区域。Hero 区域必须保持简洁,标题最多不超过 1-3 行。该 skill 强制执行充裕的间距,减少视觉杂乱,并实现与生成的参考图忠实匹配的前端,而不是偏向通用的代码化布局。
工作方式
- 01在 Codex 中创建独立的板块图像
在 Codex 内部,该 skill 为每个板块生成一张较大、清晰可读的图像,而不是将多个板块压缩到一张图版中。
- 02生成全新图像,绝不裁剪
当某个板块需要专门的视图时,该 skill 会生成一张保留相同设计语言的全新图像,而不是从之前生成的较大图像中裁剪。
- 03深入分析所有生成的图像
在实现之前,该 skill 会从每张图像中提取确切的可见文本、字体排印关系、间距逻辑、按钮细节、色彩方案、布局结构和组件样式。
- 04实现与参考图匹配的前端
代码忠实地转译所分析的设计,保留布局逻辑、间距节奏、板块顺序、字体排印氛围和组件样式,而不会偏向通用模式。