它能做什么
中文摘要
「agent-self-evaluation」的原始 GitHub SKILL.md 将它定位为:Use after completing any non-trivial task.。它的核心价值是约束界面层级、组件状态、可访问性和视觉验收细节;把测试策略、回归路径和发布前验证步骤前置到 Agent 工作流。文档重点章节包括「When to Activate」「Core Concepts」「The 5 Evaluation Axes」。
为什么推荐
推荐理由
推荐它,是因为它在「商业」分类里热度靠前(GitHub Stars 219,439),同时原始文档信息密度足够高。原文列出的执行要点包括:After writing code that spans 3+ files or 50+ lines;After completing a multi-step workflow (implement → test → review)。对经常重复的任务来说,这类 Skill 能把经验沉淀到工作流前端,减少临场猜测。
什么时候用
适用场景
- 做界面实现、组件重构、视觉验收或设计系统一致性检查
- 建立测试闭环、回归验证、安全检查和发布前质量门
- 提升 Agent 的规划、调试、浏览器自动化和多代理协作能力
使用前先看
主要亮点
- 01
可输出带证据的评分表,方便定位输出短板。
- 02
适合代码、文案或方案交付后的质量回看。
- 03
原文有效说明不足,仅能确认用于完成任务后的自评。
原始文档
原文摘录
Use after completing any non-trivial task.