社区热度榜

agent-self-evaluation

让代理在完成非平凡任务后,自评准确性、完整性、清晰度、可执行性与简洁度。

分类
商业
榜单排名
#7
GitHub Stars
219,439

它能做什么

中文摘要

「agent-self-evaluation」的原始 GitHub SKILL.md 将它定位为:Use after completing any non-trivial task.。它的核心价值是约束界面层级、组件状态、可访问性和视觉验收细节;把测试策略、回归路径和发布前验证步骤前置到 Agent 工作流。文档重点章节包括「When to Activate」「Core Concepts」「The 5 Evaluation Axes」。

为什么推荐

推荐理由

推荐它,是因为它在「商业」分类里热度靠前(GitHub Stars 219,439),同时原始文档信息密度足够高。原文列出的执行要点包括:After writing code that spans 3+ files or 50+ lines;After completing a multi-step workflow (implement → test → review)。对经常重复的任务来说,这类 Skill 能把经验沉淀到工作流前端,减少临场猜测。

什么时候用

适用场景

  • 做界面实现、组件重构、视觉验收或设计系统一致性检查
  • 建立测试闭环、回归验证、安全检查和发布前质量门
  • 提升 Agent 的规划、调试、浏览器自动化和多代理协作能力

使用前先看

主要亮点

  • 01

    可输出带证据的评分表,方便定位输出短板。

  • 02

    适合代码、文案或方案交付后的质量回看。

  • 03

    原文有效说明不足,仅能确认用于完成任务后的自评。

原始文档

原文摘录

Use after completing any non-trivial task.