‹ 首页

eval-run

@fr-e-d · 收录于 昨天 · 上游提交 昨天

Evaluate any output file against a structured evals.yaml assertions file and produce a score report with per-assertion pass/fail results. Activate when the Discovery Agent runs the Skill Optimize protocol to measure output quality or detect regressions after skill instruction changes.

适合你,如果需要在修改指令后自动检测输出是否达标

/ 通过 npx 安装 校验哈希
npx oh-my-skill add fr-e-d/gaai-framework/eval-run
/ 通过 bash 安装
curl -fsSL https://oh-my-skill.com/install.sh | bash -s -- fr-e-d/gaai-framework/eval-run
/ 已经装过?验证本机副本,不用重装
npx oh-my-skill verify fr-e-d/gaai-framework/eval-run
安装目标可用 --agent / --scope 或 --to 明确指定;省略时只会在唯一已存在的 agent 目录上自动选择,零命中或多命中会停止并提示。content_hash 缺失或不一致均拒装。
155GitHub stars
~1.5K最小装载
~3.3K含声明引用
~3.3K文本包总量
索引托管

怎么用

商店整理自技能原文 · 版本 2668387 · 表述以原文为准
它做什么

装上后,Claude 能根据你的 evals.yaml 断言文件,对任意输出文件执行代码检查或 LLM 评判,并生成每项断言通过/失败的结构化评分报告。

什么时候触发

当你提供输出文件路径和 evals.yaml 断言文件时触发。常用于量化评估技能输出质量或检测修改后的性能变化。

装好后可以这样说
它会运行所有断言,返回通过/失败结果。
需在 evals.yaml 中定义字数断言。

评论

登录即可评论;带「已验证安装」的,是发布者名下有本店的安装或持有记录。