Install
openclaw skills install @qq435912743/self-eval自我评估 / rubric 评分器(元认知闭环核心)。让 agent 对自己的输出做结构化、可复现的评分,而非凭感觉"我觉得不错"。提供多维度评分表(相关性/完整性/结构/准确性/可执行性)、自动 rubric 生成、可选参考答案重叠比对,输出打分 JSON + 改进建议。当用户需要"评估一下这段输出""给自己的回答打分""做个 rubric 评分""self-evaluation""检查质量"时调用。
openclaw skills install @qq435912743/self-eval让 agent 对自己的输出做结构化、可复现的评分,把"质量"从主观感受变成可度量的维度分数。这是元认知闭环的核心一环:能评估自己,才能改进自己。
用 scripts/grade.py 对一段输出做评分:
# 自带默认 5 维 rubric,直接评
python scripts/grade.py --task "写一封英文道歉邮件" --output answer.md --out report.json
# 指定自定义 rubric(JSON)
python scripts/grade.py --task "..." --output out.md --rubric rubric.json --out report.json
# 有参考答案时,加入重叠比对(更准确)
python scripts/grade.py --task "..." --output mine.md --reference gold.md --out report.json
rubric.json 结构:
{
"criteria": [
{"name": "相关性", "weight": 0.25, "keywords": ["道歉", "原因"], "min_len": 80},
{"name": "完整性", "weight": 0.25, "keywords": ["补偿", "联系方式"]}
]
}
python scripts/learner.py record . --capability "自我评估" [--fail --error <类型> --note <说明>]
python scripts/learner.py insight .
python scripts/learner.py reflect .
prefer 记录,未来自动加权