Install
openclaw skills install @qq435912743/meta-value-alignment由 model-distillation 从教师技能 value-alignment 蒸馏并增强的超越型元技能, 在教师能力之上叠加自验证、自我反思、super-agent 编排与持续自进化闭环,逐步超越教师。
openclaw skills install @qq435912743/meta-value-alignment由
model-distillation从教师技能 value-alignment 蒸馏并增强生成。 生成时间:2026-07-23 03:56:08 | 蒸馏机制:跨模型蒸馏(见 meta-evolver 北极星策略)
reason-verify 做命题一致性/事实锚定校验,reliability<0.8 即回退重做。self-reflection-loop,沉淀失败模式到 learner。| 维度 | 教师(value-alignment) | 学生(meta-value-alignment) |
|---|---|---|
| 能力来源 | 原始 SKILL.md(1960 字符) | 蒸馏提取 + 元进化增强 |
| 工作流 | 0 步显性流程 | 同流程 + 自验证钩子 + 反思步 |
| 工具脚本 | learner.py, valuealign.py | 继承 + reason-verify/self-reflection 钩子 |
| 失败防护 | 已识别 1 处 | 显式 limits + 对抗验证 |
| 自进化 | 视技能而定 | 强制注入 learner,纳入 meta-evolver 闭环 |
| 集成 | 单点 | 接入 super-agent 感知→规划→执行→自验证→反思→记忆闭环 |
直接调用本技能完成「value-alignment」领域的任务;本技能在教师能力之上叠加自验证与反思,输出更可靠、可追溯。
本技能内置通用学习模块 scripts/learner.py。每次评估后自动复盘、积累经验。
learned_patterns.json 记录:操作总数、各原则命中频次、越界类型、用户偏好、改进建议。
# 记录一次评估(--capability 填本次主维度,如「harmless」「honest」)
python scripts/learner.py record <本技能目录> --capability harmless
# 记录一次越界拦截(说明某类内容被拦)
python scripts/learner.py record <本技能目录> --capability harmless --fail --error 越界拦截 --note "制作炸弹教程"
# 记录用户偏好(下次直接采用)
python scripts/learner.py prefer <本技能目录> --key 发布阈值 --val 0.6
# 查看累计洞察(高频越界类型 / 反复失败)
python scripts/learner.py insight <本技能目录>
# 自动复盘(错误≥3次 或 操作≥10次 时给出改进建议)
python scripts/learner.py reflect <本技能目录>
learned_patterns.json,下次调用直接采用。越用越懂你:第一次评估是通用初筛,第十次已沉淀为你专属的"价值守门清单"。