Install
openclaw skills install @graysilver/llm-workflow-diagnoserUse this skill whenever a user wants to evaluate whether an existing offline / reusable workflow is worth converting into an LLM-driven workflow. Triggers on phrases like "这个流程要不要交给大模型做", "我有个跑得很熟的脚本流程, 能不能用 LLM 改造", "我想把这套离线流程升级成 LLM 工作流", "判断一下现在流程合不合适交给大模型", "LLM 改造 ROI 诊断", "评估一下大模型介入的成本收益". Always trigger when the user describes a reusable workflow and wants a go / partial / no-go decision plus ROI reasoning, even if they don't ask for the words "diagnose" or "ROI" explicitly. Do not trigger for one-off prompts that are not a reusable workflow, and do not trigger for general writing / coding tasks.
openclaw skills install @graysilver/llm-workflow-diagnoser把一个已有的「离线 / 可复用流程」拆开,看它是否值得交给 LLM,输出全量改造 / 部分改造 / 不适合的结论 + ROI 分数 + 改造难度评级 + 落地 MVP 路线图。
整套流程由 LLM 主判,叠加一份 8 题追问清单做骨架;不允许用纯规则打分硬给结论。
触发:
不触发:
clean-code-skill / mubai-writer-v2 / technical-report-writer)。如果用户描述里没有提到「流程名 / 触发频率 / 输出形式」中的任意两项,先问一句:
你这次想诊断的「离线流程」大致叫什么名字?多久跑一次?输出长什么样?
不准默认脑补流程主题。不准直接进入追问。
按 references/question_bank.md 的 8 维度出第一组问题,每轮给 3-4 个题,用户可一次答完。
LLM 在收到回答后可补问 0-3 题,针对信息缺口。
退出准则(明确写进追问流程):
任意一项不满足 → 继续追问;满足 → 进入诊断。
LLM 综合判断改造建议 + 5 维度难度评级:
按下列标准给最终建议:
| 建议 | 触发条件 |
|---|---|
| 全量改造 | 5 维度难度均值 ≤ 4 + 没有命中任何「不适合」硬护栏 + ROI 分数 ≥ 7 |
| 部分改造 | 命中 1-2 个硬护栏,或难度均值 5-7,或 ROI 分数 4-6 |
| 不适合 | 命中 ≥ 3 个硬护栏,或 ROI 分数 ≤ 3,或难度均值 ≥ 8 |
按 references/report_template.md 的固定结构,把六个章节原文贴在对话回复里:
章节标题必须完全一致。不要写 .md 文件、不要重命名、不要拼接、不要保存到磁盘。
报告"LLM 介入边界"章节必须按四个分类组织:
| 分类 | 含义 |
|---|---|
| 硬护栏护住 | 监管 / 合规 / 实时 / 高精度场景,LLM 不能介入;保留原人工或规则路径 |
| 仅部分场景适用 | LLM 可生成候选 / 提供多版本,但必须人工裁决 |
| 全量适用 | 决策 / 执行 / 润色都可交给 LLM,必要时保留少量校验 |
| AI 可护住 | LLM 能补充的具体能力(生成 / 翻译 / 命名 / 检索 / 推理 / 提炼 / 数据能力边界等) |
ROI 分数填在"诊断说明"章节,必须是 0-10 整数或一位小数:
ROI 分数只允许写在"诊断说明 - ROI 分数"那一行,其他章节不要再写一遍 ROI。
报告"改造难度评级"章节必须使用 Markdown 表格,列固定为:
维度 | 难度值(xx/10,10为满分) | 解释
5 个维度固定:
| 维度 | 难度 0 | 难度 10 |
|---|---|---|
| 输入多样性 | 高度结构化 | 自由文本 / 多模态 |
| 输出一致性要求 | 允许多版本 | 严格统一 |
| 容错率 | 高容错 | 零容错 |
| 决策密度 | 机械转换 | 多步推理 / 创造性 |
| 可验证性 | 指标完整 | 难以量化 |
8 个必问维度:
每次诊断都在对话里原文输出;同主题多次诊断时,新诊断开头用一行"相比上轮变化"做对比,再进入六章节。
按需加载,不要预先全部读:
| 文件 | 用途 | 何时读 |
|---|---|---|
references/question_bank.md | 8 维度必问清单 + 退出准则 | 追问阶段必读 |
references/scoring_rubric.md | 5 维度难度评级描述 + 改造建议触发表 | 诊断阶段读 |
references/report_template.md | 报告六章节固定结构(原文 Chat 输出) | 出报告时必读 |
references/examples/full_replace.md | "全量改造"样例 | 写报告前对照风格 |
references/examples/partial_replace.md | "部分改造"样例 | 同上 |
references/examples/not_suitable.md | "不适合"样例 | 同上 |
scripts/diagnose.py | 打印追问清单 + 报告骨架(辅助) | 调试或人工查看时用 |
入口澄清 → 8 维度追问最多 6 轮 → LLM 主判给建议 + 5 维度难度评级 + ROI 分数 → 按固定结构原文贴在 Chat 输出,不写 .md。