Install
openclaw skills install @thcjp/model-routing-tool-free模型路由工具(免费版)为个人开发者包含三层模型路由指南,从最便宜的模型起步,仅在必要时升级,帮助降低API成本。核心能力:. 适用于需要model routing tool相关能力的开发场景,提供结构化的工作流程和配置指引. 该工具经过深度差异化处理,针对用户反馈和使用痛点进行了优化改进,提升了实用性和可操作性.
openclaw skills install @thcjp/model-routing-tool-free核心功能: 本技能提供结构化的工作流程和配置指引等能力。
模型路由工具(免费版)为个人开发者提供三层模型路由指南。核心原则是:从最便宜的模型起步,仅在必要时升级。 错误的模型选择要么浪费金钱,要么浪费时间——Flash用于简单任务,Standard用于常规工作,Plus / 32B用于复杂决策. 当你在请求中提及 模型路由、成本优化、子Agent分发、定时任务模型选择 等关键词时,本工具会自动激活,根据任务复杂度推荐合适的模型层级. 本版本聚焦三层路由决策与个人使用场景。如需成本分析仪表盘、批量路由、自定义规则与监控告警,请升级至 PRO 版本.
| 能力 | 说明 |
|---|---|
| 三层路由 | Flash → Standard → Plus / 32B 决策框架 |
| 黄金规则 | 30秒人类思考阈值决定是否升级 |
| 决策树 | 快速判断应使用哪一层 |
| 参考卡 | 可打印的速查卡 |
| 子Agent路由 | 子Agent任务分发模型选择 |
| 定时任务路由 | cron任务默认使用Flash |
技术实现要点:核心能力基于input_params参数与output_format配置实现,支持创建/查询/修改/删除等操作模式,通过config_options进行运行时配置. |
用input_params参数进行配置.
处理: 解析核心功能执行的输入参数,完成核心逻辑,返回结构化响应. 输出: 返回核心功能执行的响应数据,包含状态码、结果和日志.
input_params参数,支持创建/查询/导出操作用config_options参数进行配置.
处理: 解析参数配置与调用的输入参数,完成核心逻辑,返回结构化响应. 输出: 返回参数配置与调用的响应数据,包含状态码、结果和日志.
config_options参数,支持修改/重置/导入操作用output_format参数进行配置.
处理: 解析结果处理与输出的输入参数,完成核心逻辑,返回结构化响应. 输出: 返回结果处理与输出的响应数据,包含状态码、结果和日志.
output_format参数,支持导出/保存/转换操作
能力覆盖范围:本skill的核心能力覆盖以下场景关键词:个人开发者的三层、模型路由指南、从最便宜模型起步、按需升级降低、API、模型路由工具、免费版、为个人开发者提供、三层模型路由指南、从最便宜的模型起、仅在必要时升级、帮助降低、快速决策树与参考、基础子、与定时任务路由等。这些关键词对应description中声明的使用场景,均已在上述能力点中提供对应的操作支持.用户希望日常对话尽量用便宜模型,降低成本.
用户: 今天天气怎么样?
工具: 💚 FLASH — 简单事实查询,使用Flash
# ...
用户: 帮我写一个REST API端点
工具: 💛 STANDARD — 代码生成,使用Standard
# ...
用户: 设计一个多租户的数据库schema
工具: ❤️ PLUS / 32B — 架构决策,使用Plus
用户有多个子Agent各司其职,希望按任务复杂度分发模型.
// 例行监控 — 用Flash
sessions_spawn(task="检查备份状态", model="GLM-4.5-Flash")
// ...
// 标准代码工作 — 用Standard
sessions_spawn(task="构建REST API端点", model="GLM-4.7")
// ...
// 架构决策 — 用Plus
sessions_spawn(task="设计多租户数据库schema", model="GLM-4-Plus")
用户配置定时任务,希望默认用最便宜的模型.
{
"payload": {
"kind": "agentTurn",
"model": "GLM-4.5-Flash"
}
}
定时任务默认用Flash,除非任务确实需要推理能力.
以下场景模型路由工具(免费版)不适合处理:
需要AI模型调用、智能对话、Agent编排、LLM应用时使用。不适用于非本工具能力范围的需求.
如果一个人类需要超过30秒的专注思考,从Flash升级到Standard. 如果任务涉及架构、复杂权衡或深度推理,升级到Plus / 32B.
| 层级 | 示例模型 | 用途 |
|---|---|---|
| Flash | GLM-4.5-Flash, GLM-4.7-Flash | 最快最便宜 |
| Standard | GLM-4.6, GLM-4.7 | 强推理与代码 |
| Plus / 32B | GLM-4-Plus, GLM-4-32B-128K | 重推理与架构 |
是问候、查询、状态检查或1-2句回答?
是 → FLASH
否 ↓
# ...
是代码、分析、规划、写作或多步骤?
是 → STANDARD
否 ↓
# ...
是架构、深度推理或关键决策?
是 → PLUS / 32B
否 → 默认STANDARD,卡住再升级
响应解析: 完成完成后,查看输出响应确认任务状态。成功时输出包含解析摘要和响应数据;失败时根据错误信息排查问题,查阅错误解析章节获取恢复步骤.
Flash禁止做的事:
代码与技术:
分析与规划:
写作与内容:
大多数真实用户对话属于这一层.
架构与设计:
深度分析:
战略与判断:
原则:START CHEAP → SCALE ONLY WHEN NEEDED
# ...
默认用Flash → 卡住或质量不足 → 升级Standard → 仍不足 → 升级Plus
判断升级的关键问题:一个人类需要多少秒专注思考来回答这个任务?
2分钟或涉及架构:Plus / 32B
定时任务通常不需要推理,默认用Flash可大幅降低成本。仅当任务确实需要推理时才升级.
// 简单监控任务
sessions_spawn(task="检查服务健康", model="GLM-4.5-Flash")
// ...
// 标准开发任务
sessions_spawn(task="实现用户认证模块", model="GLM-4.7")
// ...
// 复杂架构任务
sessions_spawn(task="设计微服务拆分方案", model="GLM-4-Plus")
┌─────────────────────────────────────────┐
│ 智能模型路由(免费版) │
│ Flash → Standard → Plus / 32B │
├─────────────────────────────────────────┤
│ 💚 FLASH(最便宜) │
│ • 问候、状态检查、快速查询 │
│ • 事实问答、提醒 │
│ • 简单文件操作、1-2句回答 │
├─────────────────────────────────────────┤
│ 💛 STANDARD(主力) │
│ • 代码>10行、调试 │
│ • 分析、对比、规划 │
│ • 报告、长文写作 │
├─────────────────────────────────────────┤
│ ❤️ PLUS / 32B(复杂) │
│ • 架构决策 │
│ • 复杂调试、多文件重构 │
│ • 战略规划、深度研究 │
├─────────────────────────────────────────┤
│ 💡 规则:人类>30秒思考 → 升级 │
│ 💰 从便宜开始 → 按需升级 │
└─────────────────────────────────────────┘
免费版提供三层路由决策框架,示例使用GLM系列模型(Flash/Standard/Plus/32B)。实际可用模型取决于你的API供应商,路由原则通用.
参考"30秒思考阈值":人类需要<30秒思考用Flash,30秒-2分钟用Standard,>2分钟或涉及架构用Plus / 32B。也可参考决策树与参考卡.
免费版提供路由决策,不提供成本分析仪表盘。如需成本追踪、预算告警与优化报告,请使用PRO版.
| 维度 | 免费版 | PRO版 |
|---|---|---|
| 路由决策 | 三层决策树 | 三层+自定义规则 |
| 成本分析 | 不支持 | 仪表盘与告警 |
| 批量路由 | 不支持 | 批量任务分发 |
| 自定义规则 | 不支持 | 团队规则与策略 |
| 监控 | 不支持 | 实时监控与告警 |
| 支持 | 社区支持 | 优先支持 |
模型名称会随版本更新,但三层路由原则(便宜→标准→复杂)通用。建议定期对照你的API供应商文档更新具体模型名,决策框架不变.
| 依赖项 | 类型 | 是否必需 | 获取方式 |
|---|---|---|---|
| LLM API | API | 必需 | 由Agent内置LLM提供 |
| 模型API供应商 | API | 必需 | 自行选择并申请API Key |
MODEL_API_KEY).| 错误场景 | 原因 | 处理方式 |
|---|---|---|
| 配置错误 | 参数缺失或格式错误 | 检查依赖说明中的配置要求 |
| 运行时错误 | 运行环境不满足 | 确认运行环境符合依赖说明 |
| 网络错误 | 连接超时或不可达 | 执行ping命令测试网络连通性,检查防火墙和代理设置连接后执行ping命令测试网络连通性,检查防火墙和代理设置连接后重新执行命令,参考国内替代方案 |
{
"success": true,
"data": {
"result": "模型路由工具(免费版)处理结果",
"execution_time": "0.5s",
"metadata": {
"version": "1.0",
"processor": "model routing"
}
},
"execution_log": ["解析输入参数", "执行核心处理", "格式化输出结果"],
"error": null
}