Install
openclaw skills install @thcjp/model-routing-tool-freeopenclaw skills install @thcjp/model-routing-tool-free模型路由工具(免费版)为个人开发者提供三层模型路由指南。核心原则是:从最便宜的模型起步,仅在必要时升级。 错误的模型选择要么浪费金钱,要么浪费时间——Flash用于简单任务,Standard用于常规工作,Plus / 32B用于复杂决策。
当你在请求中提及 模型路由、成本优化、子Agent分发、定时任务模型选择 等关键词时,本工具会自动激活,根据任务复杂度推荐合适的模型层级。
本版本聚焦三层路由决策与个人使用场景。如需成本分析仪表盘、批量路由、自定义规则与监控告警,请升级至 PRO 版本。
| 能力 | 说明 |
|---|---|
| 三层路由 | Flash → Standard → Plus / 32B 决策框架 |
| 黄金规则 | 30秒人类思考阈值决定是否升级 |
| 决策树 | 快速判断应使用哪一层 |
| 参考卡 | 可打印的速查卡 |
| 子Agent路由 | 子Agent任务分发模型选择 |
| 定时任务路由 | cron任务默认使用Flash |
技术实现要点:核心能力基于input_params参数与output_format配置实现,支持创建/查询/修改/删除等操作模式,通过config_options进行运行时配置。 |
用input_params参数进行配置。
输入: 用户提供核心功能执行所需的指令和必要参数。 处理: 按照skill规范执行核心功能执行操作,遵循单一意图原则。 输出: 返回核心功能执行的执行结果,包含操作状态和输出数据。
input_params参数,支持创建/查询/导出操作用config_options参数进行配置。
输入: 用户提供参数配置与调用所需的指令和必要参数。 处理: 按照skill规范执行参数配置与调用操作,遵循单一意图原则。 输出: 返回参数配置与调用的执行结果,包含操作状态和输出数据。
config_options参数,支持修改/重置/导入操作用output_format参数进行配置。
输入: 用户提供结果处理与输出所需的指令和必要参数。 处理: 按照skill规范执行结果处理与输出操作,遵循单一意图原则。 输出: 返回结果处理与输出的执行结果,包含操作状态和输出数据。
output_format参数,支持导出/保存/转换操作
能力覆盖范围:本skill的核心能力覆盖以下场景关键词:个人开发者的三层、模型路由指南、从最便宜模型起步、按需升级降低、API、模型路由工具、免费版、为个人开发者提供、三层模型路由指南、从最便宜的模型起、仅在必要时升级、帮助降低、快速决策树与参考、基础子、与定时任务路由等。这些关键词对应description中声明的使用场景,均已在上述能力点中提供对应的操作支持。用户希望日常对话尽量用便宜模型,降低成本。
用户: 今天天气怎么样?
工具: 💚 FLASH — 简单事实查询,使用Flash
用户: 帮我写一个REST API端点
工具: 💛 STANDARD — 代码生成,使用Standard
用户: 设计一个多租户的数据库schema
工具: ❤️ PLUS / 32B — 架构决策,使用Plus
用户有多个子Agent各司其职,希望按任务复杂度分发模型。
// 例行监控 — 用Flash
sessions_spawn(task="检查备份状态", model="GLM-4.5-Flash")
// 标准代码工作 — 用Standard
sessions_spawn(task="构建REST API端点", model="GLM-4.7")
// 架构决策 — 用Plus
sessions_spawn(task="设计多租户数据库schema", model="GLM-4-Plus")
用户配置定时任务,希望默认用最便宜的模型。
{
"payload": {
"kind": "agentTurn",
"model": "GLM-4.5-Flash"
}
}
定时任务默认用Flash,除非任务确实需要推理能力。
以下场景模型路由工具(免费版)不适合处理:
需要AI模型调用、智能对话、Agent编排、LLM应用时使用。不适用于非本工具能力范围的需求。
如果一个人类需要超过30秒的专注思考,从Flash升级到Standard。 如果任务涉及架构、复杂权衡或深度推理,升级到Plus / 32B。
| 层级 | 示例模型 | 用途 |
|---|---|---|
| Flash | GLM-4.5-Flash, GLM-4.7-Flash | 最快最便宜 |
| Standard | GLM-4.6, GLM-4.7 | 强推理与代码 |
| Plus / 32B | GLM-4-Plus, GLM-4-32B-128K | 重推理与架构 |
是问候、查询、状态检查或1-2句回答?
是 → FLASH
否 ↓
是代码、分析、规划、写作或多步骤?
是 → STANDARD
否 ↓
是架构、深度推理或关键决策?
是 → PLUS / 32B
否 → 默认STANDARD,卡住再升级
结果处理: 执行完成后,查看输出结果确认操作状态。成功时输出包含处理摘要和结果数据;失败时根据错误信息排查问题,查阅错误处理章节获取恢复步骤。
Flash禁止做的事:
代码与技术:
分析与规划:
写作与内容:
大多数真实用户对话属于这一层。
架构与设计:
深度分析:
战略与判断:
原则:START CHEAP → SCALE ONLY WHEN NEEDED
默认用Flash → 卡住或质量不足 → 升级Standard → 仍不足 → 升级Plus
判断升级的关键问题:一个人类需要多少秒专注思考来回答这个任务?
2分钟或涉及架构:Plus / 32B
定时任务通常不需要推理,默认用Flash可大幅降低成本。仅当任务确实需要推理时才升级。
// 简单监控任务
sessions_spawn(task="检查服务健康", model="GLM-4.5-Flash")
// 标准开发任务
sessions_spawn(task="实现用户认证模块", model="GLM-4.7")
// 复杂架构任务
sessions_spawn(task="设计微服务拆分方案", model="GLM-4-Plus")
┌─────────────────────────────────────────┐
│ 智能模型路由(免费版) │
│ Flash → Standard → Plus / 32B │
├─────────────────────────────────────────┤
│ 💚 FLASH(最便宜) │
│ • 问候、状态检查、快速查询 │
│ • 事实问答、提醒 │
│ • 简单文件操作、1-2句回答 │
├─────────────────────────────────────────┤
│ 💛 STANDARD(主力) │
│ • 代码>10行、调试 │
│ • 分析、对比、规划 │
│ • 报告、长文写作 │
├─────────────────────────────────────────┤
│ ❤️ PLUS / 32B(复杂) │
│ • 架构决策 │
│ • 复杂调试、多文件重构 │
│ • 战略规划、深度研究 │
├─────────────────────────────────────────┤
│ 💡 规则:人类>30秒思考 → 升级 │
│ 💰 从便宜开始 → 按需升级 │
└─────────────────────────────────────────┘
免费版提供三层路由决策框架,示例使用GLM系列模型(Flash/Standard/Plus/32B)。实际可用模型取决于你的API供应商,路由原则通用。
参考"30秒思考阈值":人类需要<30秒思考用Flash,30秒-2分钟用Standard,>2分钟或涉及架构用Plus / 32B。也可参考决策树与参考卡。
免费版提供路由决策,不提供成本分析仪表盘。如需成本追踪、预算告警与优化报告,请使用PRO版。
| 维度 | 免费版 | PRO版 |
|---|---|---|
| 路由决策 | 三层决策树 | 三层+自定义规则 |
| 成本分析 | 不支持 | 仪表盘与告警 |
| 批量路由 | 不支持 | 批量任务分发 |
| 自定义规则 | 不支持 | 团队规则与策略 |
| 监控 | 不支持 | 实时监控与告警 |
| 支持 | 社区支持 | 优先支持 |
模型名称会随版本更新,但三层路由原则(便宜→标准→复杂)通用。建议定期对照你的API供应商文档更新具体模型名,决策框架不变。
| 依赖项 | 类型 | 是否必需 | 获取方式 |
|---|---|---|---|
| LLM API | API | 必需 | 由Agent内置LLM提供 |
| 模型API供应商 | API | 必需 | 自行选择并申请API Key |
MODEL_API_KEY)。| 错误场景 | 原因 | 处理方式 |
|---|---|---|
| 配置错误 | 参数缺失或格式错误 | 检查依赖说明中的配置要求 |
| 运行时错误 | 运行环境不满足 | 确认运行环境符合依赖说明 |
| 网络错误 | 连接超时或不可达 | 执行ping命令测试网络连通性,检查防火墙和代理设置连接后执行ping命令测试网络连通性,检查防火墙和代理设置连接后重新执行命令,参考国内替代方案 |