为 OpenClaw 提供免费模型智能路由服务,支持本地代理、自动配置、自动轮询、故障切换和配置零侵入。在需要设置免费模型路由、配置 Provider、切换模型或诊断模型可用性问题时使用。
编程
模型路由工具(免费版)
试用模型路由工具(免费版)为个人开发者包含三层模型路由指南,从最便宜的模型起步,仅在必要时升级,帮助降低API成本。核心能力:. 适用于需要model routing tool相关能力的开发场景,提供结构化的工作流程和配置指引. 该工具经过深度差异化处理,针对用户反馈和使用痛点进行了优化改进,提升了实用性和可操作性.
它能做什么
模型路由工具(免费版)为个人开发者包含三层模型路由指南,从最便宜的模型起步,仅在必要时升级,帮助降低API成本。核心能力:. 适用于需要model routing tool相关能力的开发场景,提供结构化的工作流程和配置指引. 该工具经过深度差异化处理,针对用户反馈和使用痛点进行了优化改进,提升了实用性和可操作性.
技能文档
核心功能: 本技能提供结构化的工作流程和配置指引等能力。
模型路由工具(免费版)
概述
模型路由工具(免费版)为个人开发者提供三层模型路由指南。核心原则是:从最便宜的模型起步,仅在必要时升级。 错误的模型选择要么浪费金钱,要么浪费时间——Flash用于简单任务,Standard用于常规工作,Plus / 32B用于复杂决策. 当你在请求中提及 模型路由、成本优化、子Agent分发、定时任务模型选择 等关键词时,本工具会自动激活,根据任务复杂度推荐合适的模型层级. 本版本聚焦三层路由决策与个人使用场景。如需成本分析仪表盘、批量路由、自定义规则与监控告警,请升级至 PRO 版本.
核心能力
| 能力 | 说明 |
|---|---|
| 三层路由 | Flash → Standard → Plus / 32B 决策框架 |
| 黄金规则 | 30秒人类思考阈值决定是否升级 |
| 决策树 | 快速判断应使用哪一层 |
| 参考卡 | 可打印的速查卡 |
| 子Agent路由 | 子Agent任务分发模型选择 |
| 定时任务路由 | cron任务默认使用Flash |
技术实现要点:核心能力基于input_params参数与output_format配置实现,支持创建/查询/修改/删除等操作模式,通过config_options进行运行时配置. |
核心功能执行
用input_params参数进行配置.
处理: 解析核心功能执行的输入参数,完成核心逻辑,返回结构化响应. 输出: 返回核心功能执行的响应数据,包含状态码、结果和日志.
- 执行此能力时使用
input_params参数,支持创建/查询/导出操作
参数配置与调用
用config_options参数进行配置.
处理: 解析参数配置与调用的输入参数,完成核心逻辑,返回结构化响应. 输出: 返回参数配置与调用的响应数据,包含状态码、结果和日志.
- 执行此能力时使用
config_options参数,支持修改/重置/导入操作
结果处理与输出
用output_format参数进行配置.
处理: 解析结果处理与输出的输入参数,完成核心逻辑,返回结构化响应. 输出: 返回结果处理与输出的响应数据,包含状态码、结果和日志.
- 执行此能力时使用
output_format参数,支持导出/保存/转换操作 能力覆盖范围:本skill的核心能力覆盖以下场景关键词:个人开发者的三层、模型路由指南、从最便宜模型起步、按需升级降低、API、模型路由工具、免费版、为个人开发者提供、三层模型路由指南、从最便宜的模型起、仅在必要时升级、帮助降低、快速决策树与参考、基础子、与定时任务路由等。这些关键词对应description中声明的使用场景,均已在上述能力点中提供对应的操作支持.
使用场景
场景一:个人项目日常对话路由
用户希望日常对话尽量用便宜模型,降低成本.
用户: 今天天气怎么样?
工具: 💚 FLASH — 简单事实查询,使用Flash
# ...
用户: 帮我写一个REST API端点
工具: 💛 STANDARD — 代码生成,使用Standard
# ...
用户: 设计一个多租户的数据库schema
工具: ❤️ PLUS / 32B — 架构决策,使用Plus
场景二:子Agent任务分发
用户有多个子Agent各司其职,希望按任务复杂度分发模型.
// 例行监控 — 用Flash
sessions_spawn(task="检查备份状态", model="GLM-4.5-Flash")
// ...
// 标准代码工作 — 用Standard
sessions_spawn(task="构建REST API端点", model="GLM-4.7")
// ...
// 架构决策 — 用Plus
sessions_spawn(task="设计多租户数据库schema", model="GLM-4-Plus")
场景三:定时任务模型选择
用户配置定时任务,希望默认用最便宜的模型.
{
"payload": {
"kind": "agentTurn",
"model": "GLM-4.5-Flash"
}
}
定时任务默认用Flash,除非任务确实需要推理能力.
不适用场景
以下场景模型路由工具(免费版)不适合处理:
- 需要100%确定性的关键决策
- 医疗诊断
- 法律判决
触发条件
需要AI模型调用、智能对话、Agent编排、LLM应用时使用。不适用于非本工具能力范围的需求.
快速开始
- 阅读## 核心能力章节了解skill功能
- 按## 依赖说明配置环境
- 执行所需能力对应的命令
- 参考## 错误处理章节处理异常
- 查看## FAQ解答常见疑问
1. 掌握黄金规则
如果一个人类需要超过30秒的专注思考,从Flash升级到Standard. 如果任务涉及架构、复杂权衡或深度推理,升级到Plus / 32B.
2. 模型层级速览
| 层级 | 示例模型 | 用途 |
|---|---|---|
| Flash | GLM-4.5-Flash, GLM-4.7-Flash | 最快最便宜 |
| Standard | GLM-4.6, GLM-4.7 | 强推理与代码 |
| Plus / 32B | GLM-4-Plus, GLM-4-32B-128K | 重推理与架构 |
3. 使用决策树
是问候、查询、状态检查或1-2句回答?
是 → FLASH
否 ↓
# ...
是代码、分析、规划、写作或多步骤?
是 → STANDARD
否 ↓
# ...
是架构、深度推理或关键决策?
是 → PLUS / 32B
否 → 默认STANDARD,卡住再升级
响应解析: 完成完成后,查看输出响应确认任务状态。成功时输出包含解析摘要和响应数据;失败时根据错误信息排查问题,查阅错误解析章节获取恢复步骤.
示例
适用场景
- 事实问答:"什么是X"、"谁是Y"、"什么时候Z"
- 快速查询:定义、单位换算、短翻译
- 状态检查:监控、文件读取、会话状态
- 心跳:周期性检查、OK响应
- 记忆与提醒
- 闲聊:问候、确认
- 简单文件操作:读取、列出、基础写入
- 一句话任务:1-2句能回答的任何事
- 定时任务(默认用Flash)
Flash禁止做的事:
- 写超过10行代码
- 创建对比表格
- 写超过3段
- 多步骤分析
- 写报告或提案
Standard适用场景(主力)
代码与技术:
- 代码生成:函数、脚本、功能
- 调试:常规bug排查
- 代码审查:PR、重构
- 文档:README、注释、指南
分析与规划:
- 对比与评估
- 规划:路线图、任务拆解
- 研究综合
- 多步骤推理
写作与内容:
- 长文写作(>3段)
- 长文档摘要
- 结构化输出:表格、大纲
大多数真实用户对话属于这一层.
Plus / 32B适用场景(复杂推理)
架构与设计:
- 系统与服务架构
- 数据库schema设计
- 分布式或多租户系统
- 跨多文件的大型重构
深度分析:
- 复杂调试(竞态条件、隐蔽bug)
- 安全审查
- 性能优化策略
- 根因分析
战略与判断:
- 战略规划
- 细微判断与模糊性
- 深度或多源研究
- 关键生产决策
优秀实践
1. 从便宜开始,按需升级
原则:START CHEAP → SCALE ONLY WHEN NEEDED
# ...
默认用Flash → 卡住或质量不足 → 升级Standard → 仍不足 → 升级Plus
2. 30秒思考阈值
判断升级的关键问题:一个人类需要多少秒专注思考来回答这个任务?
- <30秒:Flash足够
- 30秒-2分钟:Standard
-
2分钟或涉及架构:Plus / 32B
3. 定时任务默认Flash
定时任务通常不需要推理,默认用Flash可大幅降低成本。仅当任务确实需要推理时才升级.
4. 子Agent分发按任务复杂度
// 简单监控任务
sessions_spawn(task="检查服务健康", model="GLM-4.5-Flash")
// ...
// 标准开发任务
sessions_spawn(task="实现用户认证模块", model="GLM-4.7")
// ...
// 复杂架构任务
sessions_spawn(task="设计微服务拆分方案", model="GLM-4-Plus")
5. 可打印参考卡
┌─────────────────────────────────────────┐
│ 智能模型路由(免费版) │
│ Flash → Standard → Plus / 32B │
├─────────────────────────────────────────┤
│ 💚 FLASH(最便宜) │
│ • 问候、状态检查、快速查询 │
│ • 事实问答、提醒 │
│ • 简单文件操作、1-2句回答 │
├─────────────────────────────────────────┤
│ 💛 STANDARD(主力) │
│ • 代码>10行、调试 │
│ • 分析、对比、规划 │
│ • 报告、长文写作 │
├─────────────────────────────────────────┤
│ ❤️ PLUS / 32B(复杂) │
│ • 架构决策 │
│ • 复杂调试、多文件重构 │
│ • 战略规划、深度研究 │
├─────────────────────────────────────────┤
│ 💡 规则:人类>30秒思考 → 升级 │
│ 💰 从便宜开始 → 按需升级 │
└─────────────────────────────────────────┘
常见问题
Q1:免费版支持哪些模型?
免费版提供三层路由决策框架,示例使用GLM系列模型(Flash/Standard/Plus/32B)。实际可用模型取决于你的API供应商,路由原则通用.
Q2:如何判断任务需要哪一层?
参考"30秒思考阈值":人类需要<30秒思考用Flash,30秒-2分钟用Standard,>2分钟或涉及架构用Plus / 32B。也可参考决策树与参考卡.
Q3:免费版能否分析成本?
免费版提供路由决策,不提供成本分析仪表盘。如需成本追踪、预算告警与优化报告,请使用PRO版.
Q4:免费版与PRO版差异?
| 维度 | 免费版 | PRO版 |
|---|---|---|
| 路由决策 | 三层决策树 | 三层+自定义规则 |
| 成本分析 | 不支持 | 仪表盘与告警 |
| 批量路由 | 不支持 | 批量任务分发 |
| 自定义规则 | 不支持 | 团队规则与策略 |
| 监控 | 不支持 | 实时监控与告警 |
| 支持 | 社区支持 | 优先支持 |
Q5:模型名称会变化怎么办?
模型名称会随版本更新,但三层路由原则(便宜→标准→复杂)通用。建议定期对照你的API供应商文档更新具体模型名,决策框架不变.
依赖说明
运行环境
- Agent平台: 支持SKILL.md的任意AI Agent(Claude Code / Cursor / Codex / Gemini CLI等)
- 操作系统: Windows / macOS / Linux
- API供应商: 提供三层模型选择的任意LLM API供应商
依赖详情
| 依赖项 | 类型 | 是否必需 | 获取方式 |
|---|---|---|---|
| LLM API | API | 必需 | 由Agent内置LLM提供 |
| 模型API供应商 | API | 必需 | 自行选择并申请API Key |
API Key 配置
- 基础LLM由Agent平台内置提供,Skill基于Markdown指令驱动
- 实际调用模型API需要对应供应商的API Key,请按供应商文档配置环境变量(如
MODEL_API_KEY). - 建议为不同层级模型配置独立Key,便于成本追踪.
可用性分类
- 分类: MD+EXEC模式纯Markdown指令,部分功能需exec命令行执行)
- 说明: 基于Markdown的AI Skill,通过自然语言指令驱动Agent完成操作。免费版聚焦个人开发者的三层模型路由决策.
错误处理
| 错误场景 | 原因 | 处理方式 |
|---|---|---|
| 配置错误 | 参数缺失或格式错误 | 检查依赖说明中的配置要求 |
| 运行时错误 | 运行环境不满足 | 确认运行环境符合依赖说明 |
| 网络错误 | 连接超时或不可达 | 执行ping命令测试网络连通性,检查防火墙和代理设置连接后执行ping命令测试网络连通性,检查防火墙和代理设置连接后重新执行命令,参考国内替代方案 |
已知限制
- 执行效率受模型能力与网络环境影响
输出格式
{
"success": true,
"data": {
"result": "模型路由工具(免费版)处理结果",
"execution_time": "0.5s",
"metadata": {
"version": "1.0",
"processor": "model routing"
}
},
"execution_log": ["解析输入参数", "执行核心处理", "格式化输出结果"],
"error": null
}
相关技能
模型切换工具(免费版)为个人开发者包含三层Claude模型切换指南,从最便宜的Haiku起步,仅在必要时升级,帮助节省50-90%的API成本。核心能力:. 适用于需要model switching tool相关能力的开发场景,提供结构化的工作流程和配置指引. 该工具经过深度差异化处理,针对用户反馈和使用痛点进行了优化改进,提升了实用性和可操作性.
多模型成本路由中心的多模型路由策略、AI-HIVE小样与迁移验收
智能模型路由与Token成本优化顾问 / Smart LLM Router & Token Cost Optimizer. 帮助用户为不同复杂度的AI任务选择最合适的模型层级(从极致性价比到旗舰级), 通过任务复杂度评估、模型分级推荐、安全强制升级规则,在保证质量的前提下节省70-90%的Token成本。 同时提...
Rust 开发优选实践助手免费版,面向个人开发者与学习者。核心能力:,可自发提升工作效率. 适用于需要rust toolkit相关能力的开发场景,包含结构化的工作流程和可复用的模板,帮助用户快速完成任务并保持代码质量. 适用于需要rust toolkit相关能力的开发场景,包含结构化的工作流程和配置指引.
Choose RouterBase model IDs and routing strategies for chat, image, video, audio, and embeddings workloads. Use when comparing providers, selecting GPT, Clau...