编程

模型路由工具(免费版)

试用

模型路由工具(免费版)为个人开发者包含三层模型路由指南,从最便宜的模型起步,仅在必要时升级,帮助降低API成本。核心能力:. 适用于需要model routing tool相关能力的开发场景,提供结构化的工作流程和配置指引. 该工具经过深度差异化处理,针对用户反馈和使用痛点进行了优化改进,提升了实用性和可操作性.

它能做什么

模型路由工具(免费版)为个人开发者包含三层模型路由指南,从最便宜的模型起步,仅在必要时升级,帮助降低API成本。核心能力:. 适用于需要model routing tool相关能力的开发场景,提供结构化的工作流程和配置指引. 该工具经过深度差异化处理,针对用户反馈和使用痛点进行了优化改进,提升了实用性和可操作性.

技能文档

核心功能: 本技能提供结构化的工作流程和配置指引等能力。

模型路由工具(免费版)

概述

模型路由工具(免费版)为个人开发者提供三层模型路由指南。核心原则是:从最便宜的模型起步,仅在必要时升级。 错误的模型选择要么浪费金钱,要么浪费时间——Flash用于简单任务,Standard用于常规工作,Plus / 32B用于复杂决策. 当你在请求中提及 模型路由、成本优化、子Agent分发、定时任务模型选择 等关键词时,本工具会自动激活,根据任务复杂度推荐合适的模型层级. 本版本聚焦三层路由决策与个人使用场景。如需成本分析仪表盘、批量路由、自定义规则与监控告警,请升级至 PRO 版本.

核心能力

能力说明
三层路由Flash → Standard → Plus / 32B 决策框架
黄金规则30秒人类思考阈值决定是否升级
决策树快速判断应使用哪一层
参考卡可打印的速查卡
子Agent路由子Agent任务分发模型选择
定时任务路由cron任务默认使用Flash
技术实现要点:核心能力基于input_params参数与output_format配置实现,支持创建/查询/修改/删除等操作模式,通过config_options进行运行时配置.

核心功能执行

input_params参数进行配置.

处理: 解析核心功能执行的输入参数,完成核心逻辑,返回结构化响应. 输出: 返回核心功能执行的响应数据,包含状态码、结果和日志.

  • 执行此能力时使用input_params参数,支持创建/查询/导出操作

参数配置与调用

config_options参数进行配置.

处理: 解析参数配置与调用的输入参数,完成核心逻辑,返回结构化响应. 输出: 返回参数配置与调用的响应数据,包含状态码、结果和日志.

  • 执行此能力时使用config_options参数,支持修改/重置/导入操作

结果处理与输出

output_format参数进行配置.

处理: 解析结果处理与输出的输入参数,完成核心逻辑,返回结构化响应. 输出: 返回结果处理与输出的响应数据,包含状态码、结果和日志.

  • 执行此能力时使用output_format参数,支持导出/保存/转换操作 能力覆盖范围:本skill的核心能力覆盖以下场景关键词:个人开发者的三层、模型路由指南、从最便宜模型起步、按需升级降低、API、模型路由工具、免费版、为个人开发者提供、三层模型路由指南、从最便宜的模型起、仅在必要时升级、帮助降低、快速决策树与参考、基础子、与定时任务路由等。这些关键词对应description中声明的使用场景,均已在上述能力点中提供对应的操作支持.

使用场景

场景一:个人项目日常对话路由

用户希望日常对话尽量用便宜模型,降低成本.

用户: 今天天气怎么样?
工具: 💚 FLASH — 简单事实查询,使用Flash
# ...
用户: 帮我写一个REST API端点
工具: 💛 STANDARD — 代码生成,使用Standard
# ...
用户: 设计一个多租户的数据库schema
工具: ❤️ PLUS / 32B — 架构决策,使用Plus

场景二:子Agent任务分发

用户有多个子Agent各司其职,希望按任务复杂度分发模型.

// 例行监控 — 用Flash
sessions_spawn(task="检查备份状态", model="GLM-4.5-Flash")
// ...
// 标准代码工作 — 用Standard
sessions_spawn(task="构建REST API端点", model="GLM-4.7")
// ...
// 架构决策 — 用Plus
sessions_spawn(task="设计多租户数据库schema", model="GLM-4-Plus")

场景三:定时任务模型选择

用户配置定时任务,希望默认用最便宜的模型.

{
  "payload": {
    "kind": "agentTurn",
    "model": "GLM-4.5-Flash"
  }
}

定时任务默认用Flash,除非任务确实需要推理能力.

不适用场景

以下场景模型路由工具(免费版)不适合处理:

  • 需要100%确定性的关键决策
  • 医疗诊断
  • 法律判决

触发条件

需要AI模型调用、智能对话、Agent编排、LLM应用时使用。不适用于非本工具能力范围的需求.

快速开始

  1. 阅读## 核心能力章节了解skill功能
  2. 按## 依赖说明配置环境
  3. 执行所需能力对应的命令
  4. 参考## 错误处理章节处理异常
  5. 查看## FAQ解答常见疑问

1. 掌握黄金规则

如果一个人类需要超过30秒的专注思考,从Flash升级到Standard. 如果任务涉及架构、复杂权衡或深度推理,升级到Plus / 32B.

2. 模型层级速览

层级示例模型用途
FlashGLM-4.5-Flash, GLM-4.7-Flash最快最便宜
StandardGLM-4.6, GLM-4.7强推理与代码
Plus / 32BGLM-4-Plus, GLM-4-32B-128K重推理与架构

3. 使用决策树

是问候、查询、状态检查或1-2句回答?
  是 → FLASH
  否 ↓
# ...
是代码、分析、规划、写作或多步骤?
  是 → STANDARD
  否 ↓
# ...
是架构、深度推理或关键决策?
  是 → PLUS / 32B
  否 → 默认STANDARD,卡住再升级

响应解析: 完成完成后,查看输出响应确认任务状态。成功时输出包含解析摘要和响应数据;失败时根据错误信息排查问题,查阅错误解析章节获取恢复步骤.

示例

适用场景

  • 事实问答:"什么是X"、"谁是Y"、"什么时候Z"
  • 快速查询:定义、单位换算、短翻译
  • 状态检查:监控、文件读取、会话状态
  • 心跳:周期性检查、OK响应
  • 记忆与提醒
  • 闲聊:问候、确认
  • 简单文件操作:读取、列出、基础写入
  • 一句话任务:1-2句能回答的任何事
  • 定时任务(默认用Flash)

Flash禁止做的事:

  • 写超过10行代码
  • 创建对比表格
  • 写超过3段
  • 多步骤分析
  • 写报告或提案

Standard适用场景(主力)

代码与技术:

  • 代码生成:函数、脚本、功能
  • 调试:常规bug排查
  • 代码审查:PR、重构
  • 文档:README、注释、指南

分析与规划:

  • 对比与评估
  • 规划:路线图、任务拆解
  • 研究综合
  • 多步骤推理

写作与内容:

  • 长文写作(>3段)
  • 长文档摘要
  • 结构化输出:表格、大纲

大多数真实用户对话属于这一层.

Plus / 32B适用场景(复杂推理)

架构与设计:

  • 系统与服务架构
  • 数据库schema设计
  • 分布式或多租户系统
  • 跨多文件的大型重构

深度分析:

  • 复杂调试(竞态条件、隐蔽bug)
  • 安全审查
  • 性能优化策略
  • 根因分析

战略与判断:

  • 战略规划
  • 细微判断与模糊性
  • 深度或多源研究
  • 关键生产决策

优秀实践

1. 从便宜开始,按需升级

原则:START CHEAP → SCALE ONLY WHEN NEEDED
# ...
默认用Flash → 卡住或质量不足 → 升级Standard → 仍不足 → 升级Plus

2. 30秒思考阈值

判断升级的关键问题:一个人类需要多少秒专注思考来回答这个任务?

  • <30秒:Flash足够
  • 30秒-2分钟:Standard
  • 2分钟或涉及架构:Plus / 32B

3. 定时任务默认Flash

定时任务通常不需要推理,默认用Flash可大幅降低成本。仅当任务确实需要推理时才升级.

4. 子Agent分发按任务复杂度

// 简单监控任务
sessions_spawn(task="检查服务健康", model="GLM-4.5-Flash")
// ...
// 标准开发任务
sessions_spawn(task="实现用户认证模块", model="GLM-4.7")
// ...
// 复杂架构任务
sessions_spawn(task="设计微服务拆分方案", model="GLM-4-Plus")

5. 可打印参考卡

┌─────────────────────────────────────────┐
│         智能模型路由(免费版)          │
│      Flash → Standard → Plus / 32B     │
├─────────────────────────────────────────┤
│  💚 FLASH(最便宜)                     │
│  • 问候、状态检查、快速查询            │
│  • 事实问答、提醒                      │
│  • 简单文件操作、1-2句回答             │
├─────────────────────────────────────────┤
│  💛 STANDARD(主力)                     │
│  • 代码>10行、调试                     │
│  • 分析、对比、规划                    │
│  • 报告、长文写作                      │
├─────────────────────────────────────────┤
│  ❤️ PLUS / 32B(复杂)                  │
│  • 架构决策                            │
│  • 复杂调试、多文件重构                │
│  • 战略规划、深度研究                  │
├─────────────────────────────────────────┤
│  💡 规则:人类>30秒思考 → 升级         │
│  💰 从便宜开始 → 按需升级              │
└─────────────────────────────────────────┘

常见问题

Q1:免费版支持哪些模型?

免费版提供三层路由决策框架,示例使用GLM系列模型(Flash/Standard/Plus/32B)。实际可用模型取决于你的API供应商,路由原则通用.

Q2:如何判断任务需要哪一层?

参考"30秒思考阈值":人类需要<30秒思考用Flash,30秒-2分钟用Standard,>2分钟或涉及架构用Plus / 32B。也可参考决策树与参考卡.

Q3:免费版能否分析成本?

免费版提供路由决策,不提供成本分析仪表盘。如需成本追踪、预算告警与优化报告,请使用PRO版.

Q4:免费版与PRO版差异?

维度免费版PRO版
路由决策三层决策树三层+自定义规则
成本分析不支持仪表盘与告警
批量路由不支持批量任务分发
自定义规则不支持团队规则与策略
监控不支持实时监控与告警
支持社区支持优先支持

Q5:模型名称会变化怎么办?

模型名称会随版本更新,但三层路由原则(便宜→标准→复杂)通用。建议定期对照你的API供应商文档更新具体模型名,决策框架不变.

依赖说明

运行环境

  • Agent平台: 支持SKILL.md的任意AI Agent(Claude Code / Cursor / Codex / Gemini CLI等)
  • 操作系统: Windows / macOS / Linux
  • API供应商: 提供三层模型选择的任意LLM API供应商

依赖详情

依赖项类型是否必需获取方式
LLM APIAPI必需由Agent内置LLM提供
模型API供应商API必需自行选择并申请API Key

API Key 配置

  • 基础LLM由Agent平台内置提供,Skill基于Markdown指令驱动
  • 实际调用模型API需要对应供应商的API Key,请按供应商文档配置环境变量(如 MODEL_API_KEY).
  • 建议为不同层级模型配置独立Key,便于成本追踪.

可用性分类

  • 分类: MD+EXEC模式纯Markdown指令,部分功能需exec命令行执行)
  • 说明: 基于Markdown的AI Skill,通过自然语言指令驱动Agent完成操作。免费版聚焦个人开发者的三层模型路由决策.

错误处理

错误场景原因处理方式
配置错误参数缺失或格式错误检查依赖说明中的配置要求
运行时错误运行环境不满足确认运行环境符合依赖说明
网络错误连接超时或不可达执行ping命令测试网络连通性,检查防火墙和代理设置连接后执行ping命令测试网络连通性,检查防火墙和代理设置连接后重新执行命令,参考国内替代方案

已知限制

  • 执行效率受模型能力与网络环境影响

输出格式

{
  "success": true,
  "data": {
    "result": "模型路由工具(免费版)处理结果",
    "execution_time": "0.5s",
    "metadata": {
      "version": "1.0",
      "processor": "model routing"
    }
  },
  "execution_log": ["解析输入参数", "执行核心处理", "格式化输出结果"],
  "error": null
}

相关技能

为 OpenClaw 提供免费模型智能路由服务,支持本地代理、自动配置、自动轮询、故障切换和配置零侵入。在需要设置免费模型路由、配置 Provider、切换模型或诊断模型可用性问题时使用。

38 次安装2 星标

模型切换工具(免费版)为个人开发者包含三层Claude模型切换指南,从最便宜的Haiku起步,仅在必要时升级,帮助节省50-90%的API成本。核心能力:. 适用于需要model switching tool相关能力的开发场景,提供结构化的工作流程和配置指引. 该工具经过深度差异化处理,针对用户反馈和使用痛点进行了优化改进,提升了实用性和可操作性.

智能模型路由与Token成本优化顾问 / Smart LLM Router & Token Cost Optimizer. 帮助用户为不同复杂度的AI任务选择最合适的模型层级(从极致性价比到旗舰级), 通过任务复杂度评估、模型分级推荐、安全强制升级规则,在保证质量的前提下节省70-90%的Token成本。 同时提...

Rust 开发优选实践助手免费版,面向个人开发者与学习者。核心能力:,可自发提升工作效率. 适用于需要rust toolkit相关能力的开发场景,包含结构化的工作流程和可复用的模板,帮助用户快速完成任务并保持代码质量. 适用于需要rust toolkit相关能力的开发场景,包含结构化的工作流程和配置指引.

1 次安装

Choose RouterBase model IDs and routing strategies for chat, image, video, audio, and embeddings workloads. Use when comparing providers, selecting GPT, Clau...

1 次安装