☰
tokenwise - SKILL
2026/10/2 21:32:45 网站建设 项目流程

name: tokenwise
description: “Measurement-driven model router for Claude Code. Routes Haiku/Sonnet/Opus per task class, logs every routed task with real $ numbers, and A/B tests cheaper tiers before you trust the savings.”
category: developer-tools
risk: critical
source: community
source_repo: CodeShuX/tokenwise
source_type: community
date_added: “2026-05-12”
author: CodeShuX
tags: [model-routing, token-optimization, cost-reduction, anthropic, haiku, sonnet, opus, claude-code, ab-testing, measurement]
tools: [claude]
license: “MIT”
license_source: “https://github.com/CodeShuX/tokenwise/blob/main/LICENSE”
plugin:
targets:
codex: blocked
claude: blocked

TokenWise — 基于测量的模型路由器

概述

一个 Claude Code 技能,可将子任务自动路由到能处理它们的最便宜模型(机械性工作用 Haiku,有限推理用 Sonnet,只有综合工作用 Opus),然后将每个路由任务以真实的 token + 成本数字记录到本地 NDJSON 文件中。它还包括一个 A/B 测试子命令,可在多个档位运行同一任务并评分质量,因此路由决策是根据用户的真实工作负载验证的——而非估算的。

Anthropic 自己的 bug 追踪器(Issue #27665)报告称,Max 订阅者的 Claude Code token 中有 93.8% 流向了 Opus。现有的路由器(claude-router、wshobson、VoltAgent)要么静态固定模型,要么基于没有测量的"感觉式"启发进行路由。TokenWise 填补了测量的空白。

何时使用

  • 在不牺牲输出质量的前提下削减 Claude Code token 支出
  • 在信任自动路由之前,验证 Haiku/Sonnet 对于特定任务类是否"足够好"
  • 审计 Opus token 实际消耗在哪里
  • 为财务或费用分摊记录每会话成本数据

子命令

  • /tokenwise:install— 带 diff 预览、自动备份和--dry-run模式的引导式安装程序
  • /tokenwise:report— 每会话 token + 成本摘要,对比全 Opus 基线
  • /tokenwise:summary [--week|--month|--all]— 带趋势的历史汇总
  • /tokenwise:ab "<task>"— 在多个档位 A/B 测试同一任务,生成 Markdown 对比
  • /tokenwise:undo— 从备份恢复 CLAUDE.md / settings.json

路由分类

档位模型任务类
机械性Haiku 4.5文件读取、grep、格式化、重命名、简单编辑、文档查询
有限推理Sonnet 4.6单文件重构、限定范围的研究、编写测试
综合Opus 4.7架构决策、多文件重构、安全审查

安全上限:

  • Haiku 永远不派生进一步的子代理
  • 最大派生深度 = 2
  • 需要更智能模型的子代理返回给父级——它们绝不自行升级
  • 少于 100 字符且没有文件上下文的任务以内联方式运行(子代理开销 > 节省)
  • 子代理上下文超过 30k token 会提升一个档位

隐私

零遥测。所有日志都位于项目本地的.tokenwise/log.ndjson中。任务描述在记录前被截断为 80 个字符并剥离文件内容。源码中不存在任何分析端点。

安装

在任何 Claude Code 会话中:

/plugin marketplace add CodeShuX/tokenwise /plugin install tokenwise@tokenwise

然后运行/tokenwise:install并按照引导提示操作。

局限性

  • token 计数与 Anthropic 计费相比误差约 ±2%
  • A/B 测试模式会消耗额外 token(一个任务 × N 个档位)——这是有意的一次性验证
  • 仅支持 Anthropic 设计(跨供应商请使用 LiteLLM 或 OpenRouter)
  • 子代理model:参数在某些 Claude Code 版本上存在已知的静默失败 bug——该技能会在安装时探测此问题,如果路由损坏则拒绝配置

来源

  • 仓库:https://github.com/CodeShuX/tokenwise
  • 许可证:MIT
  • 作者:CodeShuX

需要专业的网站建设服务?

联系我们获取免费的网站建设咨询和方案报价,让我们帮助您实现业务目标

立即咨询