9Router Quota Tracking 深度指南:实时 Token 监控、成本估算与预警
2026/9/11 21:48:49 网站建设 项目流程

9Router Quota Tracking 深度指南:实时 Token 监控、成本估算与预警

【免费下载链接】9routerUnlimited FREE AI coding. Connect Claude Code, Codex, Cursor, Cline, Copilot, Antigravity to FREE Claude/GPT/Gemini via 40+ providers. Auto-fallback, RTK -40% tokens, never hit limits.项目地址: https://gitcode.com/GitHub_Trending/9r/9router

本篇技术指南以 9Router 的 Quota Tracking(配额追踪)功能为核心,讲解如何通过 Dashboard 与 HTTP API 实时追踪所有 Provider 的 token 消耗、监控 quota 上限与重置时间、估算付费支出并在额度耗尽前收到预警。读完本文,你将掌握 9Router 的配额/用量数据从"请求 → 提取 → 规范化 → 持久化 → 展示"的完整链路,能够配置预算告警与成本异常检测,并学会利用 Combo 顺序优化来把每月 AI 编码成本压到最低。


功能总览

9Router 为接入的每一个 Provider 提供全维度的 quota 追踪能力:

  • 实时 token 消耗—— 查看每次请求使用的 token 数(输入/输出/缓存/思考)
  • Quota 限制与剩余量—— 对照 provider 官方限额追踪使用进度
  • 重置倒计时—— 明确知道 quota 何时刷新(滚动窗口 / 每日 / 每周 / 每月)
  • 成本估算—— 为付费 tier 精确计算开销(区分普通输入、缓存读取与缓存写入价格)
  • 月度报告—— 分析长期使用模式与成本结构
  • 告警与通知—— 在到达限制之前获得预警,支持 Dashboard / 邮件 / Webhook

从源码结构看,这套能力由三层支撑:open-sse/utils/usageTracking.js(usage 提取与规范化)、open-sse/services/usage/(各 Provider 的 quota 拉取 handler)以及src/lib/db/repos/usageRepo.js(用量持久化与统计聚合)。


Dashboard 概览:Quota 汇总卡片

9Router Dashboard 的首页(Dashboard → Home → Quota Overview)以卡片形式汇总每个连接(Connection)的配额状态。以文档中的典型展示为例:

Dashboard → Home → Quota Overview ┌─────────────────────────────────────────────┐ │ Claude Code (cc/) │ │ ████████████░░░░░░░░ 2.5h / 5h (50%) │ │ Resets in: 2h 30m │ │ Cost: $0 (subscription) │ └─────────────────────────────────────────────┘ ┌─────────────────────────────────────────────┐ │ Gemini CLI (gc/) │ │ ████████░░░░░░░░░░░░ 450 / 1000 (45%) │ │ Daily reset in: 18h 30m │ │ Monthly: 45K / 180K (25%) │ │ Cost: $0 (free tier) │ └─────────────────────────────────────────────┘ ┌─────────────────────────────────────────────┐ │ GLM-4.7 (glm/) │ │ ██████████████░░░░░░ 7M / 10M tokens (70%) │ │ Resets: Daily 10:00 AM (in 5h 35m) │ │ Cost today: $4.20 │ └─────────────────────────────────────────────┘ ┌─────────────────────────────────────────────┐ │ MiniMax M2.1 (minimax/) │ │ ████████████████░░░░ 4M / 5M tokens (80%) │ │ Rolling 5h window │ │ Cost (5h): $0.80 │ └─────────────────────────────────────────────┘ ┌─────────────────────────────────────────────┐ │ iFlow (if/) │ │ ████████████████████ Unlimited │ │ Cost: $0 (free forever) │ └─────────────────────────────────────────────┘

卡片的核心信息维度包括:已用 / 总量(百分比)剩余百分比重置时间或倒计时resets in ...)、成本归属(订阅 $0 / 免费 tier $0 / 按量计费金额)。

对应源码中的渲染层位于 src/app/(dashboard)/dashboard/usage/components/ProviderLimits/QuotaTable.js/dashboard/usage/components/ProviderLimits/QuotaTable.js#L152-L205):每一行 quota 数据渲染进度条(quota.remaining驱动的宽度)、used / total(总量为 0 时显示)、剩余百分比(按剩余量分级配色getColorClasses)以及重置倒计时(formatResetTime)。特别地,recurring标志控制文案 —— 周期性配额显示in 5h 35m,而一次性/赠量包(bonus pack)会显示expires in ...,避免把硬性过期误读为循环刷新。


实时 Token 消耗追踪

逐请求追踪

Dashboard → Activity → Recent Requests页面为每次请求记录完整的 usage 明细:

Request #1234 Model: cc/claude-opus-4-5-20251101 Timestamp: 2026-02-04 04:15:32 Tokens: Input: 1,250 tokens Output: 850 tokens Total: 2,100 tokens Cost: $0 (subscription quota) Duration: 3.2s Status: ✅ Success

实时用量监视器

Dashboard → Live Monitor展示正在进行的请求的流式统计:

Current request: Model: glm/glm-4.7 Tokens streamed: 450 / ~800 estimated Cost so far: $0.0009 Duration: 1.8s

这里的"实时"能力与 src/lib/db/repos/usageRepo.js 中的trackPendingRequest相关:它以global._pendingRequests(按模型 / 按账号两级聚合)追踪在途请求,配合 60 秒超时清理与节流后的statsEmitter事件推送前端刷新,这正是 Live Monitor 数据的来源。

按模型拆解 Token

Dashboard → Analytics → Token Usage提供按模型维度的用量视图:

Today (Feb 4, 2026): cc/claude-opus-4-5: 15M tokens ($0, subscription) glm/glm-4.7: 8M tokens ($4.80) if/kimi-k2-thinking: 3M tokens ($0, free) Total: 26M tokens Cost: $4.80

源码级原理:usage 的提取与规范化

为什么不同 provider(Claude / OpenAI / Gemini / Ollama……)上报的 usage 结构千差万别,最终却能统一聚合?关键在于 open-sse/utils/usageTracking.js 中的三个函数:

  • extractUsage(chunk)(usageTracking.js):识别各协议的事件结构并提取 token 字段 —— Claude 的message_start/message_delta事件、OpenAI Responses API 的response.completed、OpenAI 兼容格式(含 DeepSeek 的prompt_cache_hit_tokens)、Gemini/Antigravity 的usageMetadata,乃至 Ollama NDJSON 的prompt_eval_count/eval_count
  • mergeUsage(prev, next)(usageTracking.js):Anthropic 把 usage 拆在两个事件里(message_start携带真实输入+缓存、message_delta携带累计输出),因此必须按字段取最大值合并,而不是覆盖。
  • canonicalizeUsage(usage)(usageTracking.js):把各类格式归一到统一约定 ——prompt_tokens为包含缓存读取与缓存写入的输入总量,cached_tokens为缓存读取子集,cache_creation_input_tokens为缓存写入子集。Claude 路径会把缓存字段折叠进 prompt 并置cached_tokens,从而保证幂等(重复执行不会重复累加)。

当 provider 不返回 usage 时,9Router 还会兜底估算:estimateInputTokens按 JSON 序列化后约每 4 字符 1 token 估算输入,estimateOutputTokens按输出长度估算,addBufferToUsage为结果追加 2000 token 缓冲以预防上下文截断(usageTracking.js)。相关的缓存语义与成本正确性由测试 tests/unit/cached-token-e2e.test.js 与 tests/unit/cached-token-usage.test.js 专门验证。


Quota 限制与重置时间

9Router 按 provider 的类型区分三种配额模型,文档逐一给出了限额与重置规则:

订阅型 Provider

Claude Code(Pro/Max)

Quota type: Time-based (5-hour rolling) Limit: 5 hours of usage Reset: Rolling 5-hour window + Weekly refresh Tracking: Usage time per model Dashboard shows: Opus: 2.5h / 5h used Sonnet: 1.2h / 5h used Haiku: 0.8h / 5h used Weekly reset: Every Monday 00:00 UTC

OpenAI Codex(Plus/Pro)

Quota type: Time-based (5-hour rolling) Limit: 5 hours (Plus) / 10 hours (Pro) Reset: Rolling 5-hour window + Weekly refresh Dashboard shows: GPT-5.2 Codex: 3.5h / 5h used Resets in: 1h 30m

Gemini CLI(免费)

Quota type: Request count + Monthly tokens Daily limit: 1,000 requests Monthly limit: 180,000 completions Reset: Daily 00:00 UTC + Monthly 1st Dashboard shows: Today: 450 / 1,000 requests (45%) This month: 45K / 180K completions (25%) Daily reset in: 18h 30m Monthly reset in: 26 days

GitHub Copilot

Quota type: Monthly usage Limit: Varies by plan Reset: 1st of each month Dashboard shows: Usage: 60% of monthly quota Resets: March 1, 2026 (in 25 days)

低价型 Provider

GLM-4.7

Quota type: Daily token limit Limit: 10M tokens/day (Coding Plan) Reset: Daily 10:00 AM Beijing Time (UTC+8) Dashboard shows: Used: 7M / 10M tokens (70%) Remaining: 3M tokens Resets in: 5h 35m Cost today: $4.20

MiniMax M2.1

Quota type: Rolling 5-hour window Limit: 5M tokens per 5 hours Reset: Continuous rolling window Dashboard shows: Used (5h): 4M / 5M tokens (80%) Oldest usage expires in: 45m Cost (5h): $0.80

Kimi K2

Quota type: Monthly subscription Limit: 10M tokens/month ($9 flat) Reset: Monthly on subscription date Dashboard shows: Used: 6M / 10M tokens (60%) Resets: Feb 15, 2026 (in 11 days) Cost: $9/month (prepaid)

免费型 Provider

iFlow / Qwen / Kiro

Quota type: Unlimited (rate-limited) Limit: No hard limit Reset: N/A Dashboard shows: Used today: 5M tokens Cost: $0 (free forever) Status: ✅ Available

源码级原理:quota 数据从哪来

Quota 数据并非拍脑袋计算,而是由各 Provider 的官方 usage 接口实时拉取。调度中心是 open-sse/services/usage.js 中的USAGE_HANDLERS映射表:claude → getClaudeUsagegemini-cli → getGeminiUsageglm → getGlmUsageminimax → getMiniMaxUsagegrok-cli → getGrokCliUsage等,覆盖 OAuth 型与 API Key 型两类认证。

  • Claude(open-sse/services/usage/claude.js):优先调用 OAuth usage 端点,读取five_hour(5 小时滚动窗口)与seven_day(7 天周窗口)以及seven_day_sonnet/seven_day_opus等模型级窗口,把官方返回的utilization(已用百分比)转换为{ used, total: 100, remaining, resetAt }结构;遇到 429 会对该 token 冷却 3 分钟(OAUTH_429_COOLDOWN_MS),并回退到旧的 settings + org usage 端点。
  • GLM(open-sse/services/usage/misc.js):按glm/glm-cn区分国际与国内区域,请求 quota 端点后筛选TOKENS_LIMIT类型的 limit,读取percentage(已用百分比)与nextResetTime(下次重置时间戳)填充 session quota —— 这正是文档中"Resets: Daily 10:00 AM (UTC+8)"字段的来源。
  • grok-cli(open-sse/services/usage/grokCliQuotaFrame.js):xAI 没有公开 REST quota 接口,9Router 直接解码 gRPC-web 的GetGrokCreditsConfig响应帧,从 protobuf 嵌套消息中提取usage ratio(已用比例 0~1)与 credit-pool 重置时间戳,得到{ percentUsed, resetAt }

各 handler 返回的resetAt统一经过 shared.js 的 parseResetTime 归一化:兼容 Date 对象、秒级/毫秒级 Unix 时间戳(自动判断< 1e12为秒)、纯数字字符串与 ISO 字符串,最终统一输出 ISO 格式,供前端倒计时渲染。


成本估算

实时成本追踪

Dashboard → Costs → Today按"订阅 / 付费 / 免费"三档归并当日开销:

Subscription providers: $0 Claude Code: 15M tokens ($0, included) Gemini CLI: 3M tokens ($0, free tier) Paid providers: $4.80 GLM-4.7: 8M tokens ($4.80) Input: 6M × $0.60/1M = $3.60 Output: 2M × $2.20/1M = $4.40 Total: $4.80 Free providers: $0 iFlow: 3M tokens ($0) Total today: $4.80

月度支出报告

Dashboard → Costs → This Month提供按周拆分的月度视图与成本结构分析:

Week 1 (Feb 1-7): Subscription: $0 (80M tokens) Paid: $15.20 (25M tokens) Free: $0 (10M tokens) Total: $15.20 Week 2 (Feb 8-14): Subscription: $0 (75M tokens) Paid: $12.80 (20M tokens) Free: $0 (8M tokens) Total: $12.80 Month to date: $28.00 Projected (30 days): ~$120 Breakdown by provider: GLM-4.7: $22.00 (78%) MiniMax M2.1: $6.00 (22%) Average cost per 1M tokens: $0.62 Savings vs ChatGPT API: 97% ($4,000 → $120)

成本预测

Dashboard → Costs → Projections基于最近 7 天数据外推月度开销:

Based on last 7 days usage: Daily average: 50M tokens Daily cost: $4.50 Monthly projection: Tokens: 1,500M (1.5B) Cost: $135 Breakdown: Subscription: 900M tokens ($0) GLM-4.7: 450M tokens ($90) MiniMax: 120M tokens ($24) Free: 30M tokens ($0) Budget status: Daily limit: $5 → 90% used today Monthly limit: $150 → 90% projected ⚠️ Warning: May exceed monthly budget

源码级原理:成本如何被计算

成本计算有单一事实来源:open-sse/providers/pricing.js。

  • getPricingForModel(provider, model)(pricing.js):按三级回退链解析模型单价 —— ① provider 专属定价表PROVIDER_PRICING,② 全局模型定价表MODEL_PRICING(如claude-opus-4-5-20251101为 input $5.00 / output $25.00 / cached $0.50 / cache_creation $6.25),③ 通配符模式定价PATTERN_PRICING。模型名带 vendor 前缀(如deepseek/deepseek-chat)时自动剥离前缀再查表。
  • calculateCostFromTokens(tokens, pricing)(pricing.js):按规范化的 usage 结构分档计价 —— 普通输入按input单价、缓存读取按cached单价、缓存写入按cache_creation单价。由于prompt_tokens已包含缓存部分,计算前先从输入中减去cached + cache_creation的 token 数,避免缓存 token 被重复按全价计费。

在持久化层,usageRepo.js 的 calculateCost 把每条请求的 tokens 交给calculateCostFromTokens结算,随后按"日粒度 + 多维聚合"落库:aggregateEntryToDay同时维护byProviderbyModelbyAccountbyApiKeybyEndpoint五组计数器(usageRepo.js),为后续 Analytics 的各种切面统计提供数据基础。


Usage 仪表盘

概览统计

Dashboard → Analytics → Overview汇总多时间跨度核心指标:

Today (Feb 4, 2026): Requests: 1,234 Tokens: 26M Cost: $4.80 Avg response time: 2.1s This week: Requests: 8,456 Tokens: 180M Cost: $28.00 Success rate: 99.2% This month: Requests: 15,234 Tokens: 320M Cost: $52.00 Top model: cc/claude-opus-4-5 (45%)

按模型维度

Dashboard → Analytics → Models展示 Top 模型排名与成本归属:

Top models (this month): 1. cc/claude-opus-4-5: 145M tokens (45%) 2. glm/glm-4.7: 95M tokens (30%) 3. if/kimi-k2-thinking: 50M tokens (16%) 4. minimax/MiniMax-M2.1: 20M tokens (6%) 5. gc/gemini-3-flash: 10M tokens (3%) Cost breakdown: cc/claude-opus: $0 (subscription) glm/glm-4.7: $45.00 if/kimi-k2-thinking: $0 (free) minimax/MiniMax-M2.1: $7.00 gc/gemini-3-flash: $0 (free)

按时间维度

Dashboard → Analytics → Timeline提供小时级热力分布:

Hourly usage (today): 00:00 - 01:00: 0.5M tokens 01:00 - 02:00: 0.2M tokens ... 08:00 - 09:00: 3.2M tokens (peak) 09:00 - 10:00: 2.8M tokens ... 23:00 - 00:00: 0.8M tokens Peak hours: 08:00 - 12:00 (morning coding) Low hours: 00:00 - 06:00 (night)

按 Combo 维度

Dashboard → Analytics → Combos把用量归因到具体的 Combo 链路:

premium-coding: Requests: 456 Tokens: 12M Cost: $2.40 Breakdown: cc/claude-opus: 8M tokens (67%, $0) glm/glm-4.7: 3M tokens (25%, $1.80) minimax/MiniMax-M2.1: 1M tokens (8%, $0.20) budget-combo: Requests: 234 Tokens: 6M Cost: $1.20 Breakdown: glm/glm-4.7: 4M tokens (67%, $2.40) if/kimi-k2-thinking: 2M tokens (33%, $0)

这些统计视图的数据来源于 src/lib/usageDb.js 重新导出(shim)的新 SQLite 数据库层(src/lib/db/),其中的getUsageStatsgetChartDatagetUsageHistory分别支撑概览卡片、图表与历史明细,而saveRequestUsage在每次请求结束时把规范化后的 tokens 与成本写入usageHistory表,形成"实时写入 → 定时聚合 → 多维度查询"的完整闭环。


告警与通知

Quota 告警

Dashboard → Settings → Alerts支持多级阈值与多种投递渠道:

Quota warnings: ✅ Alert at 80% quota used ✅ Alert at 90% quota used ✅ Alert when quota exhausted ✅ Notify when quota resets Delivery: ✅ Dashboard notification ✅ Email (optional) ✅ Webhook (optional)

示例通知:

⚠️ Claude Code quota 80% used 2.5h remaining (resets in 1h 30m) ⚠️ GLM-4.7 quota 90% used 1M tokens remaining (resets in 5h) ✅ Gemini CLI quota reset 1,000 requests available (daily limit)

预算告警

Dashboard → Settings → Budget Alerts为每日 / 每月预算配置百分比阈值,并在超额时自动切换到免费 tier:

Daily budget: $5 ✅ Alert at 80% ($4) ✅ Alert at 100% ($5) ✅ Auto-switch to free tier when exceeded Monthly budget: $150 ✅ Alert at 50% ($75) ✅ Alert at 80% ($120) ✅ Alert at 100% ($150)

示例通知:

⚠️ Daily budget 80% used $4.00 / $5.00 spent today ⚠️ Monthly budget 50% reached $75 / $150 spent this month Projected: $135 (within budget) 🚨 Daily budget exceeded $5.20 / $5.00 spent today Auto-switched to free tier

"Auto-switch 到免费 tier"这一行为与 9Router 的智能路由机制联动 —— 当 quota 耗尽或预算触顶时,请求自动 fallback 到路由链中的下一个可用 provider(详见本文末相关文档链接)。

成本异常检测

Dashboard → Settings → Anomaly Detection主动识别异常支出模式:

✅ Detect unusual spending patterns ✅ Alert on cost spikes (>2× daily average) ✅ Warn on quota exhaustion patterns Example alert: ⚠️ Cost spike detected Today: $12.50 (2.5× daily average) Reason: High GLM-4.7 usage (20M tokens) Suggestion: Check if primary models quota-exhausted

这类检测之所以可行,正是因为有usageHistory中的逐请求成本数据可以计算"日均成本"基线,从而识别超过 2 倍的突增。


最佳实践

1. 每日检查 Quota

Daily routine: 1. Check dashboard quota overview (30 seconds) 2. Review reset times 3. Plan usage around quota availability

示例:

Morning check: ✅ Claude Code: 5h available (fresh reset) ✅ Gemini CLI: 1K requests available ⚠️ GLM-4.7: 2M tokens left (resets 10AM) Action: Use Claude Code for morning work

2. 设置预算上限

Dashboard → Settings → Budget: Daily: $5 (prevents overspending) Monthly: $150 (aligns with budget)

效果:达到上限后自动切换到免费 tier,从机制上杜绝超支。

3. 优化 Combo 用量结构

Dashboard → Analytics → Combos: Review which models are used most Adjust combo order to minimize costs

示例:

Current: cc/claude-opus → glm/glm-4.7 80% via Claude (good) 20% via GLM ($12/month) Optimized: gc/gemini-3-flash → cc/claude-opus → glm/glm-4.7 50% via Gemini (free) 40% via Claude (subscription) 10% via GLM ($6/month) Savings: $6/month

4. 掌握各 Provider 的重置节奏

Dashboard → Quota → Reset Schedule: Claude Code: 5h rolling + Weekly Monday Gemini CLI: Daily 00:00 UTC + Monthly 1st GLM-4.7: Daily 10:00 AM Beijing Time MiniMax: Rolling 5h window

策略:优先在 quota 刚刚刷新的时间段使用对应 provider(例如 GLM-4.7 在北京时间每天 10:00 重置后使用),让"免费额度/订阅额度"发挥最大价值。

5. 定期复盘月度报告

Dashboard → Analytics → Monthly Report: Total tokens: 1.5B Total cost: $120 Savings: 97% vs ChatGPT API Insights: - 60% usage via subscriptions ($0) - 30% via GLM ($90) - 10% via free tier ($0) Optimization: - Increase Gemini CLI usage (free) - Reduce GLM usage (expensive)

API 访问

除了 Dashboard,9Router 还通过本地 HTTP API 暴露 quota 与 usage 数据,便于脚本化监控与自动化集成。

获取 Quota 状态

GET http://localhost:20128/api/quota Authorization: Bearer your-api-key Response: { "providers": [ { "id": "cc", "name": "Claude Code", "quota": { "used": 2.5, "limit": 5, "unit": "hours", "percentage": 50 }, "reset": { "type": "rolling", "window": "5h", "nextReset": "2026-02-04T06:45:00Z" }, "cost": { "today": 0, "month": 0, "currency": "USD" } }, { "id": "glm", "name": "GLM-4.7", "quota": { "used": 7000000, "limit": 10000000, "unit": "tokens", "percentage": 70 }, "reset": { "type": "daily", "time": "10:00 AM UTC+8", "nextReset": "2026-02-04T10:00:00+08:00" }, "cost": { "today": 4.20, "month": 52.00, "currency": "USD" } } ] }

注意响应的结构差异:Claude Code 的 quota 单位为hoursused: 2.5 / limit: 5),而 GLM-4.7 的单位为tokensused: 7000000 / limit: 10000000),reset.type也从rollingdaily两个维度区分了两种配额模型。这正是文档所描述的聚合端点。

获取 Usage 统计

GET http://localhost:20128/api/usage?period=today Authorization: Bearer your-api-key Response: { "period": "today", "date": "2026-02-04", "summary": { "requests": 1234, "tokens": 26000000, "cost": 4.80 }, "byModel": [ { "model": "cc/claude-opus-4-5", "requests": 456, "tokens": 15000000, "cost": 0 }, { "model": "glm/glm-4.7", "requests": 234, "tokens": 8000000, "cost": 4.80 } ] }

源码级说明:真实的路由实现

从源码看,连接级(connection-level)的 quota 拉取由 src/app/api/usage/[connectionId]/route.js 实现,其流程为:

  1. connectionId从数据库取出连接记录,不存在返回 404;
  2. 校验认证类型:仅 OAuth 连接,以及USAGE_APIKEY_PROVIDERS白名单内的 API Key 型连接(glm / minimax / kiro 等,apikeyapi_key两种拼写均接受)可获取 usage;
  3. 对 OAuth 连接先执行凭证刷新(refreshAndUpdateCredentials,仅在needsRefresh时触发),再调用getUsageForProvider从 provider 官方接口拉取配额;
  4. 若返回的消息命中"过期/未授权"特征(AUTH_EXPIRED_PATTERNS),则强制刷新令牌并重试一次(route.js),避免因 token 过期导致 quota 数据永久拉取失败。

对于文档中/api/usage/api/quota这类聚合端点,可以推断其数据来源即为上述连接级 usage 之上叠加src/lib/db层的持久化统计(getUsageStatsgetChartData)聚合而来,period=today等参数对应PERIOD_MS中的"24h""7d""30d""60d"窗口(见 usageRepo.js)。


故障排查

问题:Quota 显示 0% 但请求仍然失败

解决步骤:

  1. 检查 provider 连接状态(Dashboard → Providers)
  2. 确认 API keys 有效
  3. 查看 provider 服务状态页,确认是否宕机
  4. 尝试重新连接 OAuth providers

从源码角度补充:若 handler 因鉴权失败返回了含 "expired / authentication / unauthorized" 等关键字的 message(isAuthExpiredMessage),API 层会自动触发强制刷新重试(route.js);而 Claude 的 usage 端点若频繁 429,会触发 3 分钟冷却并回退到旧端点(claude.js)——因此"0% 但请求失败"时优先检查凭证与网络连通性,而非配额本身。

问题:成本估算不准

解决步骤:

  1. 进入 Dashboard → Settings → Pricing
  2. 核对各 provider 的单价是否与官方当前费率一致
  3. provider 调价后及时更新定价
  4. 仍有偏差时联系支持

问题:重置时间不更新

解决步骤:

  1. 刷新 Dashboard(F5)
  2. 检查系统时间是否正确
  3. 核对时区设置(如 GLM 的 10:00 AM 为北京时间 UTC+8)
  4. 仍异常则重启 9Router

问题:收不到告警

解决步骤:

  1. 进入 Dashboard → Settings → Alerts
  2. 确认邮箱地址填写正确
  3. 检查垃圾邮件文件夹
  4. 使用 Send Test 按钮测试通知链路

相关文档

  • Smart Routing —— 基于 quota 的自动 fallback 路由
  • Combos —— 创建自定义 fallback 链

二者与 Quota Tracking 构成闭环:Quota Tracking 负责"看得见",Smart Routing 与 Combos 负责"用得好"——当主 provider 配额耗尽或预算触顶时,请求自动沿路由链降级,实现"永不中断、成本可控"的 AI 编码体验。

【免费下载链接】9routerUnlimited FREE AI coding. Connect Claude Code, Codex, Cursor, Cline, Copilot, Antigravity to FREE Claude/GPT/Gemini via 40+ providers. Auto-fallback, RTK -40% tokens, never hit limits.项目地址: https://gitcode.com/GitHub_Trending/9r/9router

创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考

需要专业的网站建设服务?

联系我们获取免费的网站建设咨询和方案报价,让我们帮助您实现业务目标

立即咨询