news 2026/9/12 6:05:45

9Router 配额跟踪与用量监控实战指南:实时追踪 Token 消耗、成本估算与告警机制

作者头像

张小明

前端开发工程师

1.2k 24
文章封面图
9Router 配额跟踪与用量监控实战指南:实时追踪 Token 消耗、成本估算与告警机制

9Router 配额跟踪与用量监控实战指南:实时追踪 Token 消耗、成本估算与告警机制

【免费下载链接】9routerUnlimited FREE AI coding. Connect Claude Code, Codex, Cursor, Cline, Copilot, Antigravity to FREE Claude/GPT/Gemini via 40+ providers. Auto-fallback, RTK -40% tokens, never hit limits.项目地址: https://gitcode.com/GitHub_Trending/9r/9router

导读

本文围绕 9Router 的配额跟踪(Quota Tracking)与用量监控功能展开,覆盖 Dashboard 配额总览、逐请求 Token 消耗跟踪、各类订阅/付费/免费提供商的配额重置时间表、成本估算与月度报告、异常检测告警,以及GET /api/quotaGET /api/usage等 HTTP API 的接入方式。读完本文,你将掌握如何利用 9Router 同时管理多个 AI 提供商(Claude Code、Codex、Gemini CLI、Copilot、GLM、MiniMax、iFlow 等)的配额余量,在订阅额度耗尽前自动切换或降级,把多提供商组合的月度成本控制在预算之内。原文文档位于 gitbook/content/es/features/quota-tracking.md,本文以它为骨架,并结合仓库源码(open-sse/services/usage.js 及其下属的提供商 usage 处理器、src/lib/db/repos/usageRepo.js)补充实现层面的原理。

一、配额跟踪解决什么问题

9Router 是面向 AI 编程场景的多提供商聚合代理,同时连接 Claude Code、Codex、Cursor、Cline、Copilot、Antigravity 等客户端到 40+ 家模型提供商。每个提供商的配额模型完全不同:有的按使用时长计(Claude Code Pro 的 5 小时滚动窗口),有的按请求数计(Gemini CLI 每日 1,000 次),有的按 Token 量计(GLM 每日 1000 万 Token),还有的是无硬限制的免费层。如果缺乏统一视图,很容易出现"订阅额度没花完却去付费用量"或"主模型额度耗尽导致请求失败"的浪费。

9Router 的配额跟踪把这些问题集中到一个 Dashboard,提供六项核心能力(对应原文档 Resumen 章节):

  • 实时 Token 消耗:查看每次请求实际使用的输入/输出 Token;
  • 配额限制与剩余量:跟踪每个提供商的使用量 vs 限制;
  • 重置倒计时:明确知道下一次配额刷新时间;
  • 成本估算:对付费层级计算真实花费;
  • 月度报告:分析长期使用模式;
  • 告警与通知:在触顶之前收到预警。

二、Dashboard 配额总览(Quota Overview)

原文档给出了 Dashboard → Home → Quota Overview 的典型形态:每个连接一张卡片,同时展示用量进度条、剩余量、重置时间与成本。

┌─────────────────────────────────────────────┐ │ Claude Code (cc/) │ │ ████████████░░░░░░░░ 2.5h / 5h (50%) │ │ Se reinicia en: 2h 30m │ │ Costo: $0 (suscripción) │ └─────────────────────────────────────────────┘ ┌─────────────────────────────────────────────┐ │ Gemini CLI (gc/) │ │ ████████░░░░░░░░░░░░ 450 / 1000 (45%) │ │ Reinicio diario en: 18h 30m │ │ Mensual: 45K / 180K (25%) │ │ Costo: $0 (nivel gratis) │ └─────────────────────────────────────────────┘ ┌─────────────────────────────────────────────┐ │ GLM-4.7 (glm/) │ │ ██████████████░░░░░░ 7M / 10M tokens (70%) │ │ Se reinicia: Diario 10:00 AM (en 5h 35m) │ │ Costo hoy: $4.20 │ └─────────────────────────────────────────────┘ ┌─────────────────────────────────────────────┐ │ MiniMax M2.1 (minimax/) │ │ ████████████████░░░░ 4M / 5M tokens (80%) │ │ Ventana rolling 5h │ │ Costo (5h): $0.80 │ └─────────────────────────────────────────────┘ ┌─────────────────────────────────────────────┐ │ iFlow (if/) │ │ ████████████████████ Ilimitado │ │ Costo: $0 (gratis para siempre) │ └─────────────────────────────────────────────┘

卡片前缀(cc/gc/glm/minimax/if/)即 9Router 的路由别名,在请求路径中以此选择目标提供商。可以看到:不同提供商的"用量单位"各不相同(小时、请求数、Token 数),9Router 会按各自的配额模型归一化展示。

实现层面:统一配额分发器

Dashboard 上每个卡片的数字并非一个统一的"配额中心"算出来的,而是由 open-sse/services/usage.js 中的USAGE_HANDLERS映射表按提供商分发到各自的 usage 处理器:

const USAGE_HANDLERS = { github: (c) => getGitHubUsage(c.accessToken, c.providerSpecificData, c.proxyOptions), "gemini-cli": (c) => getGeminiUsage(c.accessToken, c.providerDataWithProjectId, c.proxyOptions), antigravity: (c) => getAntigravityUsage(c.accessToken, c.providerSpecificData, c.proxyOptions), claude: (c) => getClaudeUsage(c.accessToken, c.proxyOptions), codex: (c) => getCodexUsage(c.accessToken, c.proxyOptions), glm: (c) => getGlmUsage(c.apiKey, c.provider, c.proxyOptions), minimax: (c) => getMiniMaxUsage(c.apiKey, c.provider, c.proxyOptions), // ... };

入口getUsageForProvider(connection, proxyOptions)先组装providerDataWithProjectId(把连接上保存的projectId合并进providerSpecificData),再根据connection.provider找到对应 handler 并调用。对于没有实现 usage 接口的提供商,返回Usage API not implemented for {provider}的友好提示。

三、实时 Token 消耗跟踪

3.1 逐请求用量(Recent Requests)

每次请求完成后,Activity → Recent Requests 都会记录一条带详细 Token 拆解的记录:

Request #1234 Model: cc/claude-opus-4-5-20251101 Timestamp: 2026-02-04 04:15:32 Tokens: Input: 1,250 tokens Output: 850 tokens Total: 2,100 tokens Cost: $0 (cuota de suscripción) Duration: 3.2s Status: ✅ Success

3.2 实时监控(Live Monitor)

对于进行中的流式请求,Dashboard → Live Monitor 显示已传输的 Token 数、估算总量、当前累计成本和耗时:

Solicitud actual: Model: glm/glm-4.7 Tokens transmitidos: 450 / ~800 estimados Costo hasta ahora: $0.0009 Duración: 1.8s

3.3 按模型拆分(Token Usage Analytics)

Dashboard → Analytics → Token Usage 按模型汇总当天用量:

Hoy (4 feb 2026): cc/claude-opus-4-5: 15M tokens ($0, suscripción) glm/glm-4.7: 8M tokens ($4.80) if/kimi-k2-thinking: 3M tokens ($0, gratis) Total: 26M tokens Costo: $4.80

实现层面:请求用量的落库与聚合

这些逐请求数据不是仅存在于前端的内存态,而是被持久化到 SQLite 使用统计库。src/lib/db/repos/usageRepo.js 中的saveRequestUsage(entry)负责写入单条请求用量,getUsageStats(period)负责聚合统计。聚合时它会把最近 100 条 history 记录去重(按model|provider|promptTokens|completionTokens|分钟组合去重,防止重复计数),并归一化不同厂商的 Token 字段名——既读取prompt_tokens也读取input_tokens,既读取completion_tokens也读取output_tokens,同时单独统计cached_tokens(缓存命中 Token)。这也是为什么 Dashboard 能同时兼容 Anthropic 系与 OpenAI 系请求的 Token 字段。

getUsageStats的返回结构同时包含totalRequeststotalPromptTokenstotalCompletionTokenstotalCachedTokenstotalCost,以及按byProviderbyModelbyAccountbyApiKeybyEndpoint五个维度的拆分,还有activeRequests(进行中请求)与pendingRequests——这些正是 Dashboard 统计页各图表的底层数据源。

四、配额限制与重置时间:三类提供商的差异

9Router 将提供商分为三类配额模型,重置机制完全不同(原文档 Límites de cuota 章节)。

4.1 订阅型提供商

Claude Code(Pro/Max)——基于时间(rolling 5 小时)

Tipo de cuota: Basado en tiempo (rolling 5 horas) Límite: 5 horas de uso Reinicio: Ventana rolling 5 horas + refresh semanal Seguimiento: Tiempo de uso por modelo El dashboard muestra: Opus: 2.5h / 5h usados Sonnet: 1.2h / 5h usados Haiku: 0.8h / 5h usados Reinicio semanal: Todos los lunes 00:00 UTC

实现要点(open-sse/services/usage/claude.js):getClaudeUsage优先调用 Claude 的 OAuth usage 端点(anthropic-beta: oauth-2025-04-20头),解析响应里的five_hour(5 小时窗口)与seven_day(7 天窗口)字段,utilization表示已用百分比(如 87 表示已用 87%、剩 13%),还会遍历seven_day_sonnetseven_day_opusseven_day_*前缀字段生成按模型拆分的周配额对象。值得注意的是,该端点有 429 限流保护:一旦收到 429,会对该 token 施加 180 秒冷却(OAUTH_429_COOLDOWN_MS = 180000),期间改用 legacy settings + org usage 端点兜底——即"配额接口被限流不影响正常聊天"。

OpenAI Codex(Plus/Pro)——基于时间

Tipo de cuota: Basado en tiempo (rolling 5 horas) Límite: 5 horas (Plus) / 10 horas (Pro) Reinicio: Ventana rolling 5 horas + refresh semanal El dashboard muestra: GPT-5.2 Codex: 3.5h / 5h usados Se reinicia en: 1h 30m

Gemini CLI(免费)——请求数 + 月度 Token 双限额

Tipo de cuota: Conteo de solicitudes + tokens mensuales Límite diario: 1,000 solicitudes Límite mensual: 180,000 completados Reinicio: Diario 00:00 UTC + Mensual día 1 El dashboard muestra: Hoy: 450 / 1,000 solicitudes (45%) Este mes: 45K / 180K completados (25%) Reinicio diario en: 18h 30m Reinicio mensual en: 26 días

实现要点(open-sse/services/usage/google.js):getGeminiUsage通过 Cloud Code Assist API 的retrieveUserQuota(与gemini /stats同一端点)获取按模型的配额桶(bucket),每个桶带remainingFraction(剩余比例)与resetTime。注意它需要先解析出 Google Cloud 项目 ID:优先用连接上保存的projectId,否则调用loadCodeAssist订阅接口取cloudaicompanionProject,再向quotaUrlPOST{ project: projectId }。所有配额值被归一化为total = 1000的基准(remaining = 1000 * remainingFractionused = 1000 - remaining),以便 UI 统一渲染进度条。

GitHub Copilot——月度用量

Tipo de cuota: Uso mensual Límite: Varía según el plan Reinicio: 1ro de cada mes El dashboard muestra: Uso: 60% de la cuota mensual Se reinicia: 1 mar 2026 (en 25 días)

4.2 廉价付费提供商

GLM-4.7——每日 Token 限额

Tipo de cuota: Límite diario de tokens Límite: 10M tokens/día (Coding Plan) Reinicio: Diario 10:00 AM hora de Beijing (UTC+8) El dashboard muestra: Usados: 7M / 10M tokens (70%) Restantes: 3M tokens Se reinicia en: 5h 35m Costo hoy: $4.20

实现要点(open-sse/services/usage/misc.js):getGlmUsage根据 provider 是glm(国际)还是glm-cn(中国区)选择不同的GLM_QUOTA_URLS[region]端点,以BearerAPI key 请求配额;401 时明确返回"API key 无效或过期",其他非 2xx 返回带状态码的提示。

MiniMax M2.1——5 小时滚动窗口

Tipo de cuota: Ventana rolling 5 horas Límite: 5M tokens por 5 horas Reinicio: Ventana rolling continua El dashboard muestra: Usados (5h): 4M / 5M tokens (80%) El uso más antiguo expira en: 45m Costo (5h): $0.80

Kimi K2——月度订阅

Tipo de cuota: Suscripción mensual Límite: 10M tokens/mes ($9 plano) Reinicio: Mensual en la fecha de suscripción El dashboard muestra: Usados: 6M / 10M tokens (60%) Se reinicia: 15 feb 2026 (en 11 días) Costo: $9/mes (pagado por adelantado)

4.3 免费提供商

iFlow / Qwen / Kiro——无硬限制

Tipo de cuota: Ilimitado (con rate-limit) Límite: Sin límite duro Reinicio: N/A El dashboard muestra: Usados hoy: 5M tokens Costo: $0 (gratis para siempre) Estado: ✅ Disponible

实现要点:getIflowUsage在仓库中返回"iFlow connected. Usage tracked per request."——即 iFlow 本身无公开配额端点,9Router 采用"逐请求记账"(usage 落库)的方式跟踪其用量;同理,open-sse/services/usage/misc.js 中的 Ollama Cloud 处理也明确注释"不暴露公开 quota API",返回计划信息与友好提示,避免 UI 显示错误态。

五、成本估算(Cost Tracking)

5.1 当日成本(Costs → Today)

Proveedores de suscripción: $0 Claude Code: 15M tokens ($0, incluido) Gemini CLI: 3M tokens ($0, nivel gratis) Proveedores de pago: $4.80 GLM-4.7: 8M tokens ($4.80) Input: 6M × $0.60/1M = $3.60 Output: 2M × $2.20/1M = $4.40 Total: $4.80 Proveedores gratis: $0 iFlow: 3M tokens ($0) Total hoy: $4.80

可见成本估算按"输入 Token 单价 × 输入量 + 输出 Token 单价 × 输出量"计算,不同 Token 类型单价不同(GLM 示例中 Input $0.60/1M vs Output $2.20/1M)。订阅层与免费层显示为 $0 但保留 Token 量,让用户看清"钱花在哪、省在哪"。

5.2 月度支出报告(Costs → This Month)

Semana 1 (1-7 feb): Suscripción: $0 (80M tokens) Pago: $15.20 (25M tokens) Gratis: $0 (10M tokens) Total: $15.20 Semana 2 (8-14 feb): Suscripción: $0 (75M tokens) Pago: $12.80 (20M tokens) Gratis: $0 (8M tokens) Total: $12.80 Mes hasta la fecha: $28.00 Proyectado (30 días): ~$120 Desglose por proveedor: GLM-4.7: $22.00 (78%) MiniMax M2.1: $6.00 (22%) Costo promedio por 1M tokens: $0.62

月度报告按周拆分订阅/付费/免费三类,给出"截至今日"与"30 天外推"两个口径,并按提供商展示成本占比。

5.3 成本预测(Costs → Projections)

Basado en uso de los últimos 7 días: Promedio diario: 50M tokens Costo diario: $4.50 Proyección mensual: Tokens: 1,500M (1.5B) Costo: $135 Estado del presupuesto: Límite diario: $5 → 90% usado hoy Límite mensual: $150 → 90% proyectado ⚠️ Advertencia: Puede exceder el presupuesto mensual

预测基于最近 7 天的日均消耗外推全月,并与用户设定的日/月预算上限对比,提前给出"可能超支"的预警。

六、使用统计 Dashboard(Analytics)

6.1 总体统计(Analytics → Overview)

Hoy (4 feb 2026): Solicitudes: 1,234 Tokens: 26M Costo: $4.80 Tiempo promedio de respuesta: 2.1s Esta semana: Solicitudes: 8,456 Tokens: 180M Costo: $28.00 Tasa de éxito: 99.2% Este mes: Solicitudes: 15,234 Tokens: 320M Costo: $52.00 Modelo principal: cc/claude-opus-4-5 (45%)

6.2 按模型(Analytics → Models)

Modelos principales (este mes): 1. cc/claude-opus-4-5: 145M tokens (45%) 2. glm/glm-4.7: 95M tokens (30%) 3. if/kimi-k2-thinking: 50M tokens (16%) 4. minimax/MiniMax-M2.1: 20M tokens (6%) 5. gc/gemini-3-flash: 10M tokens (3%) Desglose de costos: cc/claude-opus: $0 (suscripción) glm/glm-4.7: $45.00 if/kimi-k2-thinking: $0 (gratis) minimax/MiniMax-M2.1: $7.00 gc/gemini-3-flash: $0 (gratis)

这正对应getUsageStats返回的byModel聚合维度——每个模型累积 Token 量、请求数与成本,成本拆解让"最贵的模型"一目了然。

6.3 按时段(Analytics → Timeline)

Uso por hora (hoy): 00:00 - 01:00: 0.5M tokens 01:00 - 02:00: 0.2M tokens ... 08:00 - 09:00: 3.2M tokens (pico) 09:00 - 10:00: 2.8M tokens ... 23:00 - 00:00: 0.8M tokens Horas pico: 08:00 - 12:00 (codificación matutina) Horas bajas: 00:00 - 06:00 (noche)

时间线数据来自getChartData(period)(src/lib/db/repos/usageRepo.js),它按日期键从usageDaily表读取历史聚合,可发现"早上 8 点到 12 点编码高峰"这类使用规律。

6.4 按组合(Analytics → Combos)

premium-coding: Solicitudes: 456 Tokens: 12M Costo: $2.40 Desglose: cc/claude-opus: 8M tokens (67%, $0) glm/glm-4.7: 3M tokens (25%, $1.80) minimax/MiniMax-M2.1: 1M tokens (8%, $0.20) budget-combo: Solicitudes: 234 Tokens: 6M Costo: $1.20 Desglose: glm/glm-4.7: 4M tokens (67%, $2.40) if/kimi-k2-thinking: 2M tokens (33%, $0)

组合(Combo)是 9Router 的多级 fallback 链路,配额跟踪会展示每个 Combo 内部各模型的用量与成本占比,帮助判断链路的成本分布是否合理。

七、告警与通知(Alerts & Notifications)

7.1 配额告警(Settings → Alerts)

Advertencias de cuota: ✅ Alerta al 80% de cuota usada ✅ Alerta al 90% de cuota usada ✅ Alerta cuando la cuota se agota ✅ Notificar cuando la cuota se reinicia Entrega: ✅ Notificación del dashboard ✅ Email (opcional) ✅ Webhook (opcional)

通知示例:

⚠️ Cuota de Claude Code 80% usada 2.5h restantes (se reinicia en 1h 30m) ⚠️ Cuota de GLM-4.7 90% usada 1M tokens restantes (se reinicia en 5h) ✅ Cuota de Gemini CLI reiniciada 1,000 solicitudes disponibles (límite diario)

7.2 预算告警(Settings → Budget Alerts)

Presupuesto diario: $5 ✅ Alerta al 80% ($4) ✅ Alerta al 100% ($5) ✅ Cambio automático al nivel gratis cuando se excede Presupuesto mensual: $150 ✅ Alerta al 50% ($75) ✅ Alerta al 80% ($120) ✅ Alerta al 100% ($150)

通知示例:

⚠️ Presupuesto diario 80% usado $4.00 / $5.00 gastados hoy ⚠️ Presupuesto mensual 50% alcanzado $75 / $150 gastados este mes Proyectado: $135 (dentro del presupuesto) 🚨 Presupuesto diario excedido $5.20 / $5.00 gastados hoy Cambio automático al nivel gratis

关键机制:日预算超限后自动切换至免费层——这与项目描述中的 Auto-fallback 能力呼应,配额耗尽时请求会自动改走配置的备选提供商,而不是直接失败。

7.3 成本异常检测(Settings → Anomaly Detection)

✅ Detectar patrones de gasto inusuales ✅ Alerta en picos de costo (>2× promedio diario) ✅ Advertencia en patrones de agotamiento de cuota Ejemplo de alerta: ⚠️ Pico de costo detectado Hoy: $12.50 (2.5× promedio diario) Razón: Alto uso de GLM-4.7 (20M tokens) Sugerencia: Verifica si los modelos principales tienen cuota agotada

异常检测以"超过日均成本 2 倍"为触发线,并在告警中给出原因推测(如主模型配额耗尽导致流量集中到付费模型)。

八、最佳实践

1. 每天监控配额

Rutina diaria: 1. Revisa el resumen de cuota del dashboard (30 segundos) 2. Revisa los tiempos de reinicio 3. Planifica el uso según la disponibilidad de cuota

示例:早晨检查时 Claude Code 有 5h 可用、Gemini CLI 有 1K 请求可用、GLM 只剩 2M Token(10AM 重置),那么上午的重活优先走 Claude Code。

2. 设置预算上限

Dashboard → Settings → Budget: Diario: $5 (previene gastos excesivos) Mensual: $150 (alinea con el presupuesto)

达到上限后自动切换免费层,防止失控消费。

3. 优化 Combo 组合顺序

Actual: cc/claude-opus → glm/glm-4.7 80% vía Claude (bueno) 20% vía GLM ($12/mes) Optimizado: gc/gemini-3-flash → cc/claude-opus → glm/glm-4.7 50% vía Gemini (gratis) 40% vía Claude (suscripción) 10% vía GLM ($6/mes) Ahorros: $6/mes

把免费/订阅层放在 fallback 链前面,把付费按量层放在最后,仅作为兜底。结合 智能路由 的按配额自动 fallback,效果最佳。

4. 跟踪重置时间表

Dashboard → Quota → Reset Schedule: Claude Code: 5h rolling + Semanal lunes Gemini CLI: Diario 00:00 UTC + Mensual día 1 GLM-4.7: Diario 10:00 AM hora Beijing MiniMax: Ventana rolling 5h

策略:在配额刚刷新时优先使用对应提供商。

5. 定期复查月度报告

Dashboard → Analytics → Monthly Report: Total de tokens: 1.5B Costo total: $120 Insights: - 60% de uso vía suscripciones ($0) - 30% vía GLM ($90) - 10% vía nivel gratis ($0) Optimización: - Aumentar el uso de Gemini CLI (gratis) - Reducir el uso de GLM (costoso)

九、HTTP API 访问配额与用量

除了 Dashboard,9Router 还提供 HTTP API 供脚本、Agent 或第三方工具拉取数据(对应仓库 src/app/api/usage 下的路由组:statshistorychartprovidersrequest-detailsrequest-logs等)。

9.1 获取配额状态

GET http://localhost:20128/api/quota Authorization: Bearer your-api-key

响应结构(原文档示例,经删节):

{ "providers": [ { "id": "cc", "name": "Claude Code", "quota": { "used": 2.5, "limit": 5, "unit": "hours", "percentage": 50 }, "reset": { "type": "rolling", "window": "5h", "nextReset": "2026-02-04T06:45:00Z" }, "cost": { "today": 0, "month": 0, "currency": "USD" } }, { "id": "glm", "name": "GLM-4.7", "quota": { "used": 7000000, "limit": 10000000, "unit": "tokens", "percentage": 70 }, "reset": { "type": "daily", "time": "10:00 AM UTC+8", "nextReset": "2026-02-04T10:00:00+08:00" }, "cost": { "today": 4.20, "month": 52.00, "currency": "USD" } } ] }

字段语义:quota.used/limit/unit/percentage为用量与单位(hours / tokens / requests);reset.type取值rolling(滚动窗口)或daily(定点重置),nextReset为 ISO 8601 时间戳;cost.today/month为本日/本月累计成本。这正对应源码中各 handler 返回的统一结构——如 Claude 的createQuotaObject生成的{ used, total, remaining, resetAt, unlimited },以及 Gemini/Antigravity 归一化到total=1000基准后的{ used, total, resetAt, remainingPercentage }

9.2 获取用量统计

GET http://localhost:20128/api/usage?period=today Authorization: Bearer your-api-key

响应结构(原文档示例,经删节):

{ "period": "today", "date": "2026-02-04", "summary": { "requests": 1234, "tokens": 26000000, "cost": 4.80 }, "byModel": [ { "model": "cc/claude-opus-4-5", "requests": 456, "tokens": 15000000, "cost": 0 }, { "model": "glm/glm-4.7", "requests": 234, "tokens": 8000000, "cost": 4.80 } ] }

period参数可扩展为todayweekmonth等,byModel数组即为上面提到的按模型聚合结果,可作为外部监控脚本的数据源。

十、常见问题排查(Troubleshooting)

原文档给出了四类高频问题的排查路径:

现象排查步骤
配额显示 0% 但请求仍然失败检查 Provider 连接(Dashboard → Providers);确认 API key 有效;查看提供商状态页是否宕机;尝试重连 OAuth 提供商
成本估算不准确Dashboard → Settings → Pricing 核对各提供商单价是否与最新费率一致;若厂商调价则手动更新;持续不符联系支持
重置时间不刷新刷新 Dashboard(F5);核对系统时间;检查时区配置;仍异常则重启 9Router
收不到告警Dashboard → Settings → Alerts 核对邮箱地址;检查垃圾邮件文件夹;用 Send Test 按钮测试通知通道

从源码角度看,"配额显示 0% 但请求失败"还有一种常见成因:某些提供商(如 Ollama Cloud)没有公开配额 API,配额显示本就是信息性占位;而 Claude 类 OAuth 配额端点在 429 冷却期内会走 legacy 兜底,此时展示的是旧数据。因此当配额数据与请求结果矛盾时,优先确认连接状态与冷却/兜底逻辑是否生效。

十一、与智能路由、Combos 的配合

配额跟踪并非孤立功能——它的数据会直接喂给 智能路由:当主提供商配额接近耗尽时,9Router 自动把新请求 fallback 到配置链上的下一个提供商,这正是"Auto-fallback, never hit limits"的实现基础;而 Combos 则允许把多个提供商编排成自定义 fallback 链,配合本文第四节的重置时间表,可以把免费层和订阅层放在链首、按量付费层放在链尾,在保证请求可用性的同时把成本压到最低。

结语

9Router 的配额跟踪体系用"统一 Dashboard + 按提供商分发的 usage handler + SQLite 用量落库 + 告警通知 + HTTP API"四层结构,把 40+ 家提供商千差万别的配额模型(滚动小时窗、每日请求数、每日/每月 Token 量、无限免费层)收敛为一套可对比、可告警、可编程查询的统一视图。对于重度使用 AI 编程助手的开发者,这套机制的价值在于:订阅额度物尽其用、付费额度精打细算、免费额度优先利用、预算上限自动兜底——从"怕超额"变成"算得清"。

【免费下载链接】9routerUnlimited FREE AI coding. Connect Claude Code, Codex, Cursor, Cline, Copilot, Antigravity to FREE Claude/GPT/Gemini via 40+ providers. Auto-fallback, RTK -40% tokens, never hit limits.项目地址: https://gitcode.com/GitHub_Trending/9r/9router

创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考

版权声明: 本文来自互联网用户投稿,该文观点仅代表作者本人,不代表本站立场。本站仅提供信息存储空间服务,不拥有所有权,不承担相关法律责任。如若内容造成侵权/违法违规/事实不符,请联系邮箱:809451989@qq.com进行投诉反馈,一经查实,立即删除!
网站建设 2026/9/12 6:04:53

AI辅助开发多开浏览器:从技术选型到指纹隔离实战

/* MD / 富文本中的 .toc(含博客园搬家等嵌套结构);.toc-box 在侧栏,不受影响 */#content_views .toc,/* 编辑器常在目录前后插入空 p(:empty 仍占 20px),一并去掉避免顶空隙 */#content_views.markdown_views > p:empty:has(+ .toc),#content_views.markdown_views …

作者头像 李华
网站建设 2026/9/12 6:03:55

LEACH、LEACH-C与TS-I-LEACH:无线传感器网络分簇路由协议仿真对比

1. 从网络生命周期瓶颈说起:LEACH为什么经典却又必须被改进 做无线传感器网络(WSN)方向的研究,绕不开LEACH。我大概五年前第一次接触这个协议的时候,在网上找到一堆Matlab代码,但基本都是跑完出张图就完事。…

作者头像 李华
网站建设 2026/9/12 6:03:35

C++模板编译期机器学习:原理与性能优化实践

/* MD / 富文本中的 .toc(含博客园搬家等嵌套结构);.toc-box 在侧栏,不受影响 */#content_views .toc,/* 编辑器常在目录前后插入空 p(:empty 仍占 20px),一并去掉避免顶空隙 */#content_views.markdown_views > p:empty:has(+ .toc),#content_views.markdown_views …

作者头像 李华
网站建设 2026/9/12 6:01:17

豆包+飞书构建松弛工作流:AI协同提效实战指南

/* MD / 富文本中的 .toc(含博客园搬家等嵌套结构);.toc-box 在侧栏,不受影响 */#content_views .toc,/* 编辑器常在目录前后插入空 p(:empty 仍占 20px),一并去掉避免顶空隙 */#content_views.markdown_views > p:empty:has(+ .toc),#content_views.markdown_views …

作者头像 李华