跳到正文
EN

选择模型并核对价格与用量

读取 API Key 可访问的模型,按服务档位核对当前价格,并在使用记录中确认请求费用。

更新于 复核于
查看 Markdown

模型目录、服务分组和价格会独立变化。调用前先用目标 API Key 读取模型,再到价格页核对同一模型在对应服务档位中的当前价格。

价格页将不同来源和价格选择称为“服务档位”;API Key 和使用记录中称为“服务分组”。两处指向同一个分组值,本文按你当前操作的页面使用对应名称。

只有一个可用服务档位时,价格页直接显示该档位的价格,无需选择。页面展示简化不改变已有 API Key 的服务分组或账号权限;历史 Key 仍需核对自己的模型范围和实际调用价格。

福利组迁移期限

福利组已不能新建,已有福利组目前仍可用。根据福利组下线公告,2026 年 9 月 30 日后,福利组将完全停止使用。请提前迁移到其他可用分组;Key 保留原设置不代表福利组会一直可用。

迁移前先确认目标分组中的模型、价格和额度。迁移到 Astra 时,Fast 的额度消耗是 Standard 的 2.5 倍;按实际需求选择处理模式。迁移后用应用实际使用的协议发送小请求,再到“使用记录”核对模型、服务分组、费用和结果,确认后再恢复正常调用量。

如果账号没有其他可用分组,或目标模型无法访问,先联系支持确认可用方案。

读取可用模型

curl https://router-api.xiu.ai/v1/models \
  -H "Authorization: Bearer $XIUROUTER_API_KEY"

返回列表受以下条件共同限制:

  • 账号当前可用的服务分组。
  • API Key 绑定或自动选择的服务分组。
  • API Key 的模型范围。
  • 当前有可用渠道的模型。

同一个账号的两把 Key 可能看到不同列表。生产配置应保存精确模型 ID,不要只按厂商名或页面展示名匹配。

核对协议

价格目录会发布模型可用的端点类型,但最终仍要用目标 Key 验证:

supported_endpoint_types 值 常用接口
openai /v1/chat/completions
openai-response /v1/responses
anthropic /v1/messages
gemini /v1beta/models/{model}:generateContent

网关还存在图片、Embeddings、音频、Rerank 和 Moderation 路由。它们的可用性取决于模型和服务来源;当前文档没有把这些路由列为通用生产能力。Files、Fine-tuning 和图片 Variations 当前未实现。

核对价格

打开模型与价格,完成以下检查:

  1. 搜索精确模型 ID。
  2. 若页面提供多个服务档位,选择与 API Key 服务分组对应的档位;只有一个时直接查看价格。
  3. 确认目标模型可由该 Key 访问;公开价格页不代表账号拥有所有模型的调用权限。
  4. 查看按 Token 或按次计费。
  5. 按 Token 计费时,分别看输入、输出、缓存读取和缓存写入。
  6. 页面列出多个上下文档位时,核对每档的输入长度条件和四项 Token 单价。
  7. 页面列出 Fast 或 Flex 时,核对对应倍率,不要只看默认档价格。
  8. 需要对比时,再看厂商参考价;实际扣费以 XiuRouter 当前服务分组价格和使用记录为准。

服务档位表示来源和价格选择,不代表固定速度、质量或 SLA。API Key 使用自动分组时,系统可能在失败后尝试下一个分组,最终承接请求的分组决定价格。

动态阶梯价格

部分模型会根据输入上下文长度切换整套 Token 单价。输入超过页面标出的条件后,输入、输出、缓存读取和缓存写入可能同时进入另一档。不要只用默认输入价乘总 Token,也不要把缓存 Token 重复算进普通输入。

部分 Responses 模型还支持 service_tier:

推荐请求值 价格页显示
省略或默认值 默认处理模式
priority Fast
flex Flex

本文使用 priority 发起 Fast 请求。只使用目标模型价格行中明确显示的模式。倍率应用于该请求命中的 Token 价格;工具调用等附加费用会在使用记录中单独列出。

核对使用记录

按日期查询费用

登录后打开使用记录,可查看已有调用,无需另外发送请求。

  1. 打开时间范围选择器。可以直接选择“今天”“昨天”“近 7 天”“近 30 天”或“本月”。
  2. 要查某一段时间,在日历中选择开始、结束日期和时间,再点“确定”。
  3. 查看这段时间的 Token 合计和费用记录。需要定位具体调用时,再按 API Key、模型或请求状态筛选请求列表。

日期按浏览器本地时间计算。“近 7 天”和“近 30 天”包含今天;“本月”从本月 1 日开始。刷新自定义范围时,起止时间保持不变。

页面顶部合计按所选时间范围统计;API Key、模型和状态筛选只影响请求列表,不改变顶部合计。

如果没有记录,先核对日期和筛选条件。费用尚未记录的请求不等于免费调用,可稍后刷新并打开请求详情核对。

核对单次请求

发送请求后,打开 XiuRouter“使用记录”。每条记录可用于核对:

  • 请求时间和请求 ID。
  • API Key 名称和 public ID。
  • 模型和实际服务分组。
  • 输入、输出 Token。
  • 动态模型实际命中的上下文档位和请求规则。
  • Web search 等工具的调用次数和附加费用。
  • 执行费用和费用状态。
  • 流式或非流式。
  • 首字、总耗时和请求结果。

失败或未知结果先刷新记录。没有请求 ID、Token 或费用时,不要用 0 或客户端估算值代替缺失事实。

使用记录用于核对调用统计,不提供对话原文。XiuRouter 不存储模型对话内容,调用统计与模型性能数据长期保留;模型厂商按各自服务的数据政策处理请求。具体范围见数据处理与隐私保护。

建议流程

  1. 在价格页选择模型;有多个服务档位时,再选择与 Key 对应的档位。
  2. 为项目创建专用 Key,并限制模型和剩余额度。
  3. 通过 GET /v1/models 确认 Key 能看到目标模型。
  4. 用项目实际协议发送小请求。
  5. 在使用记录核对模型、分组、Token、费用和结果。
  6. 通过后再提高并发、上下文和任务权限。

来源与核对日期

本文于 2026-09-13 复核公开价格目录的单档位展示、处理模式请求值、数据政策入口及福利组下线公告。福利组迁移期限和 Astra Fast 额度倍率来自该公告;模型列表、API Key 范围和使用记录说明沿用已核对的接口与字段。模型、分组和价格以控制台当前显示为准。

2026-09-17 补充时间范围查询步骤;选项名称、日期范围和刷新规则依据当前产品实现及已发布资源复核。

导航

输入关键词开始搜索

↑↓ 移动↵ 打开Esc 关闭