预算

令牌与费用计算器

Reflection 尚未公布测试版的 API 价格,请输入你自己的价格。计算器会显示令牌的使用情况,尤其是推理令牌,因为 Beam 始终会生成推理令牌。

API 用量
Beam 的推理长度取决于任务和推理力度。请从响应中读取 usage.completion_tokens_details.reasoning_tokens,并填入平均值。

留空则只显示令牌数。在 OpenAI 风格的 API 中,推理令牌按输出计费;价格公布后,请查看 Reflection 的条款。

API 用量
每个请求的令牌数
4,100
每天的令牌数
4.1M
每月的令牌数
123M
每分钟的平均令牌数
2,847
推理令牌占输出的比例
71%
每月 API 费用
输入价格
每个请求的输入令牌数每个请求的回答令牌数每个请求的推理令牌数
自托管
服务器上所有请求每秒输出的 token 总数。请使用你的推理引擎和批处理大小进行测量;该值可能相差很大。
自托管
每月成本
$17,280
每月输出 token 数
3.9B
每 100 万个输出 token 的成本
$4.44
粗略 token 计数器

约 0 个 token · 0 个字符

Beam 的分词器尚未公开。对于拉丁文文本,此处按每个 token 约 4 个字符估算;对于中文、日文和韩文,则按每个字符约 1 个 token 估算。

速览速率限制
  • 限制适用于整个组织,由所有项目和密钥共享。
  • 限制按分钟和 UTC 日统计请求数与 token 数;推理 token 也计入。
  • 每个组织和每个密钥的并发请求数都有上限。
  • 429 错误码 rate_limit_exceeded:至少等待 Retry-After 秒。x-should-retry: false 表示每日额度已用完,需等到 00:00 UTC 才会重置。
  • 请留意 x-ratelimit-remaining-requests 和 x-ratelimit-remaining-tokens(以及对应的 -day 版本),以便及时降低请求速度。

源码: developers.reflection.ai/rate-limits