予算

トークン・コスト計算ツール

Reflectionはベータ版のAPI価格を公開していないため、独自の価格を入力してください。この計算ツールではトークンの内訳、特にBeamが常に生成する推論トークンの割合を確認できます。

API使用量
Beamの推論の長さはタスクと推論の強度によって異なります。レスポンスからusage.completion_tokens_details.reasoning_tokensを読み取り、平均値を入力してください。

トークン数のみを確認する場合は空欄にしてください。OpenAI形式のAPIでは推論トークンも出力として課金されます。価格が公開されたらReflectionの利用条件を確認してください。

API使用量
1リクエストあたりのトークン数
4,100
1日あたりのトークン数
4.1M
1か月あたりのトークン数
123M
1分あたりの平均トークン数
2,847
出力に占める推論の割合
71%
1か月あたりのAPIコスト
価格を入力
1リクエストあたりの入力トークン数1リクエストあたりの回答トークン数1リクエストあたりの推論トークン数
セルフホスト
サーバー上のすべてのリクエストを合計した、1秒あたりの出力トークン数です。エンジンとバッチサイズを使って測定してください。数値は大きく変動します。
セルフホスト
月額コスト
$17,280
月間出力トークン数
3.9B
出力トークン100万個あたりのコスト
$4.44
おおよそのトークン数カウンター

約 0 トークン · 0 文字

Beamのトークナイザーはまだ公開されていません。このツールでは、ラテン文字のテキストは約4文字で1トークン、中国語、日本語、韓国語は約1文字で1トークンとして計算します。

レート制限の概要
  • 制限は組織全体に適用され、すべてのプロジェクトとキーで共有されます。
  • リクエスト数とトークン数は1分あたりおよびUTC日次でカウントされます。推論トークンもカウントされます。
  • 同時リクエスト数には、組織ごとおよびキーごとの上限があります。
  • コード rate_limit_exceeded を含む429が返された場合は、少なくとも Retry-After 秒待ってください。x-should-retry: false は、00:00 UTC まで日次の上限に達していることを意味します。
  • x-ratelimit-remaining-requests と x-ratelimit-remaining-tokens(およびそれぞれの -day バージョン)を確認し、早めにリクエストを抑えてください。

ソース: developers.reflection.ai/rate-limits