Budget

Token- en kostencalculator

Reflection heeft geen API-prijzen voor de bèta gepubliceerd, dus vul je eigen prijzen in. De calculator laat zien waar tokens naartoe gaan, vooral naar redenering, die Beam altijd genereert.

API-gebruik
Hoeveel tokens Beam aan redenering besteedt, hangt af van de taak en de inspanning. Lees usage.completion_tokens_details.reasoning_tokens uit je responses en vul het gemiddelde in.

Laat leeg om alleen tokens te zien. Op API's in OpenAI-stijl wordt redenering gefactureerd als uitvoer; controleer de voorwaarden van Reflection zodra de prijzen bekend zijn.

API-gebruik
Tokens per verzoek
4,100
Tokens per dag
4.1M
Tokens per maand
123M
Gemiddeld aantal tokens per minuut
2,847
Aandeel redenering in de uitvoer
71%
API-kosten per maand
vul prijzen in
Invoertokens per verzoekAntwoordtokens per verzoekRedeneringstokens per verzoek
Zelf hosten
Totaal aantal outputtokens per seconde voor alle aanvragen op de server. Meet dit met je engine en batchgrootte; de waarde kan sterk variëren.
Zelf hosten
Kosten per maand
$17,280
Outputtokens per maand
3.9B
Kosten per 1M outputtokens
$4.44
Geschatte tokenteller

Ongeveer 0 tokens · 0 tekens

De tokenizer van Beam is nog niet openbaar. Voor Latijnse tekst gaan we uit van ongeveer 4 tekens per token en voor Chinees, Japans en Koreaans van ongeveer 1 token per teken.

Rate limits in het kort
  • Limieten gelden voor de hele organisatie en worden gedeeld door alle projecten en sleutels.
  • Ze tellen aanvragen en tokens per minuut en per UTC-dag; tokens voor redeneringen tellen ook mee.
  • Het aantal gelijktijdige aanvragen is beperkt per organisatie en per sleutel.
  • 429 met code rate_limit_exceeded: wacht minstens Retry-After seconden. x-should-retry: false betekent dat het dagbudget op is tot 00:00 UTC.
  • Houd x-ratelimit-remaining-requests en x-ratelimit-remaining-tokens (en hun -day-versies) in de gaten om op tijd af te remmen.

Bron: developers.reflection.ai/rate-limits