Budżet

Kalkulator tokenów i kosztów

Reflection nie opublikowało cen API w wersji beta, więc wpisz własne. Kalkulator pokazuje, na co przypadają tokeny, zwłaszcza tokeny rozumowania, które Beam zawsze generuje.

Użycie API
Długość rozumowania Beam zależy od zadania i poziomu wysiłku. Odczytaj usage.completion_tokens_details.reasoning_tokens z odpowiedzi i wpisz średnią.

Pozostaw puste, aby wyświetlać tylko tokeny. W API zgodnych ze stylem OpenAI tokeny rozumowania są rozliczane jako wyjściowe; gdy pojawią się ceny, sprawdź warunki Reflection.

Użycie API
Tokenów na żądanie
4,100
Tokenów dziennie
4.1M
Tokenów miesięcznie
123M
Średnia liczba tokenów na minutę
2,847
Udział rozumowania w tokenach wyjściowych
71%
Miesięczny koszt API
wpisz ceny
Tokenów wejściowych na żądanieTokenów odpowiedzi na żądanieTokenów rozumowania na żądanie
Samodzielne hostowanie
Łączna liczba tokenów wyjściowych na sekundę we wszystkich żądaniach obsługiwanych przez serwer. Zmierz ją dla swojego silnika i rozmiaru batcha — wartości mogą się znacznie różnić.
Samodzielne hostowanie
Koszt miesięczny
$17,280
Tokeny wyjściowe miesięcznie
3.9B
Koszt za 1M tokenów wyjściowych
$4.44
Przybliżony licznik tokenów

Około 0 tokenów · 0 znaków

Tokenizer Beam nie jest jeszcze publicznie dostępny. W tym przybliżeniu przyjęto około 4 znaków na token w tekście zapisanym alfabetem łacińskim oraz około 1 token na znak w języku chińskim, japońskim i koreańskim.

Limity szybkości w skrócie
  • Limity obowiązują w całej organizacji i są współdzielone przez wszystkie projekty i klucze.
  • Obejmują żądania i tokeny na minutę oraz na dobę UTC; liczą się też tokeny rozumowania.
  • Liczba równoczesnych żądań jest ograniczona dla każdej organizacji i każdego klucza.
  • 429 z kodem rate_limit_exceeded: odczekaj co najmniej tyle sekund, ile wynosi wartość Retry-After. x-should-retry: false oznacza, że dzienny limit został wyczerpany i odnowi się dopiero o 00:00 UTC.
  • Monitoruj x-ratelimit-remaining-requests i x-ratelimit-remaining-tokens (oraz ich odpowiedniki z końcówką -day), aby odpowiednio wcześnie ograniczyć tempo.

Źródło: developers.reflection.ai/rate-limits