Бюджет

Калькулятор токенов и стоимости

Reflection пока не публиковала цены на API для бета-версии, поэтому укажите свои. Калькулятор покажет, на что расходуются токены, особенно на рассуждения, которые Beam генерирует всегда.

Использование API
Длина рассуждений Beam зависит от задачи и уровня усилий. Считывайте usage.completion_tokens_details.reasoning_tokens из ответов и укажите среднее значение.

Оставьте поля пустыми, чтобы видеть только токены. В API в стиле OpenAI за рассуждения платят как за выходные токены; ознакомьтесь с условиями Reflection, когда появятся цены.

Использование API
Токенов на запрос
4,100
Токенов в день
4.1M
Токенов в месяц
123M
Среднее число токенов в минуту
2,847
Доля рассуждений в выходных токенах
71%
Стоимость API в месяц
укажите цены
Входных токенов на запросТокенов в ответе на запросТокенов рассуждений на запрос
Самостоятельный хостинг
Общее количество выходных токенов в секунду по всем запросам на сервере. Измерьте этот показатель для своего движка и размера батча: он сильно варьируется.
Самостоятельный хостинг
Стоимость в месяц
$17,280
Выходные токены в месяц
3.9B
Стоимость за 1M выходных токенов
$4.44
Примерный счётчик токенов

Примерно 0 токенов · 0 символов

Токенизатор Beam пока недоступен. Здесь используется примерная оценка: около 4 символов на токен для текста на латинице и около 1 токена на символ для китайского, японского и корейского языков.

Кратко об ограничениях частоты запросов
  • Ограничения действуют для всей организации и распространяются на все проекты и ключи.
  • Учитываются запросы и токены в минуту и за день по UTC; токены рассуждений тоже учитываются.
  • Количество одновременных запросов ограничено для каждой организации и каждого ключа.
  • При 429 с кодом rate_limit_exceeded подождите не меньше указанного значения Retry-After (в секундах). x-should-retry: false означает, что дневной лимит исчерпан до 00:00 UTC.
  • Следите за x-ratelimit-remaining-requests и x-ratelimit-remaining-tokens (а также за их версиями с суффиксом -day), чтобы заранее снизить нагрузку.

Источник: developers.reflection.ai/rate-limits