Orçamento
Calculadora de tokens e custos
A Reflection ainda não publicou os preços da API para a versão beta, então informe os seus. A calculadora mostra como os tokens são usados, especialmente no raciocínio, que o Beam sempre produz.
Uso da API
A extensão do raciocínio do Beam depende da tarefa e do nível de esforço. Leia usage.completion_tokens_details.reasoning_tokens nas suas respostas e informe a média.
Deixe em branco para ver apenas os tokens. Em APIs no estilo da OpenAI, o raciocínio é cobrado como saída; confira os termos da Reflection quando os preços forem divulgados.
Uso da API
Tokens por solicitação
4,100
Tokens por dia
4.1M
Tokens por mês
123M
Média de tokens por minuto
2,847
Parcela de raciocínio na saída
71%
Custo mensal da API
insira os preços
Tokens de entrada por solicitaçãoTokens de resposta por solicitaçãoTokens de raciocínio por solicitação
Hospedagem própria
Total de tokens de saída por segundo em todas as solicitações no servidor. Meça com seu mecanismo e tamanho do lote; esse valor varia bastante.
Hospedagem própria
Custo por mês
$17,280
Tokens de saída por mês
3.9B
Custo por 1 milhão de tokens de saída
$4.44
Estimador aproximado de tokens
Cerca de 0 tokens · 0 caracteres
O tokenizador do Beam ainda não é público. Esta estimativa considera cerca de 4 caracteres por token para textos em alfabeto latino e cerca de 1 token por caractere para chinês, japonês e coreano.
Limites de taxa em resumo
- Os limites se aplicam à organização inteira e são compartilhados por todos os projetos e chaves.
- Eles contabilizam solicitações e tokens por minuto e por dia UTC; os tokens de raciocínio também são contabilizados.
- O número de solicitações simultâneas é limitado por organização e por chave.
- 429 com o código rate_limit_exceeded: aguarde pelo menos o número de segundos indicado em Retry-After. x-should-retry: false significa que o limite diário foi atingido até 00:00 UTC.
- Monitore x-ratelimit-remaining-requests e x-ratelimit-remaining-tokens (e as respectivas versões -day) para reduzir o ritmo com antecedência.