Budget

Calculateur de tokens et de coûts

Reflection n’a pas publié les tarifs de l’API pour la bêta, vous pouvez donc saisir les vôtres. Le calculateur indique où vont les tokens, notamment ceux du raisonnement, que Beam produit toujours.

Utilisation de l’API
La longueur du raisonnement de Beam dépend de la tâche et du niveau d’effort. Consultez usage.completion_tokens_details.reasoning_tokens dans vos réponses et saisissez la moyenne.

Laissez vide pour afficher uniquement les tokens. Sur les API de type OpenAI, le raisonnement est facturé comme une sortie ; consultez les conditions de Reflection lorsque les tarifs seront publiés.

Utilisation de l’API
Tokens par requête
4,100
Tokens par jour
4.1M
Tokens par mois
123M
Nombre moyen de tokens par minute
2,847
Part du raisonnement dans les sorties
71%
Coût mensuel de l’API
saisissez les tarifs
Tokens d’entrée par requêteTokens de réponse par requêteTokens de raisonnement par requête
Auto-hébergement
Nombre total de tokens de sortie par seconde pour toutes les requêtes sur le serveur. Mesurez-le avec votre moteur et la taille de lot utilisée ; il varie considérablement.
Auto-hébergement
Coût par mois
$17,280
Tokens de sortie par mois
3.9B
Coût par 1M de tokens de sortie
$4.44
Compteur approximatif de tokens

Environ 0 tokens · 0 caractères

Le tokenizer de Beam n’est pas encore public. Cette estimation se base sur environ 4 caractères par token pour les textes en alphabet latin et environ 1 token par caractère pour le chinois, le japonais et le coréen.

Limites de débit en bref
  • Les limites s’appliquent à l’ensemble de l’organisation et sont partagées entre tous les projets et toutes les clés.
  • Elles comptabilisent les requêtes et les tokens par minute et par jour UTC ; les tokens de raisonnement sont également comptabilisés.
  • Le nombre de requêtes simultanées est limité par organisation et par clé.
  • 429 avec le code rate_limit_exceeded : attendez au moins le nombre de secondes indiqué par Retry-After. x-should-retry: false signifie que le quota quotidien est épuisé jusqu’à 00:00 UTC.
  • Surveillez x-ratelimit-remaining-requests et x-ratelimit-remaining-tokens (ainsi que leurs versions -day) pour réduire votre débit avant d’atteindre les limites.

Source: developers.reflection.ai/rate-limits