Anggaran

Kalkulator token dan biaya

Reflection belum memublikasikan harga API untuk versi beta, jadi masukkan harga Anda sendiri. Kalkulator ini menunjukkan penggunaan token, terutama untuk penalaran, yang selalu dihasilkan Beam.

Penggunaan API
Panjang penalaran Beam bergantung pada tugas dan tingkat upaya. Baca usage.completion_tokens_details.reasoning_tokens dari respons Anda, lalu masukkan rata-ratanya.

Kosongkan untuk melihat token saja. Pada API bergaya OpenAI, penalaran ditagih sebagai output; periksa ketentuan Reflection saat harga sudah tersedia.

Penggunaan API
Token per permintaan
4,100
Token per hari
4.1M
Token per bulan
123M
Rata-rata token per menit
2,847
Porsi penalaran dari output
71%
Biaya API per bulan
isi harga
Token input per permintaanToken jawaban per permintaanToken penalaran per permintaan
Hosting mandiri
Total token output per detik untuk semua permintaan di server. Ukur dengan engine dan ukuran batch Anda; nilainya bisa sangat bervariasi.
Hosting mandiri
Biaya per bulan
$17,280
Token output per bulan
3.9B
Biaya per 1M token output
$4.44
Penghitung token perkiraan

Sekitar 0 token · 0 karakter

Tokenizer Beam belum tersedia untuk publik. Perkiraan ini menggunakan sekitar 4 karakter per token untuk teks Latin dan sekitar 1 token per karakter untuk bahasa Tionghoa, Jepang, dan Korea.

Sekilas tentang batas laju
  • Batas berlaku untuk seluruh organisasi dan digunakan bersama oleh semua proyek dan kunci.
  • Batas ini menghitung permintaan dan token per menit serta per hari UTC; token reasoning juga dihitung.
  • Jumlah permintaan serentak dibatasi per organisasi dan per kunci.
  • 429 dengan kode rate_limit_exceeded: tunggu setidaknya selama jumlah detik yang tercantum di Retry-After. x-should-retry: false berarti anggaran harian sudah habis hingga 00:00 UTC.
  • Pantau x-ratelimit-remaining-requests dan x-ratelimit-remaining-tokens (serta versi -day-nya) agar Anda bisa mengurangi penggunaan lebih awal.

Sumber: developers.reflection.ai/rate-limits