งบประมาณ

เครื่องคำนวณโทเค็นและค่าใช้จ่าย

Reflection ยังไม่ได้ประกาศราคา API สำหรับเบต้า คุณจึงป้อนราคาเองได้ เครื่องคำนวณจะแสดงการใช้โทเค็นในแต่ละส่วน โดยเฉพาะโทเค็นการให้เหตุผล ซึ่ง Beam สร้างขึ้นเสมอ

การใช้งาน API
ความยาวของการให้เหตุผลของ Beam ขึ้นอยู่กับงานและระดับความพยายาม อ่าน usage.completion_tokens_details.reasoning_tokens จากคำตอบของคุณ แล้วป้อนค่าเฉลี่ย

เว้นว่างไว้เพื่อดูเฉพาะจำนวนโทเค็น ใน API รูปแบบ OpenAI จะคิดค่าบริการโทเค็นการให้เหตุผลในราคาเดียวกับเอาต์พุต โปรดตรวจสอบเงื่อนไขของ Reflection เมื่อมีการประกาศราคา

การใช้งาน API
โทเค็นต่อคำขอ
4,100
โทเค็นต่อวัน
4.1M
โทเค็นต่อเดือน
123M
โทเค็นเฉลี่ยต่อนาที
2,847
สัดส่วนการให้เหตุผลในเอาต์พุต
71%
ค่าใช้จ่าย API ต่อเดือน
ป้อนราคา
โทเค็นอินพุตต่อคำขอโทเค็นคำตอบต่อคำขอโทเค็นการให้เหตุผลต่อคำขอ
โฮสต์เอง
จำนวนโทเค็นเอาต์พุตต่อวินาทีรวมจากคำขอทั้งหมดบนเซิร์ฟเวอร์ วัดด้วยเอนจินและขนาดแบตช์ของคุณ ค่านี้อาจแตกต่างกันมาก
โฮสต์เอง
ค่าใช้จ่ายต่อเดือน
$17,280
จำนวนโทเค็นเอาต์พุตต่อเดือน
3.9B
ค่าใช้จ่ายต่อโทเค็นเอาต์พุต 1M รายการ
$4.44
ตัวนับโทเค็นโดยประมาณ

ประมาณ 0 โทเค็น · 0 อักขระ

ตอนนี้ยังไม่มีการเผยแพร่ tokenizer ของ Beam เครื่องมือนี้ประเมินโดยใช้ประมาณ 4 อักขระต่อโทเค็นสำหรับข้อความภาษาที่ใช้อักษรละติน และประมาณ 1 โทเค็นต่ออักขระสำหรับภาษาจีน ญี่ปุ่น และเกาหลี

สรุปขีดจำกัดอัตราการใช้งาน
  • ขีดจำกัดมีผลกับทั้งองค์กร และใช้ร่วมกันในทุกโปรเจกต์และคีย์
  • ระบบนับจำนวนคำขอและโทเค็นต่อนาทีและต่อวันตามเวลา UTC โดยนับโทเค็นสำหรับการให้เหตุผลด้วย
  • จำนวนคำขอที่ทำงานพร้อมกันถูกจำกัดต่อองค์กรและต่อคีย์
  • 429 พร้อมรหัส rate_limit_exceeded: ให้รออย่างน้อยตามจำนวนวินาทีที่ระบุใน Retry-After ค่า x-should-retry: false หมายความว่าใช้โควต้ารายวันหมดแล้ว จนกว่าจะถึง 00:00 UTC
  • ตรวจสอบ x-ratelimit-remaining-requests และ x-ratelimit-remaining-tokens (รวมถึงเวอร์ชัน -day) เพื่อชะลอการใช้งานล่วงหน้า

ต้นฉบับ: developers.reflection.ai/rate-limits