งบประมาณ
เครื่องคำนวณโทเค็นและค่าใช้จ่าย
Reflection ยังไม่ได้ประกาศราคา API สำหรับเบต้า คุณจึงป้อนราคาเองได้ เครื่องคำนวณจะแสดงการใช้โทเค็นในแต่ละส่วน โดยเฉพาะโทเค็นการให้เหตุผล ซึ่ง Beam สร้างขึ้นเสมอ
การใช้งาน API
ความยาวของการให้เหตุผลของ Beam ขึ้นอยู่กับงานและระดับความพยายาม อ่าน usage.completion_tokens_details.reasoning_tokens จากคำตอบของคุณ แล้วป้อนค่าเฉลี่ย
เว้นว่างไว้เพื่อดูเฉพาะจำนวนโทเค็น ใน API รูปแบบ OpenAI จะคิดค่าบริการโทเค็นการให้เหตุผลในราคาเดียวกับเอาต์พุต โปรดตรวจสอบเงื่อนไขของ Reflection เมื่อมีการประกาศราคา
การใช้งาน API
โทเค็นต่อคำขอ
4,100
โทเค็นต่อวัน
4.1M
โทเค็นต่อเดือน
123M
โทเค็นเฉลี่ยต่อนาที
2,847
สัดส่วนการให้เหตุผลในเอาต์พุต
71%
ค่าใช้จ่าย API ต่อเดือน
ป้อนราคา
โทเค็นอินพุตต่อคำขอโทเค็นคำตอบต่อคำขอโทเค็นการให้เหตุผลต่อคำขอ
โฮสต์เอง
จำนวนโทเค็นเอาต์พุตต่อวินาทีรวมจากคำขอทั้งหมดบนเซิร์ฟเวอร์ วัดด้วยเอนจินและขนาดแบตช์ของคุณ ค่านี้อาจแตกต่างกันมาก
โฮสต์เอง
ค่าใช้จ่ายต่อเดือน
$17,280
จำนวนโทเค็นเอาต์พุตต่อเดือน
3.9B
ค่าใช้จ่ายต่อโทเค็นเอาต์พุต 1M รายการ
$4.44
ตัวนับโทเค็นโดยประมาณ
ประมาณ 0 โทเค็น · 0 อักขระ
ตอนนี้ยังไม่มีการเผยแพร่ tokenizer ของ Beam เครื่องมือนี้ประเมินโดยใช้ประมาณ 4 อักขระต่อโทเค็นสำหรับข้อความภาษาที่ใช้อักษรละติน และประมาณ 1 โทเค็นต่ออักขระสำหรับภาษาจีน ญี่ปุ่น และเกาหลี
สรุปขีดจำกัดอัตราการใช้งาน
- ขีดจำกัดมีผลกับทั้งองค์กร และใช้ร่วมกันในทุกโปรเจกต์และคีย์
- ระบบนับจำนวนคำขอและโทเค็นต่อนาทีและต่อวันตามเวลา UTC โดยนับโทเค็นสำหรับการให้เหตุผลด้วย
- จำนวนคำขอที่ทำงานพร้อมกันถูกจำกัดต่อองค์กรและต่อคีย์
- 429 พร้อมรหัส rate_limit_exceeded: ให้รออย่างน้อยตามจำนวนวินาทีที่ระบุใน Retry-After ค่า x-should-retry: false หมายความว่าใช้โควต้ารายวันหมดแล้ว จนกว่าจะถึง 00:00 UTC
- ตรวจสอบ x-ratelimit-remaining-requests และ x-ratelimit-remaining-tokens (รวมถึงเวอร์ชัน -day) เพื่อชะลอการใช้งานล่วงหน้า