Ngân sách
Công cụ tính toán token và chi phí
Reflection chưa công bố giá API trong giai đoạn beta, vì vậy hãy nhập mức giá của riêng bạn. Công cụ tính sẽ cho biết token được sử dụng như thế nào, đặc biệt là token suy luận mà Beam luôn tạo ra.
Mức sử dụng API
Độ dài phần suy luận của Beam phụ thuộc vào tác vụ và mức độ suy luận. Đọc usage.completion_tokens_details.reasoning_tokens từ các phản hồi của bạn và nhập giá trị trung bình.
Để trống để chỉ xem số token. Trên các API theo kiểu OpenAI, token suy luận được tính phí như token đầu ra; hãy kiểm tra điều khoản của Reflection khi giá được công bố.
Mức sử dụng API
Token mỗi yêu cầu
4,100
Token mỗi ngày
4.1M
Token mỗi tháng
123M
Số token trung bình mỗi phút
2,847
Tỷ lệ suy luận trong đầu ra
71%
Chi phí API mỗi tháng
nhập giá
Số token đầu vào mỗi yêu cầuSố token câu trả lời mỗi yêu cầuSố token suy luận mỗi yêu cầu
Tự host
Tổng số token đầu ra mỗi giây trên tất cả yêu cầu trên máy chủ. Đo bằng engine và kích thước batch của bạn; con số này thay đổi đáng kể.
Tự host
Chi phí mỗi tháng
$17,280
Số token đầu ra mỗi tháng
3.9B
Chi phí cho mỗi 1M token đầu ra
$4.44
Bộ đếm token ước tính
Khoảng 0 token · 0 ký tự
Tokenizer của Beam hiện chưa được công khai. Công cụ này ước tính khoảng 4 ký tự cho mỗi token đối với văn bản tiếng Latinh và khoảng 1 token cho mỗi ký tự đối với tiếng Trung, tiếng Nhật và tiếng Hàn.
Tóm tắt giới hạn tốc độ
- Giới hạn áp dụng cho toàn bộ tổ chức và được dùng chung bởi tất cả dự án và khóa.
- Giới hạn tính số yêu cầu và token mỗi phút và mỗi ngày theo UTC; token dùng cho reasoning cũng được tính.
- Số yêu cầu đồng thời được giới hạn theo từng tổ chức và từng khóa.
- 429 với mã rate_limit_exceeded: chờ ít nhất số giây được chỉ định trong Retry-After. x-should-retry: false nghĩa là ngân sách trong ngày đã hết cho đến 00:00 UTC.
- Theo dõi x-ratelimit-remaining-requests và x-ratelimit-remaining-tokens (cùng các phiên bản -day của chúng) để giảm tốc độ từ sớm.