Alat untuk developer

Bangun dengan Reflection Beam

Rencanakan GPU untuk hosting mandiri, perkirakan token dan biaya, buat kode API yang siap digunakan, dan siapkan coding agent Anda. Setiap angka mengacu pada dokumentasi Reflection sendiri.

Mulai dengan generator kode Perencana memori GPU

Hal-hal penting

ID model
Beam-501B-A23B
URL dasar
https://api.reflection.ai/openai/v1
Parameter
501B total, 23B aktif
Jendela konteks
262,144 token
Output maksimum
131,072 token
Tingkat reasoning
low · medium · high · xhigh · max

Tools

Permintaan pertama Anda dalam 30 detik

API ini mengikuti OpenAI Chat Completions, jadi OpenAI SDK resmi dapat digunakan setelah Anda mengganti URL dasar dan kunci API.

bash
pip install openai
export REFLECTION_API_KEY="<your API key>"
python
import os
from openai import OpenAI

client = OpenAI(
    base_url="https://api.reflection.ai/openai/v1",
    api_key=os.environ["REFLECTION_API_KEY"],
)

messages = [
    {"role": "user", "content": "Explain the difference between a process and a thread in three sentences."},
]

completion = client.chat.completions.create(
    model="Beam-501B-A23B",
    messages=messages,
    reasoning_effort="medium",
)

message = completion.choices[0].message
print("Reasoning:", getattr(message, "reasoning_content", None))
print(message.content)

Enam hal yang sering membuat orang bingung

Reasoning tidak bisa dinonaktifkan

Beam selalu melakukan reasoning. reasoning_effort menentukan tingkatnya, dari low hingga max, dengan medium sebagai nilai default. Nilai seperti none atau minimal akan menghasilkan error 400.

Kirim reasoning kembali

Dalam chat multi-giliran dan pemanggilan tool, sertakan kembali setiap pesan assistant sebelumnya beserta reasoning_content-nya. Tanpanya, API akan menjawab dengan error 400 missing_required_parameter.

Reasoning menghabiskan jatah token Anda

Token reasoning dihitung dalam max_completion_tokens. Jika nilainya terlalu rendah, Anda akan mendapat finish_reason "length" dengan jawaban kosong.

Hanya teks, hanya Chat Completions

Tidak mendukung input gambar, audio, atau file, maupun API Responses, Embeddings, atau Batch. Agent harus menggunakan penyedia Chat Completions yang kompatibel dengan OpenAI.

Beberapa parameter tidak berpengaruh

stop diterima tetapi diabaikan; n harus bernilai 1; logprobs dan logit_bias tidak didukung; user dan metadata akan menghasilkan error.

429 berarti tunggu, bukan langsung coba lagi

Batas berlaku per organisasi, per menit, dan per hari UTC. Patuhi Retry-After; x-should-retry: false berarti kuota harian sudah habis hingga 00:00 UTC.

Selengkapnya tentang Beam

FAQ

Bisakah saya mengunduh bobot Beam?

Belum. Reflection telah berjanji akan merilis bobot terbuka di bawah Apache 2.0 pada Oktober 2026. Sampai saat itu, Beam hanya tersedia melalui API beta dengan daftar tunggu.

Berapa banyak perangkat keras yang dibutuhkan untuk menjalankan sendiri?

Semua 501 miliar parameter harus muat di memori: sekitar 1 TB pada BF16, sekitar 500 GB pada FP8, dan sekitar 250 GB pada 4-bit, ditambah KV cache. Ini membutuhkan server dengan beberapa GPU; gunakan perencana memori untuk konfigurasi Anda.

Apakah API kompatibel dengan OpenAI SDK?

Ya, untuk Chat Completions dan Models. Arahkan SDK ke https://api.reflection.ai/openai/v1 dan gunakan ID model Beam-501B-A23B. Streaming, pemanggilan tool, dan output skema JSON didukung.

Berapa biaya API?

Reflection belum mengumumkan harga untuk versi beta. Kalkulator biaya memungkinkan Anda memasukkan harga sendiri dan menunjukkan pengaruh token penalaran terhadap total biaya.