Geliştirici araçları

Reflection Beam ile geliştirin

Kendi sunucunuzda barındırmak için GPU planlayın, token ve maliyet tahmini yapın, çalışan API kodu oluşturun ve kodlama ajanınızı kurun. Her sayı, Reflection'ın kendi belgelerine dayanır.

Kod oluşturucuyla başlayın GPU bellek planlayıcısı

Temel bilgiler

Model kimliği
Beam-501B-A23B
Temel URL
https://api.reflection.ai/openai/v1
Parametreler
Toplam 501B, etkin 23B
Bağlam penceresi
262,144 token
Maksimum çıktı
131,072 token
Akıl yürütme düzeyi
low · medium · high · xhigh · max

Araçlar

İlk isteğinizi 30 saniyede gönderin

API, OpenAI Chat Completions ile uyumludur. Bu nedenle temel URL'yi ve anahtarı değiştirdikten sonra resmi OpenAI SDK'ları çalışır.

bash
pip install openai
export REFLECTION_API_KEY="<your API key>"
python
import os
from openai import OpenAI

client = OpenAI(
    base_url="https://api.reflection.ai/openai/v1",
    api_key=os.environ["REFLECTION_API_KEY"],
)

messages = [
    {"role": "user", "content": "Explain the difference between a process and a thread in three sentences."},
]

completion = client.chat.completions.create(
    model="Beam-501B-A23B",
    messages=messages,
    reasoning_effort="medium",
)

message = completion.choices[0].message
print("Reasoning:", getattr(message, "reasoning_content", None))
print(message.content)

Kullanıcıların takıldığı altı nokta

Akıl yürütme kapatılamaz

Beam her zaman akıl yürütür. reasoning_effort, akıl yürütme miktarını low ile max arasında belirler; varsayılan değer medium'dur. none veya minimal gibi değerler 400 hatası döndürür.

Akıl yürütmeyi yanıtta geri gönderin

Çok turlu sohbetlerde ve araç çağrılarında, önceki her assistant mesajını reasoning_content ile birlikte geri gönderin. Bu olmadan API, 400 missing_required_parameter hatası döndürür.

Akıl yürütme token bütçenizi tüketir

Akıl yürütme token'ları max_completion_tokens sınırına dahildir. Bu sınırı çok düşük ayarlarsanız finish_reason "length" olur ve yanıt boş döner.

Yalnızca metin, yalnızca Chat Completions

Görsel, ses veya dosya girişi desteklenmez; Responses, Embeddings veya Batch API'leri de yoktur. Ajanlar, OpenAI uyumlu bir Chat Completions sağlayıcısı kullanmalıdır.

Bazı parametreler hiçbir etki yaratmaz

stop kabul edilir ancak yok sayılır; n 1 olmalıdır; logprobs ve logit_bias desteklenmez; user ve metadata hata döndürür.

429, hemen yeniden denemek yerine beklemeniz gerektiği anlamına gelir

Sınırlar kuruluş başına, dakika başına ve UTC günü başına uygulanır. Retry-After değerine uyun; x-should-retry: false, günlük bütçenin 00:00 UTC’ye kadar tükendiği anlamına gelir.

Beam hakkında daha fazla bilgi

SSS

Beam’in ağırlıklarını indirebilir miyim?

Henüz değil. Reflection, Ekim 2026’nın ilerleyen günlerinde Apache 2.0 kapsamında açık ağırlıkları kullanıma sunmayı taahhüt etti. O zamana kadar Beam’e yalnızca bekleme listesiyle erişilen beta API üzerinden ulaşılabilir.

Kendi sunucumda çalıştırmak için ne kadar donanım gerekir?

501 milyar parametrenin tamamı belleğe sığmalıdır: BF16 için yaklaşık 1 TB, FP8 için yaklaşık 500 GB ve 4 bit için yaklaşık 250 GB; KV cache için gereken alan bunlara dahil değildir. Bu, birden fazla GPU içeren bir sunucu gerektirir; kurulumunuzu planlamak için bellek planlayıcısını kullanın.

API, OpenAI SDK ile uyumlu mu?

Chat Completions ve Models uç noktaları için evet. SDK’nın adresini https://api.reflection.ai/openai/v1 olarak ayarlayın ve model kimliği olarak Beam-501B-A23B’yi kullanın. Akış, araç çağırma ve JSON şema çıktıları desteklenir.

API’nin maliyeti ne kadar?

Reflection, beta sürümü için fiyatları henüz yayımlamadı. Maliyet hesaplayıcısına kendi fiyatınızı girebilir ve akıl yürütme tokenlarının toplamı nasıl etkilediğini görebilirsiniz.