Akıl yürütme kapatılamaz
Beam her zaman akıl yürütür. reasoning_effort, akıl yürütme miktarını low ile max arasında belirler; varsayılan değer medium'dur. none veya minimal gibi değerler 400 hatası döndürür.
Geliştirici araçları
Kendi sunucunuzda barındırmak için GPU planlayın, token ve maliyet tahmini yapın, çalışan API kodu oluşturun ve kodlama ajanınızı kurun. Her sayı, Reflection'ın kendi belgelerine dayanır.
Beam'in farklı sayısal hassasiyet ve bağlam uzunluklarında ne kadar VRAM'e ihtiyaç duyduğunu ve bunun için kaç GPU gerektiğini öğrenin.
02 / costAkıl yürütme içeren istek başına token sayısını, günlük istek hacmini hız sınırlarıyla karşılaştırmanızı ve kendi sunucunuzda çalıştırma maliyetini tahmin edin.
03 / codeAkış, araç çağrıları, JSON çıktısı ve çok turlu sohbetler için çalışan curl, Python ve TypeScript örnekleri.
04 / agentsBeam ile Mirror CLI, Pi, OpenCode ve Hermes Agent için kopyalamaya hazır kurulum.
API, OpenAI Chat Completions ile uyumludur. Bu nedenle temel URL'yi ve anahtarı değiştirdikten sonra resmi OpenAI SDK'ları çalışır.
pip install openai
export REFLECTION_API_KEY="<your API key>" import os
from openai import OpenAI
client = OpenAI(
base_url="https://api.reflection.ai/openai/v1",
api_key=os.environ["REFLECTION_API_KEY"],
)
messages = [
{"role": "user", "content": "Explain the difference between a process and a thread in three sentences."},
]
completion = client.chat.completions.create(
model="Beam-501B-A23B",
messages=messages,
reasoning_effort="medium",
)
message = completion.choices[0].message
print("Reasoning:", getattr(message, "reasoning_content", None))
print(message.content) Beam her zaman akıl yürütür. reasoning_effort, akıl yürütme miktarını low ile max arasında belirler; varsayılan değer medium'dur. none veya minimal gibi değerler 400 hatası döndürür.
Çok turlu sohbetlerde ve araç çağrılarında, önceki her assistant mesajını reasoning_content ile birlikte geri gönderin. Bu olmadan API, 400 missing_required_parameter hatası döndürür.
Akıl yürütme token'ları max_completion_tokens sınırına dahildir. Bu sınırı çok düşük ayarlarsanız finish_reason "length" olur ve yanıt boş döner.
Görsel, ses veya dosya girişi desteklenmez; Responses, Embeddings veya Batch API'leri de yoktur. Ajanlar, OpenAI uyumlu bir Chat Completions sağlayıcısı kullanmalıdır.
stop kabul edilir ancak yok sayılır; n 1 olmalıdır; logprobs ve logit_bias desteklenmez; user ve metadata hata döndürür.
Sınırlar kuruluş başına, dakika başına ve UTC günü başına uygulanır. Retry-After değerine uyun; x-should-retry: false, günlük bütçenin 00:00 UTC’ye kadar tükendiği anlamına gelir.
Henüz değil. Reflection, Ekim 2026’nın ilerleyen günlerinde Apache 2.0 kapsamında açık ağırlıkları kullanıma sunmayı taahhüt etti. O zamana kadar Beam’e yalnızca bekleme listesiyle erişilen beta API üzerinden ulaşılabilir.
501 milyar parametrenin tamamı belleğe sığmalıdır: BF16 için yaklaşık 1 TB, FP8 için yaklaşık 500 GB ve 4 bit için yaklaşık 250 GB; KV cache için gereken alan bunlara dahil değildir. Bu, birden fazla GPU içeren bir sunucu gerektirir; kurulumunuzu planlamak için bellek planlayıcısını kullanın.
Chat Completions ve Models uç noktaları için evet. SDK’nın adresini https://api.reflection.ai/openai/v1 olarak ayarlayın ve model kimliği olarak Beam-501B-A23B’yi kullanın. Akış, araç çağırma ve JSON şema çıktıları desteklenir.
Reflection, beta sürümü için fiyatları henüz yayımlamadı. Maliyet hesaplayıcısına kendi fiyatınızı girebilir ve akıl yürütme tokenlarının toplamı nasıl etkilediğini görebilirsiniz.