Blockchain & Kripto

OpenAI GPT-5.6 Sol'u Yayınladı: İşte Diğer Yapay Zeka Modelleriyle Karşılaştırması

OpenAI GPT-5.6 Sol'u Yayınladı: İşte Diğer Yapay Zeka Modelleriyle Karşılaştırması
Malta Mavi Lagün'de İngilizce

OpenAI'ın GPT-5.6 Sol modeli artık herkesin kullanımına açık. Şirket, yeni amiral gemisi modelini bugün genel kullanıcılara sunarken, iki küçük kardeş modeli Terra ve Luna'yı da aynı anda piyasaya sürdü. ABD Ticaret Bakanlığı, modelin ön izlemesini iki hafta boyunca yalnızca 20 güvenilir ortakla sınırlı tutmuştu.

OpenAI için bu isimlendirme stratejisi bir ilk. Şirket, modellerine sadece numara vermek yerine ilk kez isim veriyor. Sol, Terra ve Luna, kendi hızlarında ilerleyebilen yetenek seviyelerini temsil ediyor. Sol amiral gemisi model, Terra ise OpenAI'ın açıklamasına göre GPT-5.5 ile aynı performansı yarı fiyatına sunan günlük kullanım modeli. Luna ise en uygun fiyatlı seçenek.

Fiyatlandırma şöyle: Sol için milyon giriş token'ı 5 dolar, milyon çıkış token'ı 30 dolar. Luna'da bu rakamlar 1 dolar ve 6 dolara düşüyor. (Token, bir modelin işleyebileceği en küçük bilgi birimi ve şirketler genellikle API hizmetlerinde modellerini token başına fiyatlandırıyor.) Yeni modelle birlikte iki yeni özellik de geliyor: Sol'ün daha uzun düşünmesini sağlayan maksimum akıl yürütme çabası ve işleri alt ajanlara dağıtan ultra mod.

Karşılaştırma yapmak gerekirse: Anthropic, Claude Fable 5 için milyon giriş/çıkış token'ı başına 10/50 dolar, Google, Gemini 3.1 Pro için 2/12 dolar, xAI ise Grok 4.5 için 15/75 dolar alıyor.

Çin cephesinde ise DeepSeek, V4 Pro için 1,74/3,48 dolar, Xiaomi ise MiMo v2.5 Pro için sadece 1/5 dolar talep ediyor. Bu da Sol'ü Amerikan öncü modelleriyle Çin'in düşük maliyetli rakipleri arasında bir yere konumlandırıyor.

Kıyaslamalar ne gösteriyor?

Komut satırı iş akışlarını test eden ve bir modelin tamamladığı görevlerin oranını ölçen Terminal-Bench 2.1'de Sol, ultra yapılandırmada yüzde 91,9'a ulaştı. Standart Sol ise yüzde 88,8'de kaldı.

Bu sonuçlar, her iki sürümü de Anthropic'in Claude Mythos 5'inin (yüzde 88,0), Claude Fable 5'inin (yüzde 84,3) ve Claude Opus 4.8'inin (yüzde 78,9) önüne geçiriyor. Google'ın Gemini 3.1 Pro Preview'i ise yüzde 70,7 ile listenin sonunda yer aldı.

OpenAI en çok siber güvenlik alanında öne çıktı. Bir modelin yazılım güvenlik açıklarını ne kadar iyi bulup silah haline getirebildiğini ölçen ExploitBench'te Sol, kısıtlı Mythos Preview ile aynı seviyeye ulaşırken yaklaşık üçte bir oranında daha az token harcadı. OpenAI, Sol'ün kendi risk çerçevesinde "Siber Kritik" çizgisini henüz geçmediğini belirtiyor.

Uzun dönem Malta'da, üniversite destekli okullarda dilini geliştir. Kayıt bilgisi →

Kaynak: Decrypt