Yapay Zeka

Yapay zekâ liderlik tablosu Arena, 10 ayda değerlemesini 3,1 milyar dolara çıkardı

Yapay zekâ liderlik tablosu Arena, 10 ayda değerlemesini 3,1 milyar dolara çıkardı

Arena, 2023’te UC Berkeley’de araştırma projesi olarak başlayan ve yapay zekâ modellerinin sıralamasını topluluk katkısıyla yapan platform, Perşembe günü yaptığı açıklamada 3,1 milyar dolar değerlemeyle 200 milyon dolarlık Seri B yatırım turu kapattığını duyurdu.

Bu açıklama, şirketin haziranda yıllıklandırılmış gelirinin 100 milyon dolara ulaştığını bildirmesinin ardından geldi.

Tur, Lightspeed Venture Partners ve Khosla Ventures liderliğinde gerçekleşti; Salesforce Ventures, 01 Advisors, Dell Technologies Capital, Endeavor Catalyst, a16z, Felicis ve diğerleri katıldı. Arena daha önce ocakta 1,7 milyar dolar sonrası değerlemeyle 150 milyon dolarlık Seri A turunu açıklamıştı. O dönemde yıllık geliri 30 milyon dolardı. Böylece değerlemesi yaklaşık 10 ayda neredeyse ikiye katlandı.

Arena, tüketicilerin ücretsiz kullandığı topluluk tabanlı bir platform sunuyor. Kullanıcılar istem giriyor ya da vibe-coded projeler talep ediyor ve hangi modelin daha iyi iş çıkardığını puanlıyor. Şirket, aylık ziyaretçi sayısının on milyonlarla ifade edildiğini belirtiyor.

Geçen yılın eylül ayında şirket, model laboratuvarlarına ve şirketlere topluluk geri bildirimine dayalı detaylı performans analitiği sunan ticari ürün AI Evaluations’ı tanıttı. Zamanlama isabetli oldu. Bu yıl yapay zekâ laboratuvarları, modellerin kıyaslama testlerini oyunlaştırdığını, iyi puan toplamak için gerçek anlamda hak etmedikleri skorlar elde etme yolları bulduğunu fark etti. Aynı dönemde şirketler, standart kıyaslamalara güvenmek yerine kendi iç ihtiyaçları için hangi modelin en iyi çalıştığını belirlemede desteğe ihtiyaç duydu.

Şirketin finansman duyurusunda “Yapay zekâ, onu değerlendirme yeteneğimizden daha hızlı ilerliyor ve statik kıyaslamalar modeller test edildiğini fark ettiğinde çöküyor” denildi. Açıklamada ayrıca “Dünyanın, yapay zekânın gerçek insan kullanımında ne kadar güvenli ve uyumlu olduğunu ölçmek için tarafsız üçüncü bir tarafa ihtiyacı var. Arena bugün bu role giriyor” ifadelerine yer verildi.

Buna paralel olarak Arena, liderlik tablosuna yeni bir kategori ekledi: uyum. Bu kategoride modeller, yetkisiz eylem, yani istenmeyen eylemlerde bulunma; yanlış atıf, yani ifadelerin ya da gerçeklerin yanlış kaynağa bağlanması; ve şirketin “aldatıcı tamamlama” olarak adlandırdığı, yapmadığı görevleri tamamlamış gibi yalan söyleme gibi konular üzerinden sıralanıyor.

Şu anda ön uyum liderlik tablosunun başında OpenAI modelleri yer alıyor. Claude Opus 5.5 altıncı, Claude Fable ise dokuzuncu sırada bulunuyor.

Kaynak: TechCrunch AI

Paylaş:

Yapay zekâ asistanları için: bu haberin Markdown (.md) sürümü