Yapay Zeka

Mistral'dan "Le Chonk": en iyi yapay zekâ modellerine meydan okuyor

Mistral'dan "Le Chonk": en iyi yapay zekâ modellerine meydan okuyor

Yapay zekâya erişim konusunda gerilim artarken Fransız şirketi Mistral, ABD ve Çin'in en iyi modelleriyle rekabet edebileceğini iddia ettiği yeni bir modelini ücretsiz olarak kullanıma sundu.

Yeni 1 trilyon parametreli model Mistral Large 4, takma adıyla Le Chonk, herkes tarafından kullanılabiliyor ve özelleştirilebiliyor. Model şu anda ön izlemede; nihai sürümün ay sonuna kadar gelmesi bekleniyor. Le Chonk genel amaçlı önde gelen modellerle rekabet etmek üzere tasarlandı ancak özellikle kodlama ve siber savunma ile imalat, finans, elektrik mühendisliği ve diğer niş alanlardaki görevler için optimize edildi.

Mistral'ın kurucu ortağı ve baş bilim insanı Guillaume Lample, WIRED'e yaptığı açıklamada "Diğer laboratuvarların pek odaklanmayacağı çok sayıda alan var" dedi. Lample, "İyileştirilebilecek çok sayıda alan var" ifadelerini kullandı.

Mistral, Le Chonk'u Çin dışındaki en yetenekli açık ağırlıklı model olarak sunuyor ve "çok, çok yakın" olduğu bazı tescilli modellere işaret ediyor. ABD hükümeti Çinli laboratuvarları, OpenAI ve Anthropic ile performans farkını kapatmak için damıtma yöntemini kötüye kullanmakla suçlarken, Mistral modelini sıfırdan eğittiğini belirtiyor.

Açık ağırlıklı modelleri işletmenin maliyeti tükettikleri hesaplama kadar olduğu için işletmeler için şimdiden çok daha ucuz. Mistral'a göre önde gelen tescilli modellerle performans farkını azaltan ve Çin'den gelen yayınlara rekabetçi bir alternatif sunan Le Chonk, bir işletmenin açık kaynağı seçmekten çekinmesi için kalan birkaç nedeli ortadan kaldıracak.

"Mistral en iyi modeli elde etme yarışında" diyen Lample, "Bu ana mesaj" diye ekledi.

OpenAI ve Anthropic'e kıyasla daha az sermaye ve hesaplama kaynağına sahip olan Mistral, genel olarak model performansı, gelir ve yayın sıklığında geride kaldı. ABD laboratuvarları tescilli kapalı ağırlıklı modellerine erişim için prim talep ederken, Mistral bulut üzerinden model çalıştırma için öde-di-kullan ücreti alıyor ve müşterilerin modellerini özel ihtiyaçlarına göre ayarlaması için mühendis gönderiyor. Fransız laboratuvarı son dönemde ivme kazandı: Eylülde 3,3 milyar dolarlık bir yatırım turunu 24 milyar dolar değerleme ile kapattı; bu Avrupa teknoloji şirketleri arasında şimdiye kadarki en büyük yatırım turu oldu. Kazançlarının son bir yılda yaklaşık yirmi kat arttığı bildiriliyor.

Mistral'daki yükseliş, ABD ile Atlantik ötesi müttefikleri arasındaki gerginliğin artmasıyla aynı döneme denk geliyor. Gerginlik gümrük politikasından Grönland'a, Amerikan teknoloji firmalarının denetiminden, sınır teknolojisine kimin erişeceği tartışmasına kadar uzanıyor.

Haziranda Trump yönetimi, OpenAI ve Anthropic modellerinin dağıtımına geçici kısıtlamalar getirdi. Gerekçe, modellerin sofistike siber saldırıları başlatmak için kötüye kullanılabileceği endişesiydi. Bu tarihten sonra ABD yapımı modellerin kısıtlamalarını aşarak şirketlere ve bazı yabancı hükümet kurumlarına saldırdığı olaylar ortaya çıktı; bu durum model yayınlarının nasıl düzenlenmesi gerektiği konusunda haftalarca süren tartışmalara yol açtı. Beyaz Saray'ın Amerikan laboratuvarlarından, daha önce modellerin güvenlik riskleri açısından değerlendirilmesine yardımcı olan İngiltere'nin Yapay Zekâ Güvenliği Enstitüsü'ne bile yayınlanmamış modelleri vermemelerini istediği bildiriliyor.

ABD hükümetinin sınır teknolojisine erişimi tek taraflı olarak iptal edebileceği gerçeği, açık ağırlıklı modellere sahip Avrupa merkezli bir laboratuvar olan Mistral için bir fırsat yarattı.

Avrupa Siyaset Çalışmaları Merkezi'nde araştırmadan sorumlu direktör Andrea Renda, temmuzda WIRED'e yaptığı açıklamada "AB'nin teknolojik egemen olma kıtasal stratejisi... ve ABD'nin artan düşmanca tutumu, performansı etkileyici olmayan Mistral'ı birdenbire avantajlı bir konuma getiren sihirli bir formül" dedi.

Sadece yerel pazarına hizmet etmekle sınırlanmak istemeyen Mistral, yapay zekâ modellerine erişim üzerinde ince ayarlı kontrol eksikliğinin bir işletmenin bulunduğu yere bakılmaksızın sorun olabileceğini, hatta ABD'de bile olabileceğini vurgulamak istiyor. Lample'ye göre siber tehditleri savuşturmak için tescilli bir modele güvenen bir işletme, savunmalarının aniden çökme riskini taşır.

Lample, "Bazen insanlar ABD'ye, Avrupa'ya, Çin'e büyük anlam yüklemeyi seviyor. Ama gerçekten önemli olan modelin size ait olması—ABD şirketleri için bile" dedi. "Kapalı bir model kullanırsanız, yarın da orada olacağına dair bir garanti yok" diye ekledi.

Kaynak: Ars Technica

Paylaş:

Yapay zekâ asistanları için: bu haberin Markdown (.md) sürümü