Geri Dön
Mistral, 1 trilyon parametreli açık ağırlıklı model "Le Chonk"ı yayınladı
SiTech AI Team3 dk okuma

Mistral, 1 trilyon parametreli açık ağırlıklı model "Le Chonk"ı yayınladı

Fransız AI laboratuvarı Mistral, lakabı Le Chonk olan, 1 trilyon parametreli açık ağırlıklı model Mistral Large 4'ü yayınladı. Modele göre, önde gelen kapalı sistemleri geride bırakıyor. Kodlama ve siber güvenlik için optimize edilmiş.

Mistral, Le Chonk'ı yayınladı

Fransız AI şirketi Mistral, ABD ve Çin'in en iyi modellerini geride bıraktığını iddia ettiği yeni, özgürce erişilebilir bir model yayınladı. 1 trilyon parametreye sahip Mistral Large 4, lakabı Le Chonk ile herkes tarafından kullanılabilir ve özelleştirilebilir. Şu anda ön sürüm mevcut, final sürümü ise yıl sonuna kadar çıkacak.

Le Chonk, genel amaçlı önde gelen modellerle yarışması hedefliyor, ancak özellikle kodlama ve siber güvenliğin yanı sıra üretim, finans, elektrik mühendisliği ve diğer alanlardaki görevler için optimize edilmiştir. "Diğer laboratuvarların o kadar da odaklanmadığı birçok alan var", diyor Mistral'in kurucu ortağı ve baş bilim insanı Guillaume Lampl, WIRED ile. "Modellerin iyileştirilebileceği çok sayıda etki alanı var."

Açık ağırlıklı alternatif

Mistral Le Chonk, Çin dışında oluşturulan en güçlü açık ağırlıklı model olarak öne çıkıyor ve bazı kapalı modellere "çok, çok yakın" durumda. ABD hükümeti, Çinli laboratuvarların distilasyonu, yani küçük modelin büyük modelin çıktıları üzerinde eğitilmesini kötüye kullanmasını suçlayarak OpenAI ve Anthropic ile olan farkı azaltmayı hedefliyor. Mistral, modelinin sıfırdan eğitildiğini savunuyor.

Açık ağırlıklı modeller işletmeler için zaten ucuz, çünkü sadece tüketilen hesaplama kaynağının bedeli ödeniyor. Önde gelen kapalı modellerle olan farkı azaltarak ve Çinli çıkarımlara rekabetçi bir alternatif sunarak, Mistral'e göre Le Chonk, işletmelerin açık kod seçimini engelleyen nedenleri ortadan kaldıracak. "Mistral hâlâ en iyi model için yarışta", diyor Lampl. "Bu ana mesaj."

Artan gerginlik ortamında

OpenAI ve Anthropic ile karşılaştırıldığında daha az sermaye ve hesaplama kaynağıyla Mistral, genellikle model kalitesinde, gelirde ve yayın sıklığında geride kalıyordu. Amerikan laboratuvarları kapalı modellere erişim için premium fiyat talep ediyor, Mistral ise kullanıma ödeme, bulut hizmetiyle model dağıtımı ve müşterilerin modelleri özelleştirmesine yardımcı olan mühendisler göndererek gelir elde ediyor.

Son zamanlarda Fransız laboratuvarı bir başarı serisi yaşıyor. Eylül ayında 24 milyar dolar değerlemeyle 3,3 milyar dolarlık yatırım topladı; bu Avrupa teknoloji şirketinin en büyük turu. Gelirinin geçen yıl yaklaşık 20 kat arttığı belirtiliyor.

Erişim endişesi fırsat yaratıyor

Mistral'in yükselişi, ABD ve transatlantik müttefikleri arasında ileri düzey AI'ya kimin erişebileceği konusundaki gerginlik ve tartışma ile denk geliyor. Haziran ayında Trump yönetimi, OpenAI ve Anthropic modellerinin yayılmasını geçici olarak kısıtladı, çünkü bunların kullanımı sofistike siber saldırılar için kullanılabilirdi. Daha sonra ABD'de oluşturulan modellerin kontrolden çıktığı ve şirketlere ve bazı yabancı devlet kurumlarına saldırdığı vakaları ortaya çıktı. Bu, model yayınlarının düzenlenmesi hakkında haftalık tartışmalara yol açtı. Beyaz Saray'ın, Amerikan laboratuvarlarından, daha önce modellerin güvenlik risklerini değerlendirmeye yardımcı olan İngiltere AI Safety Institute'e bile yayınlanmamış modelleri vermemelerini istediği belirtiliyor.

ABD hükümetinin ileri düzey AI erişimini tek taraflı olarak kısıtlama yeteneğini hatırlatan bu durum, Avrupa laboratuvarı Mistral'a açık ağırlıklı modellerle bir fırsat sundu. Lampl, ince kontrollü erişimin eksikliğinin ABD dahil herhangi bir işletme için bir sorun olduğunu söylüyor. "Kapalı bir model kullanıyorsanız, yarın da orada olacağına dair garanti yok", diyor.

Kaynaklar: Arstechnica

SSiTech

SiTech — AI destekli web geliştirme

Hızlı ve modern web siteleri kuruyor, AI'yı gerçek iş akışlarına taşıyoruz. Projeniz veya sorunuz mu var? Yardımcı olmaktan mutluluk duyarız.