Mistral'den Yeni Yapay Zeka Modeli 'Le Chonk': Ajan Yetenekleri ve Güvenlikte Çığır Açıyor

Mistral AI, yeni amiral gemisi modeli Mistral Large 4'ü ('le Chonk') tanıttı. Bu model, metin ve görüntü işleme yeteneklerini birleştirerek, özellikle ajan yetenekleri, siber güvenlik ve karmaşık kurumsal görevlerde üstün performans sergiliyor. Modelin, halüsinasyonları azaltan 'grounding' yeteneği ve 160'den fazla dildeki desteği öne çıkıyor.
Mistral'den Yeni Yapay Zeka Modeli 'Le Chonk': Ajan Yetenekleri ve Güvenlikte Çığır Açıyor

Mistral AI, son dönemde piyasaya sürülen Claude Opus 5.5 ve OpenAI'ın GPT-6 Sol ve Luna modellerinin ardından yeni bir amiral gemisi model olan Mistral Large 4'ü tanıttı ve bu modelin herkese açık önizlemesini Salı günü başlatacak. Açık kaynaklı ve açık ağırlıklı Büyük Dil Modelleri (LLM'ler) ile tanınan Fransız şirketi Mistral AI, Large 4 modelinin toplu metriklerde "dünyanın en iyi açık ağırlıklı modelleri arasında" yer aldığını ve Avrupa ile ABD modellerini geride bırakırken, açık ağırlık sektöründe baskın olan Çin rakiplerini de yakaladığını duyurdu.

Mistral AI'dan Baş Bilimci Guillaume Lample ve Bilim Başkan Yardımcısı Pierre Stock, yeni modelin sevgiyle "le Chonk" olarak adlandırıldığını belirterek, modelin özel yetenekleri ve olağanüstü hesaplama verimliliği hakkında bilgi verdi.

Lample ve Stock, Mistral Large 4'ün hem metin hem de görüntü işleyebilecek şekilde tasarlandığını ve bu sayede önceki Mistral modellerindeki performans boşluklarını kapattığını ifade etti. Large 4, özellikle siber güvenlik ve ajan yetenekleri konularında daha gelişmiş özelliklere ve imalat ile finansla ilgili görevleri daha iyi yönetme yeteneğine sahip.

Mistral Large 4, günlük kayıt incelemesi, kod denetimi ve yeni yayınlanan sömürü veya güvenlik açıkları kontrolü gibi savunma amaçlı siber güvenlik görevlerinde mükemmel performans göstermek üzere tasarlandı. Savunma tedbirlerinin ötesinde, yeni modelin zayıflıkları tespit etmek ve gidermek için saldırı amaçlı siber güvenlik önlemleri de sunduğunu belirtti.

Stock, "ML4 için odaklandığımız temel yetkinlik ajan yetenekleridir" dedi. Mistral Large 4, planlama, araştırma veya insan uzmanlarının saatler veya günler sürecek karmaşık kurumsal görevleri yerine getirmek için tasarlanmış ajan performansı üzerine yoğunlaştı. Mistral AI ekibi, modelin kodlama, analiz ve çekme istekleri gibi görevler için kullanılan SWE-bench ve Terminal Bench gibi karmaşık görevleri nasıl ele aldığını test eden değerlendirme çerçeveleri olan kritik ajan kıyaslamalarında "en son teknoloji" performansa ulaştığını belirtti.

Mistral ekibi, modelin hava ve uydu görüntüleri analizinde rakiplerini geride bıraktığını, orman yangınları gibi haritalardaki görsel desenleri ve nesneleri tanımlama kapasitesine sahip olduğunu söyledi.

Modelin basın bülteninde, "Grounding (Temellendirme) yeteneklerinde, kapalı modeller dahil tüm mevcut modelleri geride bırakıyor. Siber saldırılar hızlandıkça ve ucuzladıkça, şirketler her zamankinden daha fazla kod yazıyor ve dünya yapay zeka talebini karşılamak için daha fazla çipe ihtiyaç duyuyor. Bu nedenle bu özellikler kritik öneme sahip" denildi.

Grounding, LLM'lerin yanlış bilgi (halüsinasyon) üretmesini engellemek için kullanılan bir tekniktir. Bu teknik, yapay zekanın çıktılarını, yalnızca eğitildiği materyaller yerine belgeler ve veritabanları gibi harici kaynaklara dayandırarak sabitler. Grounding aynı zamanda verilerin ve bilgilerin güncel kalmasına yardımcı olurken, yapay zekanın yanıtları için bağlam sağlar.

Mistral, yeni modelin ayrıca Avrupa Birliği'nin tüm resmi dillerini, Latince ve Latin alfabesi dışındaki dilleri de dahil olmak üzere 160'dan fazla dilde eğitildiğini ve bu sayede komutlara yerel olarak yanıt verebildiğini ekledi.

Mistral, ML4'ü 27 Ekim'de yayınlayacak. O zamana kadar model, geliştiriciler, siber güvenlik uzmanları ve devlet yetkililerinden geri bildirim alarak Mistral ekibinin onu daha fazla değerlendirmesine olanak tanıyan bir genel önizleme süresi için mevcut olacak. Ekip ayrıca bu süreyi ek pekiştirmeli öğrenme ve ince ayar için de kullanacak. Önizleme API'sini buradan deneyebilirsiniz.

Yorum Yaz
Yorum yapabilmek için giriş yap veya üye ol.
Yorumlar