Kaynaklar
İş başında gör
Böyle hikâyelerin ardındaki modelleri ve stilleri keşfet — ücretsiz hesap, anında galeri.
Kataloğu keşfetBunu şununla konuş
Bir arkadaşını seç ve bu haber hakkındaki görüşünü öğren

Maya her yeni modeli benchmark'tan geçirir — önce rakamlar, asla abartı.
Böyle hikâyelerin ardındaki modelleri ve stilleri keşfet — ücretsiz hesap, anında galeri.
Kataloğu keşfetBir arkadaşını seç ve bu haber hakkındaki görüşünü öğren
Mistral AI, «Le Chonk» adını verdiği büyük bir açık ağırlıklı modeli yayımladı; şirket bu modelin OpenAI ve Google'ın en iyi kapalı kaynaklı modellerine eşdeğer olduğunu iddia ediyor — bu, sınır düzeyinde performansın tescilli ağırlıklar gerektirdiği varsayımına doğrudan bir meydan okumadır.
Ars Technica'nın haberine göre Mistral, Le Chonk'un şu anda mevcut en iyi yapay zeka modellerine meydan okuyabileceğini söylüyor. Şirket, model parametrelerinin tescilli bir API'nin arkasında kilitli kalmak yerine kamuya açık olduğu anlamına gelen açık ağırlıklı bir model olarak konumlandırıyor.
Bu ciddi bir iddia. 2024 ve 2025'in büyük bölümünde, en iyi açık ağırlıklı modeller ile en iyi kapalı modeller — GPT-4o, Claude 3.5 Sonnet, Gemini Ultra — arasındaki performans farkı gerçek iş akışlarında hissedilecek kadar genişti. Le Chonk bu farkı gerçekten kapatıyorsa, metin tabanlı istem oluşturma, karakter tanımı veya ajanlı iş akışlarına dayanan iş hatları kuran herkes için hesap değişiyor.
Uyarı: Mistral henüz bağımsız olarak doğrulanmış kıyaslama sonuçları yayımlamadı. Duyuruda aktarılan performans rakamları Mistral'ın kendi ölçümlerine dayanıyor. Üçüncü taraf değerlendirmeleri — MMLU, GPQA veya alana özgü yaratıcı yazarlık kıyaslamaları — iddiaları doğrulayana kadar sınır karşılaştırmasını yerleşik bir gerçek olarak değil, satıcı beyanı olarak değerlendirin.
Açık ağırlıklı bir model ile kapalı bir API arasındaki pratik fark göz ardı edilecek gibi değil. Kapalı modellerde her çıkarım çağrısı para eder, sağlayıcı fiyatlandırmayı değiştirebilir ya da modeli kullanımdan kaldırabilir ve ince ayar seçenekleri sınırlıdır. Açık ağırlıklarla bir yaratıcı veya küçük stüdyo modeli kendi donanımında çalıştırabilir, tüketici GPU'suna sığdırmak için nicellendirebilir ve özel bir veri kümesiyle ince ayar yapabilir — GPT-4o veya Gemini ile bu iş akışı mümkün değildir.
Yapay zeka sanat yaratıcıları için en acil kullanım alanı görüntü üretiminin kendisi değil (Le Chonk bir dil modelidir, difüzyon modeli değil), çevresindeki metin zekasıdır: ayrıntılı istemler yazmak, karakter arka planları oluşturmak, stil açıklamaları üretmek veya görüntü iş hatlarına beslenen ajanlı döngüler çalıştırmak. Gerçek anlamda sınır düzeyinde açık ağırlıklı bir model, bu metin katmanlarını daha ucuz ve daha denetlenebilir hale getirir.
Büyük açık modellerin nicellendirilmiş sürümleri rutin olarak 24 GB VRAM'li kartlarda çalışır. Le Chonk'un bu profile uyup uymadığı, Mistral'ın ilk duyuruda tam olarak açıklamadığı parametre sayısına bağlıdır. Bu rakam, yerel çıkarım planlayanlar için son derece önemlidir — 4 bit nicelendirmede 70B'lik bir model, aynı hassasiyette 400B'lik bir modelden çok farklı davranır.
Mistral'ın bu konuda güvenilir bir geçmişi var. Şirketin Mixtral 8x7B ve Mistral 7B modelleri yayımlandıklarında sınıf üstü performans sergiledi ve açık ağırlıklı sürümler, küçük ekiplerin yerel olarak çalıştırabildiklerini gerçek anlamda değiştirdi. Le Chonk'un adı gayri resmi, ancak strateji tutarlı: geliştirici güveni ve ekosistem benimsemesi oluşturmak için büyük ve yetenekli modelleri açık biçimde yayımlamak, ardından API ve kurumsal katmanlar aracılığıyla gelir elde etmek.
Yapay zeka görüntü oluşturma iş akışlarında Mistral modellerini zaten kullanan yaratıcılar bu kalıbı tanıyacaktır. Asıl soru, Le Chonk'un performansının bağımsız testlerde geçerli olup olmayacağı — ve topluluğun tüketici donanımı için optimize edilmiş nicellendirilmiş varyantları ne kadar hızlı ürettiğidir.
Mistral daha fazla teknik ayrıntının geleceğini söylüyor. Akıl yürütme ve talimat takibi kıyaslamalarındaki üçüncü taraf değerlendirmelerini takip edin; Le Chonk'un sınır etiketini hak edip etmediğini ya da seleflerinin işgal ettiği yetenekli-ama-tam-değil katmanına daha yakın düşüp düşmediğini ortaya koyacak gerçek sinyal bunlar olacak.