Teknoloji

Gemini 4 Argon, Google’ın geri dönüş modeli; ama şimdilik neredeyse kimse kullanamıyor

Google DeepMind’ın yeni modeli 1 milyon token’a kadar yazabiliyor, ancak önce yalnızca titizlikle seçilmiş siber savunuculara açılıyor
Adrian Kessler
Bizi Google'a ekleyin

Geçen yılın büyük bölümünde Google’ın yapay zekâ hikâyesi, piyasaya süremediği şeylerden ibaretti. Gemini 4 Argon bunun yanıtı ve onunla ilgili en çok şey anlatan unsur bir benchmark skoru değil. Davetli listesi. Google DeepMind’ın yeni öncü modeli, şirketin Fairwind Programı aracılığıyla önce titizlikle seçilmiş küçük bir siber güvenlik savunucuları grubuna gidiyor, başka hiç kimseye değil.

Argon uzun soluklu işler için tasarlandı: yazılım mühendisliği, hukuki ve finansal araştırma ve siber savunma. Temel mekanik değişiklik çıktı uzunluğunda: Model artık tek bir geçişte yüz binlerce token boyunca akıl yürütüp yazabiliyor; bu da büyük bir kod taşıma işini parçalardan birleştirmek yerine sonuna kadar götürmeye yetiyor.

Google, binlerce mühendisinin modeli şimdiden kullandığını söylüyor. Şirket duyuruda, veri merkezlerinde 300 TiB’tan fazla bellek boşaltan ve C ile C++ kodunu bellek açısından güvenli Rust diline taşıyan Argon ajanlarını anlatıyor; bu iş Fuchsia Zircon çekirdeğinin 800.000’i aşkın satırına kadar uzanıyor. Google’ın açık kaynaklı video çözücüsü libgav1’de Argon, elle optimize edilmiş 32.000 satırlık SIMD kodunu güvenli Rust ile yeniden yazdı; yeni kod, önceki Rust uyarlamasından 2,7 kat daha hızlı çalışıyor.

Bar chart comparing Gemini 4 Argon and Gemini 3.8 Flash Cyber on vulnerability discovery and the Wiz penetration test benchmark
Image: Google

Çıktı tavanı 64.000’den 1 milyon token’a çıkıyor. Benchmark rakamları Google’ın kendi verileri: DeepSWE v1.1’de %77,9, ekonomik ağırlıklı bilgi işini ölçen Vals Index’te birincilik ve uzun video anlama testi LVBench’te %91,7. VentureBeat’in derlemesine göre Argon açıklanan 18 benchmark’ın 12’sinde açık ara önde; OpenAI’ın GPT-6 Astra modeli ise FrontierSWE v2’de onu hâlâ on puandan fazla geride bırakıyor. Dış test uzmanları modeli çalıştırabilene kadar bunlar karar değil, iddia.

Siber güvenlik çerçevesi, erişim kısıtlamasını açıklıyor. Google, Argon’u güvenlik açıklarını kendi başına bulmak, doğrulamak ve yamamak üzere eğitti ve güvenilir savunuculara siber korumaları kaldırılmış bir sürüm verecek. Wiz’in Scan for Good girişimi kapsamında model, bir hastane yazılımında kişisel verileri açığa çıkaran ve önceki modellerin gözden kaçırdığı kritik bir açığı tespit etti. İşin rahatsız edici yanı şu: Açıkları kapatmakta bu kadar iyi olan bir model, tanımı gereği onları bulmakta da iyidir.

Dolayısıyla asıl hikâye güvenlik önlemleri. Google’a göre Argon siber saldırılara ve kimyasal, biyolojik, radyolojik ya da nükleer saldırılara yardım etmeyi reddediyor, şirketin istem enjeksiyonuna karşı bugüne kadarki en dayanıklı modeli ve düşünce zincirini izleyip kullanıcının niyetini aştığında yürütmeyi durduran bir denetleyicinin gözetiminde çalışıyor. Google ayrıca ABD hükümetinin gönüllü, yayın öncesi model erişim sürecine de katılıyor.

Gemini 4 Argon’u bugün kimler kullanabiliyor? Yalnızca Fairwind grubu ve Google’ın kendi ekipleri. Geliştiriciler, işletmeler ya da tüketiciler için bir tarih yok; erişim önce ücretli API müşterileri ve Google AI Ultra aboneleriyle başlayacak. Tanıtım fiyatı milyon girdi token’ı başına 2 dolar, milyon çıktı token’ı başına 10 dolar; bu rakamlar daha sonra 4 ve 20 dolara yükselecek.

Model 30 Eylül’de, Demis Hassabis’in ağustosta CEO’luktan ayrılmasının ardından Google DeepMind’ın başına geçen Koray Kavukcuoglu tarafından duyuruldu. Bu, Google’ın Kasım 2025’teki Gemini 3’ten bu yana ilk yeni amiral gemisi modeli; asıl sınavı ise bir sıralama değil, korumaları kaldırılmış hâlde sunulan bir modelin amaçlandığı ellerde kalıp kalmayacağı.

Etiketler: , , , , ,

Bizi Google'a ekleyin

Tartışma

S kadar yorum var.