Google Gemini 4 Argon duyurdu: 1 milyon token çıkış ve siber savunmada yeni zirve
Google DeepMind, yazılım mühendisliği, finans, hukuk ve siber güvenlikte 'sınır ötesi' performans vaat eden Gemini 4 Argon modelini güvenilir siber savunucularla test etmeye başladı; model 1 milyon token çıkış limiti ve token başına 2 dolarlık giriş fiyatıyla öne çıkıyor.

Google DeepMind, yapay zeka modellerinin yeni nesilini temsil eden Gemini 4 Argon'u resmi olarak duyurdu. Model, karmaşık, uzun vadeli iş akışlarında derin mantık yürütme yeteneğiyle yazılım geliştirme, kurumsal bilgi işleri (hukuk, finans) ve siber güvenlik savunması alanlarında "sınır ötesi" (frontier) performans sergilemek üzere tasarlandı. İlk aşamada, Google'ın Fairwind Programı kapsamında seçilmiş siber güvenlik uzmanlarına sunulacak.
Yazılım ve kurumsal işlerde yeni ölçütler
Google mühendisleri, Argon'u günlük hata ayıklamadan büyük ölçekli kod tabanı göçlerine ve algoritma tasarımına kadar geniş bir yelpazede test etti. Model, gerçek dünya yazılım mühendisliği görevlerini ölçen DeepSWE v1.1 testinde %77,9 başarı oranıyla yeni bir durum (state-of-the-art) oluşturdu. Finans, kodlama, hukuk ve vergi alanlarındaki ekonomik etkileri ölçen Vals Index'te de lider konuma oturdu. Harvey'n Hukuk Ajanı Benchmark'i ve Vals Finans Ajanı v2 gibi alan özgü testlerde de öne çıktı. Zapier'in AutomationBench'te %51,3 ile birinci oldu.
1 milyon token çıkış: Uzun akışlar için endüstri lideri
Argon'un en dikkat çeken teknik özelliklerinden biri, çıkış token limitinin endüstri standardı olan 64K'dan 1 milyona çıkarıldığıdır. Bu genişleme, modelin tek bir oturumda yüz binlerce token üreterek derin düşünme ve çok adımlı karmaşık problemleri tek seferde çözme kapasitesini artırıyor. Uzun video anlama testleri olan LVBench'te %91,7 ile zirveye tırmanan model, görsel anlama yeteneğini profesyonel grafik analizi ve belge zincirleri üzerinden eyleme geçirme gibi işlere taşıyor.
Siber savunmada 'kılavuzsuz' çalışma yeteneği
Google, Argon'u siber güvenlik savunmasında son derece yetkin hale getirdi. Model, kritik yazılım zafiyetlerini özerk olarak bulabiliyor, doğruluyor ve yamalıyor. Güvenilir siber savunucular ve Google iç ekipleri için, modelin tam yeteneğini kullanabilmesi adına siber güvenlik kılavuzları (guardrails) kaldırılmış bir versiyon sunuluyor. Wiz'in "Scan for Good" girişiminde Argon, dünya genelindeki hastaneler tarafından kullanılan yazılımlarda hassas kişisel verileri ifşa eden kritik bir zafiyeti, önceki sınır modellerinin kaçırdığı şekilde tespit etti. CWE-bench v1 zafiyet giderme testinde %68 ile ilk sırayı paylaştı.
Güvenlik: Dört ana odak alanında güçlendirme
Yaygın kullanıma açılmadan önce Google, dört kritik alanda koruma katmanlarını artırdı: Kötüye kullanım engelleme (siber ve CBRN saldırıları), dolaylı prompt enjeksiyon saldırılarına dayanıklılık (Gray Swan IPI benchmark'ında lider), yanlış hizalanmayı izleme (zincir düşünce takibi) ve sistem sertleştirme (izole sandbox ortamları). Şirket, endüstrinin de reasoning şeffaflığını korumasını çağırdı.
Fiyatlandırma ve erişim takvimi
Argon, tanıtım fiyatıyla 1 milyon giriş token başına 2 dolar, 1 milyon çıkış token başına 10 dolar maliyetle sunulacak. Önbelleğe alınmış giriş tokenları ise giriş token fiyatının %95 indirimiyle (yani 1 milyon token başına ~0,10 dolar) işlenecek. Model, geliştiricilere, kurumsal müşterilere ve Google AI Ultra abonelerine başlayacak şekilde kademeli olarak açılacak; öncesinde güvenilir testçilerden geri toplanan verilerle kılavuzlar iyileştirilecek.
HaberGo Editor ve Muhabır ekibi
