Hoşgeldin Misafir

Google’dan Yapay Zekâ Dünyasını Sarsacak Gemini 4 Argon Hamlesi 1 Milyon Token ve Siber Güvenlikte Yeni Dönem

Graves

Graves

Karanlık Özgürlüktür
Forum Yöneticisi
9 Eki 2024
10,705 Mesaj
TIM Görevleri
2

Aktiflik

Seviye

Deneyim

TIM / GÖREV:
haber-kapak.webp


Google’dan Yapay Zekâ Dünyasını Sarsacak Gemini 4 Argon Hamlesi: 1 Milyon Token ve Siber Güvenlikte Yeni Dönem

Google, şimdiye kadarki en iddialı yapay zekâ çalışmalarından biri olarak konumlandırdığı Gemini 4 Argon modelini duyurdu. Model; yazılım geliştirme, araştırma, finans, hukuk ve uzun süre devam eden karmaşık görevlerin yanı sıra özellikle siber güvenlik yetenekleriyle dikkat çekiyor. Ancak Argon, şimdilik herkesin kullanımına açılmış değil.


haber-ici-0.jpg


İlk Kullanıcılar Siber Savunma Ekipleri Olacak

Google, Gemini 4 Argon için doğrudan geniş çaplı bir lansman yerine kontrollü bir dağıtım modeli tercih ediyor. İlk aşamada Fairwind Programı içerisinde yer alan güvenilir siber savunma ekipleri modele erişebilecek. Böylece Argon'un gerçek dünyadaki kullanımından elde edilen sonuçlar değerlendirilirken güvenlik önlemlerinin de geliştirilmesi amaçlanıyor.

Google'ın kendi bünyesindeki kullanım ise çoktan başlamış durumda. Şirket çalışanlarının modeli hata ayıklama, araştırma, kod geliştirme ve kapsamlı kod dönüşümleri gibi görevlerde kullandığı belirtiliyor. Argon'un ajanları, özellikle C ve C++ tabanlı kodların Rust'a dönüştürülmesi çalışmalarında da aktif olarak kullanılıyor.


haber-ici-1.jpg


Rust Kodlarında 2,7 Kat Hız Kazancı

Argon'un yazılım tarafındaki kabiliyetlerini gösteren dikkat çekici örneklerden biri libgav1 projesinde ortaya çıktı. Modelin ajanları, Rust sürümündeki yaklaşık 32 bin satırlık SIMD kodunu yeniden düzenleyerek derleyicinin daha etkili vektörleştirme yapabileceği güvenli bir yapıya taşıdı.

Google'ın paylaştığı sonuçlara göre ortaya çıkan sürüm, önceki Rust uygulamasına kıyasla 2,7 kat daha yüksek performans sundu. Üstelik bu hız artışı sağlanırken üretilen video çıktısının aynı kaldığı ifade edildi. Bu durum, Argon'un yalnızca kod yazmakla kalmayıp mevcut yazılımların verimliliğini artırabilecek şekilde kullanılabildiğini gösteriyor.


1 Milyon Tokenlık Çıktı Sınırı

Gemini 4 Argon'un en çok konuşulacak teknik özelliklerinden biri ise 1 milyon tokenlık çıktı kapasitesi. Önceki Gemini modellerinde 64 bin token seviyesinde bulunan bu sınırın yaklaşık 16 katına çıkılması, modelin çok daha uzun ve karmaşık görevleri tek bir süreç içerisinde ele alabilmesinin önünü açıyor.

Bu kapasite özellikle büyük yazılım projelerinin incelenmesi, yüz binlerce token içeren belgelerin değerlendirilmesi ve uzun soluklu araştırma süreçlerinde önemli avantaj sağlayabilir. Google'ın hedefi, büyük görevleri çok sayıda küçük adıma bölmek yerine modelin daha geniş bir çalışma akışını kendi içerisinde yönetebilmesi.


haber-ici-2.jpg


Veri Merkezlerinde 300 TiB'tan Fazla Bellek Kazanımı

Google, Argon'un yalnızca yazılım geliştirme süreçlerinde değil, devasa altyapı sistemlerinde de kullanıldığını açıkladı. Model, veri merkezlerinden elde edilen profil verilerini analiz ederek bellek kullanımının azaltılabileceği noktaları belirledi.

Yapılan optimizasyonların ardından 300 TiB'tan fazla bellek serbest bırakıldığı belirtildi. Google, benzer çalışmaların daha geniş ölçekte uygulanması halinde toplam kazanımın 500 TiB ile 1 PiB arasında olabileceğini tahmin ediyor. Bu da Argon'un doğrudan donanım yatırımı yapmadan altyapı verimliliğini artırma potansiyeline işaret ediyor.


Kuantum Bilişimde Daha Az Kaynakla Sonuç

Modelin araştırma alanındaki kullanım örneklerinden biri de kuantum bilişim. Google, Argon'un kuantum bilgisayarlarla ilgili bir program üzerinde çalışırken daha önce yayımlanan temel sonuca göre yaklaşık %40 daha az hesaplama kaynağı gerektiren bir yaklaşım ortaya çıkardığını açıkladı.

Dikkat çekici noktalardan biri ise bu sonuca ulaşılması için yalnızca birkaç dakikalık bir sürenin yeterli olduğunun belirtilmesi. Google, bu tür sonuçların Argon'un araştırma süreçlerinde bir yardımcıdan daha fazlası olarak kullanılabileceğini düşünüyor.


haber-ici-3.jpg


Testlerde Güçlü Sonuçlar, Ancak Her Alanda Lider Değil

Google, Gemini 4 Argon'un farklı görevlerdeki performansını çeşitli benchmark sonuçlarıyla da destekledi. Uzun süreli yazılım mühendisliği görevlerini ölçen DeepSWE v1.1 testinde modelin %77,9 skor aldığı açıklandı. Uçtan uca iş süreçlerini değerlendiren AutomationBench testindeki sonuç ise %51,3 olarak paylaşıldı.

Uzun içeriklerin anlaşılması konusunda da dikkat çekici sonuçlar bulunuyor. Argon; grafikler, profesyonel görseller, uzun videolar ve farklı belgelerden gelen bilgileri birlikte değerlendirebiliyor. LVBench testinde açıklanan %91,7'lük skor da modelin uzun video analizindeki iddiasını güçlendiriyor.

Buna karşın Google'ın açıkladığı veriler Argon'un her benchmark'ta rakiplerini geride bırakmadığını da gösteriyor. Bazı bağımsız yazılım mühendisliği ve terminal odaklı testlerde modelin rakip çözümlerin altında kaldığı belirtiliyor. Dolayısıyla Argon'un gücü, tek bir benchmark skorundan ziyade çok farklı görevleri aynı model içerisinde gerçekleştirebilmesinde yatıyor.


Asıl Hedef: Siber Güvenlikte Savunma

Gemini 4 Argon'un en kritik kullanım alanı ise siber güvenlik olarak öne çıkıyor. Google, modeli güvenlik açıklarını tespit etmek, bulunan açıkları doğrulamak ve bunların giderilmesine yönelik çözüm veya yama geliştirmek gibi savunma amaçlı görevlerde kullanmayı hedefliyor.

Erken erişim programında yer alan kuruluşlardan biri olan Wiz tarafından gerçekleştirilen testlerde de dikkat çekici sonuçlar elde edildiği aktarılıyor. Google'a göre Argon, dünya genelindeki hastanelerde kullanılan sağlık yazılımlarından birinde hassas kişisel verilerin açığa çıkmasına yol açabilecek kritik bir güvenlik açığını tespit etti. Ancak şirket, söz konusu yazılımın adını ve açığın keşfedilme sürecinin tüm ayrıntılarını açıklamadı.


Güvenlik Testinde %68 Başarı

Argon, güvenlik açıklarının bulunması ve giderilmesine yönelik performansı ölçen CWE-bench v1 testinde %68 skor elde ederek liderliği paylaşıyor. Google ayrıca 20 farklı programlama dilini kapsayan karmaşık kod tabanları üzerinde yapılan şirket içi testlerde çok sayıda güvenlik açığının belirlenebildiğini ifade ediyor.

Modelin kaynak koduna doğrudan erişmediği Wiz testlerinde de saldırı yüzeyinin belirlenmesi, açıkların tespit edilmesi ve bulguların kanıtlarla desteklenmesi gibi alanlarda başarılı sonuçlar alındığı belirtiliyor. Bu nedenle Google'ın Argon'u ilk etapta sınırlı ve güvenilir kullanıcı gruplarıyla buluşturması özellikle önem taşıyor.


Gemini 4 Argon'un API Fiyatı Belli Oldu

Google, modelin API kullanımına yönelik bir tanıtım fiyatlandırması da açıkladı. Kampanya döneminde 1 milyon giriş tokenı için 2 dolar, 1 milyon çıkış tokenı için ise 10 dolar ücret alınacak.

Tanıtım döneminin sona ermesiyle birlikte fiyatların iki katına çıkması planlanıyor. Buna göre standart tarifede 1 milyon giriş tokenı 4 dolar, 1 milyon çıkış tokenı ise 20 dolar seviyesine yükselecek.

Modelin genel kullanıma açılacağı tarih ise henüz kesinleşmiş değil. Google'ın planı doğrultusunda ilk olarak güvenilir siber savunma ekiplerinden geri bildirim alınacak. Sonrasında erişimin ücretli API kullanıcıları ve Google AI Ultra abonelerine genişletilmesi, ilerleyen aşamalarda ise geliştiriciler, işletmeler ve bireysel kullanıcıların modele ulaşabilmesi hedefleniyor.


Google'ın Yeni Modeli Ne Vaat Ediyor?

Gemini 4 Argon, yalnızca daha yüksek benchmark skorları hedefleyen yeni bir model olmaktan ziyade uzun süreli görevleri yönetme, büyük kod tabanlarını analiz etme, altyapı optimizasyonu yapma ve siber güvenlik problemlerine müdahale etme üzerine kurulmuş geniş kapsamlı bir yapay zekâ sistemi olarak dikkat çekiyor.

Özellikle 1 milyon tokenlık çıktı kapasitesi ve siber güvenlik odaklı yetenekleri, modelin Google'ın yapay zekâ stratejisinde farklı bir noktaya yerleştirildiğini gösteriyor. Ancak genel erişim tarihi henüz açıklanmadığından, Argon'un gerçek dünyadaki performansını daha geniş kullanıcı kitlesinin deneyimleri belirleyecek.


Gemini 4 Argon, 1 milyon tokenlık kapasitesiyle yapay zekâ yarışında yeni bir eşik mi belirleyecek? Sizce Google'ın siber güvenlik odaklı yaklaşımı diğer yapay zekâ modellerine karşı önemli bir avantaj sağlayabilir mi?

Gemini 4 Argon, Google'ın yeni nesil yapay zekâ yaklaşımında uzun görevler, yazılım geliştirme, araştırma, altyapı optimizasyonu ve siber güvenlik gibi alanları tek bir çatı altında birleştirmeyi hedefliyor. Modelin geniş kullanıcı erişimine açılmasıyla birlikte ortaya çıkacak gerçek kullanım sonuçları ise merakla bekleniyor.