Eylül 2026
12 DAKİKA OKUMA
8.940 görüntülenme

Google Gemini 3.8 Flash ve 3.8 Flash Cyber Duyuruldu: Otonom Kodlama, Siber Güvenlik ve Ajan Mimarisinde Yeni Çağ

Google Gemini 3.8 Flash ve Gemini 3.8 Flash Cyber Tanıtımı 2026

"Gemini 3.8 Flash, karmaşık problemlerde daha fazla akıl yürütme adımı atarak ve araçları döngüsel çağırarak çok daha disiplinli çalışır. 3.8 Flash Cyber ise savunucuları saldırganların bir adım önüne geçirmek için zafiyet tespitinden otomatik yamalamaya kadar sınıfının en iyisidir."

Yazılım Mühendisliği ve Siber Güvenlikte Çığır Açan İkili Model Mimarisi

Google DeepMind, yapay zeka yarışında çıtayı yeniden belirliyor. Gemini 3.7 Flash duyurusunun üzerinden yalnızca üç hafta geçmişken ve son altı hafta içindeki üçüncü Flash lansmanına imza atan Google; bugün bugüne kadarki en yetenekli akıl yürütme, otonom kodlama ve siber güvenlik modeli olan Gemini 3.8 ailesini resmen tanıttı. Tanıtılan iki yeni varyant teknoloji dünyasında büyük heyecan yarattı: • Gemini 3.8 Flash: Yazılım mühendisliği, uzun ufuklu ajantik iş akışları (agentic workflows) ve çok adımlı kritik akıl yürütmede amiral gemisi frontier modelleri geride bırakan genel iş beygiri. • Gemini 3.8 Flash Cyber: Otonom zafiyet tespiti ve otomatik yama (patching) kabiliyetiyle savunmacılara (defenders) yapay zeka çağında asimetrik bir üstünlük sağlayan ve Fairwind Programı kapsamında güvenilir kurumlara sunulan özel siber güvenlik modeli. En önemlisi; her iki model de selefi 3.7 Flash ile aynı ezber bozan fiyatlandırmayla sunuluyor: 1 milyon girdi tokenı için $0.75 ve 1 milyon çıktı tokenı için $3.75. Nexentio ekibi olarak Google DeepMind'ın paylaştığı resmi verileri, bağımsız benchmark grafiklerini ve geliştirici ekosistemine etkilerini derinlemesine masaya yatırdık.
%
CyberGym C/C++ Pass@1
%
20 Dilde Zafiyet Keşfi
%
Vals Finance Agent v2
%
Gray Swan IPI (En Güvenli)

1. Ortak Zeka Çekirdeği ve 'Daha Çok Çalışan' (Works Harder) Model Felsefesi

Gemini 3.8 Flash ve Gemini 3.8 Flash Cyber, özelleştirilmiş farklı dağıtım ortamları için yapılandırılmış olsalar da güçlerini aynı kurucu zeka çekirdeğinden almaktadır. Bu çekirdek, modelleri yinelemeli (recursive) olarak değerlendiren ve hassaslaştıran uzun soluklu ajantik döngülerle hızlandırılmıştır. Bu mimari sıçramanın temelinde Google DeepMind'ın radikal bir tasarım tercihi yer alıyor: 3.8 Flash daha çok çalışır (works harder). Karmaşık mühendislik ve mantık problemlerinde model, erken pes etmek veya tahmin yürütmek yerine ekstra akıl yürütme adımları yürütür, dahili araçları (tools) ısrarla ve döngüsel olarak çağırır. En yüksek çaba (effort) seviyelerinde model gerekirse daha fazla token tüketerek maksimum doğruluk üretir. Kaynak ve token tasarrufunun birincil öncelik olduğu basit senaryolarda ise geliştiriciler efor seviyesini düşürebilir ya da Gemini 3.7 Flash'ı kullanmaya devam edebilir.

  • Ortak Temel Zeka: Zorlu siber güvenlik savunması eğitimleriyle güçlendirilen genel kodlama ve analitik muhakeme çekirdeği.
  • Yinelemeli Ajantik Döngüler (Recursive Loops): Modelin kendi ürettiği kod ve mantık çıkarımlarını otonom denetleyip düzelttiği feedback mekanizmaları.
  • Esnek Efor Seviyeleri (Effort Levels): Token maliyeti ile çözüm derinliği arasında geliştiriciye tam denetim imkanı.

2. Uzun Ufuklu Kodlama (Long-Horizon SWE) ve Google Antigravity Başarısı

Gemini 3.8 Flash, yazılım mühendisliği alanında sektör standardı haline gelen DeepSWE v1.1 (Long-Horizon Software Engineering) kıyaslamasında, kendisinden katbekat büyük ve yüksek maliyetli frontier modelleri geride bırakarak karmaşık mühendislik görevlerini uçtan uca otonom şekilde çözebildiğini kanıtladı. Modelin Google ekosistemindeki yeni nesil geliştirme platformu Google Antigravity ile olan uyumu ise akıl almaz demolarla sergilendi: • Döngüsel İstemle 3D Kale Oyunu: Google Antigravity üzerinde tek bir döngüsel komutla (looping instruction), prosedürel bulmacalar ve Nano Banana ile üretilen görsel kaplamalar içeren oynanabilir tam bir 3D büyücü kale oyunu inşa etti. • DOS Tabanlı Google Maps: Yine Antigravity içinde tek bir istemle lokasyon arama, rota çizme ve Street View destekli fonksiyonel bir DOS Google Maps uygulaması modelledi. • Jeolojik Harita ve 2D/3D Kesit Analizi: U.S. Geological Survey (USGS) gerçek veri setlerini kullanarak coğrafi alanların anlık kesitlerini ve bilimsel açıklamalarını hesaplayan interaktif topografik harita motoru kodladı. • Hardware Anatomy (Donanım Anatomisi): Google AI Studio üzerinde Three.js kullanarak fiziksel oranlara sadık, cihaz katmanlarını patlatan ve kaydırıcıyla incelenmesini sağlayan 3D donanım görselleştiricisi geliştirdi.

  • Büyük ölçekli kod depolarında (codebase) onlarca dosyayı kapsayan bağımlılıkları tek seferde çözümleme.
  • Kendi kendini doğrulayan test yazımı, derleme hatalarını analiz etme ve CI/CD entegrasyonu.
  • Görsel referanslardan ve API dokümantasyonlarından anında interaktif Next.js ve Three.js bileşenleri üretme.

3. Finans, Hukuk ve Çok Adımlı Profesyonel Akıl Yürütme (Vals & Harvey)

Analitik ve dikey uzmanlık gerektiren profesyonel alanlarda Gemini 3.8 Flash, kurumsal ajanların güvenilirlik çıtasını yukarı taşıyor. Finansal analist görevlerini test eden Vals Finance Agent v2 kıyaslamasında %61.4 skor elde eden model; Claude Opus 5 (%58.6), Claude Sonnet 5 (%53.9), GPT-5.6 Terra (%54.4) ve GPT-5.6 Sol'u (%53.8) geride bırakarak zirveye yerleşti. Bunun yanında hukuk profesyonellerinin akıl yürütme süreçlerini ölçen Harvey's Legal Agent Benchmark testinde 3.7 Flash ve diğer frontier modellere fark atarken; fen bilimleri, beşeri bilimler ve profesyonel disiplinleri kapsayan HLE-Verified testinde elde ettiği %54.9 başarı ile çok adımlı muhakemedeki üstünlüğünü tescilledi.

  • Bilanço, gelir tablosu ve çoklu nakit akış tablolarında çapraz denetim ve risk analizi.
  • Hukuki metinlerde emsal karar ve mevzuat çelişkilerini otonom tespit etme yetisi.
  • Kurumsal karar vericiler için güvenilir, halüsinasyondan arındırılmış analitik raporlama.
Gemini 3.8 Flash - Vals Finance Agent v2 Benchmark Karşılaştırması

Gemini 3.8 Flash - Vals Finance Agent v2 Benchmark Karşılaştırması

4. Gemini 3.8 Flash Cyber: Siber Güvenlikte Otonom Zafiyet Tespiti

Günümüzün karmaşık siber tehdit ortamında savunmacıların en büyük handikapı zaman ve kaynak yetersizliğidir. Güvenilir kurumlara Fairwind Programı ile sunulan Gemini 3.8 Flash Cyber, Flash mimarisinin getirdiği hız ve düşük maliyet avantajıyla savunma ekiplerine benzersiz bir kabiliyet sunuyor. C ve C++ dillerinde yazılım zafiyetlerini keşfetme yeteneğini ölçen küresel endüstri standardı CyberGym Pass@1 benchmarkında model, %86.2 gibi rekor bir başarıya ulaştı. Bu skorla selefi 3.5 Flash Cyber'ı (%77.5) ve Mythos 5 (%83.8), GPT-5.6 Sol (%83.6) gibi dev frontier siber modelleri geride bıraktı.

Gemini 3.8 Flash Cyber - CyberGym Pass@1 C/C++ Zafiyet Tespiti

Gemini 3.8 Flash Cyber - CyberGym Pass@1 C/C++ Zafiyet Tespiti

Gerçek dünya savunma ihtiyaçları yalnızca C/C++ kodlarıyla sınırlı değildir. Google'ın 20 farklı programlama dilini kapsayan zorlu dahili zafiyet keşif testinde Gemini 3.8 Flash Cyber, %71.0 başarı oranına ulaşarak 3.7 Flash'ın (%58.9) ve 3.5 Flash Cyber'ın (%46.6) çok üzerinde bir sıçrama gerçekleştirdi.

5. 20 Programlama Dilinde Gerçek Dünya Zafiyet Keşfi Kıyaslaması

Aşağıdaki benchmark grafiğinde, modelin Python, JavaScript/TypeScript, Go, Rust, Java, C#, PHP ve Ruby dahil olmak üzere endüstride en çok kullanılan 20 dildeki gerçek dünya zafiyet tespit performansı görülmektedir. Gemini 3.8 Flash Cyber, karmaşık kurumsal repolarda gizlenen güvenlik açıklarını tespit etmede %70 başarı barajını aşan ilk hafif ve hızlı model oldu.

  • SQL Injection, XSS, SSRF ve RCE gibi kritik web zafiyetlerini statik ve dinamik kod analiziyle yakalama.
  • Mikroservisler ve API mimarilerinde kimlik doğrulama (auth) bypass açıklarını haritalandırma.
  • Açık kaynak paket bağımlılıklarındaki sıfırıncı gün (zero-day) açıklarını önceden teşhis etme.
Gemini 3.8 Flash Cyber - 20 Programlama Dilinde Zafiyet Keşif Başarısı (%71.0)

Gemini 3.8 Flash Cyber - 20 Programlama Dilinde Zafiyet Keşif Başarısı (%71.0)

6. Otomatik Zafiyet Yamalama (Automated Patching) ve CWE-Bench Pareto Eğrisi

Google DeepMind, Gemini 3.8 Flash Cyber'ı geliştirirken stratejik bir prensip benimsedi: Saldırı (istismar/exploitation) yetenekleri yerine savunma ve yamalama (patching) yeteneklerini önceliklendirmek. Bu vizyon, siber saldırganların açık aradığı bir dünyada yazılım ekiplerinin açıkları saniyeler içinde onarmasını sağlıyor. Collinear tarafından yürütülen bağımsız yama kıyaslaması CWE-Bench Pass@1 vs. Cost per Rollout testinde Gemini 3.8 Flash Cyber, tam anlamıyla Pareto sınırında (Pareto frontier) yer alıyor: Model %47.2 Pass@1 başarı oranına rollout başına yalnızca yaklaşık $3.60 maliyetle ulaşıyor. En yakın rakibi Fable 5 ise %47.8 oranına ancak rollout başına $10'ın üzerinde (neredeyse 3 kat daha pahalı) bir maliyetle çıkabiliyor. GPT 5.6 Sol (%44.3), Opus 4.8 (%41.5) ve Gemini 3.7 Flash (%44.1) gibi modeller ise hem maliyet hem de başarı dengesinde geride kalıyor.

Model / ÇözümCWE-Bench Pass@1Ortalama Rollout MaliyetiPareto Verimlilik Durumu
Gemini 3.8 Flash Cyber%47.2~$3.60Pareto Sınırında (En Yüksek F/P)
Fable 5%47.8>$10.30Yüksek Başarı / Çok Yüksek Maliyet
GPT 5.6 Sol%44.3~$2.20Orta Düzey Doğruluk
Gemini 3.7 Flash%44.1~$0.75Ultra Düşük Maliyet / Hızlı Dağıtım
Opus 4.8%41.5~$2.60Eşik Altı Performans
Grok 4.6%37.8~$1.80Düşük Yama Doğruluğu
DeepSeek V4 Flash%30.5~$0.20Yetersiz Kritik Zafiyet Onarımı
Gemini 3.8 Flash Cyber - CWE-Bench Pass@1 vs. Rollout Başına Maliyet Pareto Eğrisi

Gemini 3.8 Flash Cyber - CWE-Bench Pass@1 vs. Rollout Başına Maliyet Pareto Eğrisi

7. Gerçek Dünya Testleri: Google, Wiz ve Chrome Güvenliğini Korumak

Gemini 3.8 Flash Cyber laboratuvar ortamından çıkıp gerçek dünyada Google ve kurumsal ortaklarının kod tabanlarını korumaya başladı bile: • Chrome Güvenlik Ekibi: Yapılan testlerde 3.8 Flash Cyber modelinin, sektördeki kendisinden çok daha büyük ticari frontier modellere kıyasla Chrome zafiyetlerine 2.6 kat daha fazla doğru yama ürettiğini raporladı. • Wiz (Bulut Güvenlik Lideri): Wiz'in dahili sızma testi (penetration testing) kıyaslamasında model; diğer öncü frontier modellere kıyasla 2.3 ila 5.2 kat daha düşük maliyetle +%7.5 ila +%9.7 daha yüksek yakalama oranı (recall) elde etti. • Google Cloud Zafiyet Araştırma Grubu: Normal şartlarda keşfedilmesi ve haritalandırılması aylar süren kritik bir altyapı zafiyetini 2 saatten kısa bir sürede otonom olarak ortaya çıkardı.

  • Büyük ölçekli tarayıcı motoru (Chromium) ve işletim sistemi çekirdeklerinde anlık yama doğrulama.
  • Bulut altyapılarında (AWS, GCP, Azure) yanlış yapılandırmaları ve IAM yetki yükseltme açıklarını otomatik kapatma.
  • Siber olay müdahale (Incident Response) ekiplerinin inceleme sürelerini aylardan saatlere indirme.

8. Gray Swan IPI Kıyaslaması ve İstem Enjeksiyonuna (Prompt Injection) Karşı Savunma

Yapay zeka ajanlarının web sayfalarından, e-postalardan veya harici veritabanlarından veri çekerken karşılaştığı en sinsi tehdit Dolaylı İstem Enjeksiyonudur (Indirect Prompt Injection - IPI). Kötü niyetli aktörlerin ajanı manipüle etmesini engelleyen güvenlik dayanıklılığını ölçen Gray Swan IPI benchmarkında Gemini 3.8 modelleri devasa bir zafer elde etti. Saldırı başarı oranının (Attack Success Rate - ASR) düşük olmasının üstün güvenlik anlamına geldiği testte: • Gemini 3.8 Flash: Yalnızca %5.5 saldırı başarı oranıyla genel modeller arasında sektör lideri oldu. • Gemini 3.8 Flash Cyber: Yalnızca %6.0 ASR ile mutlak güvenilirlik sundu. Buna karşılık DeepSeek V4 Pro (%60.1), Kimi K3 (%52.7), Grok 4.6 (%51.8) ve GPT 5.6 Luna (%50.0) gibi modellerin saldırılara karşı ne kadar savunmasız olduğu gözler önüne serildi. Gemini 3.8 modelleri ayrıca Google'ın Sınır Güvenliği Çerçevesi (Frontier Safety Framework) uyarınca Kimyasal, Biyolojik, Radyolojik ve Nükleer (CBRN) istismarlara karşı sıkı korumalarla sevk edilmektedir.

  • Görünmez metinler, gizli HTML etiketleri ve zararlı prompt manipülasyonlarına karşı tam direnç.
  • Otonom ajanların harici API'leri yetkisiz veya kontrolsüz tetiklemesini önleyen güvenlik filtreleri.
  • Finansal ve kişisel verilerin ajantik sızıntılara (data exfiltration) karşı donanımsal düzeyde korunması.
Gemini 3.8 Flash ve Cyber - Gray Swan IPI Saldırı Başarı Oranı Karşılaştırması

Gemini 3.8 Flash ve Cyber - Gray Swan IPI Saldırı Başarı Oranı Karşılaştırması

9. Geliştiriciler, İşletmeler ve Güvenlik Ekipleri İçin Erişim Yolları

Google, Gemini 3.8 ailesini bugünden itibaren tüm ekosisteme kademeli olarak açıyor: • Yazılım Geliştiriciler: Google Antigravity ile ajantik iş akışları oluşturabilir; Google AI Studio ve Android Studio üzerinden API çağrıları yapabilir; Stitch ile anında UI bileşenleri üretebilir. • Kurumsal İşletmeler: Gemini Enterprise üzerinden çok modlu ajan platformunu şirket içi sistemlerine entegre edebilir. • Bireysel Kullanıcılar: Google AI Pro ve Ultra aboneleri Gemini mobil uygulamasında, Google Search AI Mode içinde ve Google Sheets üzerinde 3.8 Flash zekasından hemen faydalanabilir. • Siber Güvenlik Savunucuları: Fairwind Programı üzerinden kamu otoriteleri, kritik altyapı sağlayıcıları ve açık kaynak kütüphane yöneticileri Gemini 3.8 Flash Cyber için öncelikli erişim başvurusunda bulunabilir.

Özellik / YetenekGemini 3.7 FlashGemini 3.8 FlashGemini 3.8 Flash Cyber
1M Girdi / Çıktı Token Fiyatı$0.75 / $3.75$0.75 / $3.75Fairwind Programı Kapsamında
CyberGym C/C++ Pass@1%77.5 (3.5 Cyber)%81.0%86.2 (Sektör Zirvesi)
20 Dilde Zafiyet Keşfi%58.9%63.2%71.0 (Rekor Başarı)
CWE-Bench Pass@1%44.1%45.0%47.2 (Pareto Sınırında)
Vals Finance Agent v2%59.0%61.4 (Lider)%58.5
Gray Swan IPI Güvenlik Açığı%9.2%5.5 (En Güvenli)%6.0
Öncelikli Kullanım AlanıHızlı ve Verimli İş AkışlarıUzun Ufuklu Kodlama & AjanlarOtonom Zafiyet Tespiti & Yama

Sıkça Sorulan Sorular

Gemini 3.8 Flash ve 3.8 Flash Cyber nedir?

Google DeepMind tarafından 2 Eylül 2026 tarihinde duyurulan Gemini 3.8; otonom yazılım mühendisliği, uzun ufuklu ajantik akıl yürütme ve siber güvenlik zafiyet tespiti için geliştirilmiş en zeki ve en hızlı yeni nesil yapay zeka model ailesidir.

Gemini 3.8 Flash'ın kullanım maliyeti ne kadar?

Gemini 3.8 Flash, selefi 3.7 Flash ile birebir aynı tanıtım fiyatıyla sunulmaktadır: 1 milyon girdi (input) tokenı için $0.75 ve 1 milyon çıktı (output) tokenı için $3.75. Bu fiyat, benzer başarıya sahip frontier modellerden 3 ila 10 kat daha düşüktür.

Gemini 3.8 Flash Cyber kime açıktır ve Fairwind Programı nedir?

3.8 Flash Cyber, saldırganlara avantaj sağlamamak adına sadece yetkili savunuculara (hükümet güvenlik birimleri, kritik altyapı operatörleri ve açık kaynak yazılım sürdürücüleri) Google DeepMind Fairwind Programı başvuru onay süreciyle sunulmaktadır.

Prompt Injection (IPI) testlerinde Gemini 3.8 ne kadar başarılı?

Gray Swan IPI kıyaslamasında Gemini 3.8 Flash %5.5 ve 3.8 Flash Cyber %6.0 gibi olağanüstü düşük saldırı başarı oranı (ASR) elde etmiştir. Rakiplerinden DeepSeek V4 Pro %60.1, Grok 4.6 %51.8 ve GPT 5.6 Luna %50.0 oranında saldırıya maruz kalırken, Gemini 3.8 endüstrinin en güvenli modeli olduğunu kanıtlamıştır.

Google Antigravity ve Gemini 3.8 Flash birlikte neler yapabilir?

Google Antigravity ve Gemini 3.8 Flash; döngüsel talimatlarla tek bir komutta oynanabilir 3D oyunlar, Street View içeren tam fonksiyonel DOS Google Maps klonları, USGS veri setleriyle jeolojik topoğrafya haritaları ve interaktif Three.js web arayüzleri inşa edebilir.

Sonuç: Yapay Zeka Ajanları ve Güvenliğin Yeni Zirvesi

Gemini 3.8 Flash ve 3.8 Flash Cyber; sadece yeni kıyaslama rekorları kırmakla kalmıyor, yazılım geliştirmeden siber savunmaya ve kurumsal finans analizine kadar yapay zekayı pratik, güvenilir ve son derece ekonomik bir gerçekliğe dönüştürüyor. Nexentio olarak bizler; web mimarilerimizde, e-ticaret altyapılarımızda ve yapay zeka entegrasyonlu projelerimizde Google'ın en güncel teknolojilerini ilk elden uygulayarak müşterilerimize geleceğin dijital gücünü bugünden sunuyoruz.
Harekete Geçin

Yeni Nesil Yapay Zeka ve Güvenli Web Projeleriniz İçin Bizimle İletişime Geçin

İşletmenizin dijital potansiyelini birlikte keşfedelim. Hemen iletişime geçin, farkı birlikte yaratalım.

+
+

SONRAKİ ADIMLARINIZI
NETLEŞTİRMEK İÇİN
30 DAKİKALIK
ÜCRETSIZ GÖRÜŞME.

Benim işim size ayaküstü bir şey satmak değil; bu görüşmeden kafanızda 'net ve uygulanabilir bir planla' ayrılmanızı sağlamaktır. Telefonu kapattığınızda ne yapacağınızı biliyor olacaksınız.
Şule BakırMüşteri Deneyimi
Şule Bakır
Nexentio Arama Mockup