Google, yapay zekâ modelleri ailesi Gemini'nin hızlı ve düşük maliyetli serisi Flash'ı güncellemeye devam ediyor. Üç hafta önce yayımlanan Gemini 3.7 Flash'ın ardından şirket, Gemini 3.8 Flash modelini tanıttı. Yeni model, özellikle yazılım mühendisliği, ajan tabanlı görevler ve çok adımlı akıl yürütme alanlarında önceki sürüme kıyasla kayda değer gelişmeler sunuyor.
Gemini 3.8 Flash'ın Performans İyileştirmeleri
Google, Gemini 3.8 Flash'ı şimdiye kadar geliştirdiği en akıllı iş gücü modeli olarak tanımlıyor. Şirketin açıkladığı verilere göre, model farklı kıyaslama testlerinde selefine göre ciddi performans artışı gösteriyor. Özellikle karmaşık mühendislik problemlerini otonom biçimde çözme yeteneği, Gemini 3.8 Flash'ı daha büyük ve maliyeti yüksek frontier modellerin önüne geçiriyor.
Yazılım Mühendisliği ve Profesyonel Alanlarda Üstünlük
DeepSWE v1.1 testi, Gemini 3.8 Flash'ın uzun süreli yazılım mühendisliği görevlerinde üstün performansını ortaya koyuyor. Google, bu başarının daha yüksek maliyetli modellerin sadece küçük bir maliyetine karşılık geldiğini belirtiyor. Ayrıca, finans ve hukuk alanlarında yapılan Vals Finance Agent V2 ve Harvey's Legal Agent Benchmark testlerinde de Gemini 3.8 Flash, önceki sürümü ve bazı frontier modelleri geride bırakıyor.
Çok Adımlı Akıl Yürütmede Kayda Değer İlerleme
Gemini 3.8 Flash, STEM, beşeri bilimler ve profesyonel alanlarda çok adımlı akıl yürütme yeteneklerini ölçen HLE-Verified testinde yüzde 54,9 skor elde etti. Bu sonuç, modelin karmaşık ve uzmanlık gerektiren görevlerde önemli bir gelişme kaydettiğini gösteriyor.
Google'ın Yapay Zekâ Stratejisinde Yeni Adım
Gemini 3.8 Flash'ın kısa sürede yayımlanması, Google'ın yapay zekâ alanındaki hızlı ilerleyişini ve maliyet-etkin çözümler sunma hedefini yansıtıyor. Şirket, bu modelle daha geniş uygulama alanlarında yüksek performans ve verimlilik sağlamayı amaçlıyor. Gelişmeler yakından takip ediliyor.





