Google, Gemini ailesinin yeni hızlı ve maliyet odaklı modeli Gemini 3.6 Flash’ı kullanıma sundu. Model, Gemini uygulamasının yanı sıra Gemini API, Google AI Studio ve geliştirici araçlarında erişime açıldı.
Şirket, Gemini 3.6 Flash’ın özellikle kod üretimi, uzun süreli ajan görevleri, bilgi çalışmaları, çok modlu içerikler ve bilgisayar kullanımı senaryolarında önceki Flash nesline göre geliştirildiğini belirtiyor.
Google’ın paylaştığı ölçümlere göre model, Artificial Analysis Index üzerinde Gemini 3.5 Flash’a kıyasla yüzde 17 daha az çıktı tokenı tüketiyor. Modelin çok aşamalı görevlerde daha az düşünme adımı, araç çağrısı ve konuşma turuyla sonuca ulaşması hedefleniyor.
Bu veriler büyük ölçüde Google’ın kendi testleri ve seçtiği değerlendirme koşullarına dayanıyor. Bağımsız kullanıcı testleri, gerçek maliyet ve kalite dengesinin farklı iş yüklerinde nasıl şekilleneceğini daha iyi gösterecek.
Neden önemli?
Yapay zekâ modellerinin yalnızca daha güçlü olması yeterli değil. Üretilen token sayısı, araç çağrıları ve görev başına maliyet; milyonlarca işlemin gerçekleştirildiği uygulamalarda doğrudan altyapı giderine dönüşüyor. Gemini 3.6 Flash’ın önemi, en büyük model olmaktan çok, kabul edilebilir kaliteyi daha düşük maliyet ve gecikmeyle sunma iddiasından kaynaklanıyor.
Kaynaklar
- Google — Introducing Gemini 3.6 FlashBirincil kaynak
- Google AI for Developers — Gemini 3.6 FlashTeknik birincil kaynak