Google, Gemini 3.8 Live Modellerini Tanıttı

Google, sesli yapay zekâ etkileşimleri için Gemini 3.8 Live ve Gemini 3.8 Live Extended Thinking modellerini duyurdu. Yeni modeller, konuşmayı sürdürürken araç çağrıları yapabiliyor.

Google, Gemini 3.8 Live Modellerini Tanıttı
Kapak görseli yapay zeka ile üretilmiştir. Temsili görseldir; gerçek fotoğraf veya ürün çekimi değildir. Editoryal ilkeler

Google, gerçek zamanlı sesli etkileşimlere odaklanan iki yeni yapay zekâ modelini kullanıma sundu. Gemini 3.8 Live ve Gemini 3.8 Live Extended Thinking, kullanıcıyla konuşmayı sürdürürken görsel bağlamı değerlendirebiliyor, arka planda araç ve API çağrıları çalıştırabiliyor ve daha karmaşık görevleri yönetebiliyor.

Yeni modellerin temel farkı, yalnızca sorulara sesli yanıt vermekle sınırlı kalmamaları. Gemini 3.8 Live daha akıcı diyaloglar ve hızlı görevler için geliştirilirken, Extended Thinking sürümü çok adımlı işlemler sırasında düşünme ve konuşma süreçlerini paralel olarak yürütebiliyor. Böylece model, işlemin tamamlanmasını sessizce beklemek yerine kullanıcıya süreç hakkında sesli bilgi vermeyi sürdürüyor.

Gemini 3.8 Live, konuşma sırasında görev çalıştırıyor

Gemini 3.8 Live, sesli sohbeti görsel bağlamla bir araya getiriyor. Model, canlı diyalog sırasında 97 farklı dili otomatik olarak algılayabiliyor. Kullanıcı konuşma içinde dil değiştirdiğinde sistemin bu geçişi takip edebilmesi, farklı dillerin kullanıldığı görüşmeler ve etkileşimler açısından öne çıkan yeteneklerden biri olarak sunuluyor.

Model aynı zamanda konuşmayı kesmeden arka planda araç veya API çağrıları gerçekleştirebiliyor. Bu yaklaşım, sesli bir asistanın yalnızca hazır yanıtlar vermek yerine dış servislerle bağlantılı işlemleri de sohbet akışını bozmadan yürütmesine imkân tanıyor. Google, Gemini 3.8 Live modelini hız ve maliyet verimliliği odağıyla konumlandırıyor.

Extended Thinking modeli düşünürken konuşabiliyor

Gemini 3.8 Live Extended Thinking, daha karmaşık iş akışları için tasarlandı. Model, çok aşamalı bir isteği işlerken kullanıcıyla iletişimi kesmiyor. “Hemen kontrol ediyorum…” gibi doğal ifadelerle talebin alındığını doğruluyor ve arka plandaki işlemlerin ilerleyişi hakkında canlı geri bildirim sağlayabiliyor.

Bu yapı, özellikle birden fazla adımın tamamlanmasını gerektiren görevlerde sesli etkileşimi daha anlaşılır hâle getiriyor. Kullanıcı, yanıtın hazırlanmasını beklerken sistemin çalışmayı sürdürdüğünü duyabiliyor. Modelin paralel muhakeme yeteneği, sesli ajanların uzun süren işlemlerde sessiz kalması veya yalnızca işlem tamamlandıktan sonra yanıt vermesi sorununu azaltmayı hedefliyor.

Test sonuçları ve erişim seçenekleri

Google’ın paylaştığı sonuçlara göre Gemini 3.8 Live Extended Thinking, çeşitli ses ve ajan performansı testlerinde yüksek skorlar elde etti:

  • Artificial Analysis Speech to Speech Quality Index testinde 82,6 puanla genel sıralamada birinci oldu.
  • Big Bench Audio testinde yüzde 97,7 başarı oranına ulaştı.
  • Ajan tipi görev tamamlama performansını ölçen τ-Voice testinde yüzde 68,6 başarı elde etti.
  • Speech Agent Arena sıralamasında Gemini 3.8 Live ikinci sırada yer aldı.

Modeller, sesli ajanların değerlendirilmesine yönelik ServiceNow EVA-Bench testinde de doğruluk ve konuşma kalitesi arasındaki denge açısından değerlendirildi. Bu sonuçlar, Google’ın yeni modelleri yalnızca doğal konuşma üretimi için değil, görev tamamlayabilen sesli ajan altyapıları için de konumlandırdığını gösteriyor.

Geliştiriciler Gemini 3.8 Live ve Gemini 3.8 Live Extended Thinking modellerine Gemini API ve Google AI Studio üzerinden erişebiliyor. Kurumsal kullanıcılar için modeller Gemini Enterprise’ın ön izleme sürümünde sunuluyor. Bireysel tarafta ise Search Live, Gemini Live ve Google Workspace’in Docs, Gmail ve Keep gibi uygulamalarındaki yapay zekâ abonelikleri üzerinden kullanılabiliyor.

Google’ın yaklaşımı, sesli yapay zekâ deneyimini basit soru-cevap akışından araç kullanan ve işlem sürecini kullanıcıya aktarabilen etkileşimlere taşıyor. Özellikle konuşmayı sürdürürken arka planda çalışabilme yeteneği, yeni modellerin hem günlük kullanım hem de kurumsal sesli ajan senaryolarındaki rolünü belirleyen temel özellik olarak öne çıkıyor.

Günün zaman çizelgesi

Haber eklenme saatine göre sıralanır.

  1. Bugün
  2. Google, Gemini 3.8 Live Modellerini Tanıttı Bu haber
  3. Xbox Game Pass’e 6 Ekim’e Kadar Eklenecek 14 Oyun
  4. iOS 27’de Apple Intelligence İçin Gereken Alan 14 GB’a Çıktı
  5. Lenovo Yoga Slim 7X, 1.000 dolarlık bütçede öne çıkıyor
  6. Apple, iPhone 18 Pro ve Watch Series 12 için aksesuarları açıkladı
  7. FPGB Mini, Game Boy kartuşlarını cebinize taşıyor
  8. Xiaomi XRING 03, Windows oyun emülasyonunu güçlendirebilir
  9. Claude destekli araştırmayla OpenAI sistemlerine erişim sağlandı
  10. iOS 27 ile Apple Music’e iPhone için gelen 5 yeni özellik
  11. Stellantis, Sürücüsüz BOW Konsept Kargo Aracını Tanıttı
  12. Xiaomi 18 Pro’nun Arka Ekranı Yapay Zekâyla Uygulama Üretecek
  13. Samsung Galeri’ye Google Fotoğraflar yedekleme desteği geliyor
  14. WhatsApp, iOS’ta Sohbet İçi Arama İçin Yeni Buton Ekledi
  15. iPhone Duo videoları bölünmüş klavye ve çoklu görevi gösterdi
Burak
Yazar

Burak

Kurucu / Teknoloji Editörü

Burak, yazılım geliştirme, web teknolojileri, mobil uygulamalar, veritabanı sistemleri ve yapay zekâ üzerine çalışan bir teknoloji editörüdür. SanalData’nın kurucusu olarak yazılım, yapay zekâ, mobil teknolojiler ve teknoloji sektöründeki gelişmeleri izler ve değerlendirir.

Burak’ın tüm yazıları

Yorum yaz