Blog

Gemini 3.8 Live ve Extended Thinking artık Glytos’ta

16 Eylül 2026 · Glytos

Google, Gemini 3.8 Live ve Gemini 3.8 Live Extended Thinking’i 15 Eylül’de yayınladı. Bir gün sonra ikisi de Glytos’ta çalışıyordu. Bekleme listesi yok, kapalı beta yok: bir sesli ajanı açın, birini seçin, arayın.

İki model, iki ayrı iş

İkisi de konuşmadan konuşmaya model. Arayanı tek bir model duyuyor ve sesle cevap veriyor; konuşmayı birbirine aktaran ayrı servislerden oluşan bir zincir yok. Ayrıldıkları yer, ne için yapıldıkları.

Gemini 3.8 Live, Google’ın ölçek ve maliyet verimliliği için geliştirdiği model. Google onu çoğu düşük gecikmeli sesli ajan için varsayılan seçenek olarak tanımlıyor. Google’a göre model, desteklediği 97 dil arasında konuşmanın ortasında bile dili algılayıp geçiş yapabiliyor. Otuz farklı ses arasından seçim yapılabiliyor.

Gemini 3.8 Live Extended Thinking daha zor işler için: birkaç adımdan oluşan, cevabın hatırlanmak yerine akıl yürütülerek bulunması gereken görevler. Google onu aynı anda hem düşünen hem konuşan bir model olarak anlatıyor; yani model düşünürken konuşma durmuyor. Google’ın anlatımıyla, bir isteği erkenden “Hemen bakıyorum…” gibi bir cümleyle karşılıyor ve uzun bir görev sürerken arayanı gidişattan haberdar ediyor.

Glytos’taki GPT-Live’ın yanına ekleniyorlar; yani bir sesli ajan artık OpenAI’ın ya da Google’ın konuşma modeliyle çalışabiliyor.

Google’ın rakamları ne gösteriyor

Bu bölümdeki bütün rakamlar Google’ın. Testleri Artificial Analysis ve Sierra, her modeli yüksek düşünme ayarında çalıştırarak yaptı; Google da sonuçları değerlendirme metodolojisiyle birlikte yayınladı. Hiçbirini biz tekrarlamadık.

Artificial Analysis’in genel konuşmadan konuşmaya kalitesini ölçen Speech to Speech Index’inde Extended Thinking %82,6 ile ilk sırada. Gemini 3.8 Live %76,0 alıyor.

Artificial Analysis Speech to Speech Index: Gemini 3.8 Live Extended Thinking %82,6, GPT-Live-1 Astra %81,5, Grok Voice Think Fast 2.0 %81,3, Gemini 3.8 Live %76,0, Gemini 3.1 Flash Live yüksek düşünme ayarında %71,5 ve en düşük ayarda %63,9

Grafik: Google’ın duyurusu, veriler Artificial Analysis’ten.

Ajan görevlerinde tablo değişiyor. Burada modelin iyi bir sohbet sürdürmesi değil, bir işi sonuna kadar götürmesi gerekiyor. Artificial Analysis’in τ-Voice testinde Extended Thinking görevlerin %68,6’sını, Gemini 3.8 Live ise %30,1’ini tamamlıyor.

Artificial Analysis τ-Voice ajan performansı: Gemini 3.8 Live Extended Thinking %68,6, GPT-Live-1 Astra %67,9, Grok Voice Think Fast 2.0 %56,5, Gemini 3.1 Flash Live yüksek düşünme ayarında %37,7, Gemini 3.8 Live %30,1, Gemini 3.1 Flash Live en düşük ayarda %26,2

Grafik: Google’ın duyurusu, veriler Artificial Analysis’ten.

Sierra’nın τ³-Banking testi daha da zor. Ajanın büyük ve düzensiz bir bilgi tabanında yolunu bulması ve gerçekçi bir bankacılık talebini çözmek için arka arkaya birkaç araç çağrısı yapması gerekiyor. Extended Thinking burada %35,1 ile önde.

Sierra τ³-Banking sıralaması: Gemini 3.8 Live Extended Thinking %35,1, GPT-Live-1 Astra %32,0, xAI-Realtime %16,5, Gemini 3.1 Flash Live %11,3, GPT-Realtime 2 %10,3

Grafik: Google’ın duyurusu, veriler Sierra’dan.

Biz nasıl okuyoruz

Birkaç şey göze çarpıyor ve hiçbirini görmek için grafiklerden fazlası gerekmiyor.

Düşünmek, adımları olan aramalarda karşılığını veriyor. İki Gemini modeli arasındaki fark genel kalitede 6,6 puan. Ajan görevlerinde ise 38,5 puan ve Extended Thinking skoru iki katından fazlasına çıkarıyor. Gemini 3.8 Live o grafikte, yüksek düşünme ayarında çalıştırılan bir önceki neslin bile gerisinde kalıyor. Yani bunlar iyi ve daha iyi iki model değil; farklı işler için yapılmış iki model.

Zirvedeki fark dar. Artificial Analysis’in iki grafiğinde de bir sonraki model Extended Thinking’e bir puan kadar yakın, τ³-Banking’de ise fark üç puan civarında. Bu, önde giden grupta olmak demek; bir benchmark’taki bir puan, arayanın duyabileceği bir şey değil.

Çok adımlı sesli işler henüz çözülmüş değil. τ³-Banking’deki en iyi sonuç görevlerin üçte birini tamamlıyor. Ajan hangi modelle çalışırsa çalışsın, yanlış bir adımın pahalıya patladığı bir akış canlıya çıkmadan önce dikkatle test edilmeyi hak ediyor.

Akıcılık ve doğruluk birbirini çekiştiriyor. Aynı metodoloji belgesinde yayınlanan ServiceNow EVA-Bench’te Gemini 3.8 Live konuşma deneyiminde en yüksek skoru alıyor; Extended Thinking ise bu deneyimin bir kısmından doğruluk karşılığında vazgeçiyor. Bu, Google’ın 3.8 Live’ı varsayılan yapma önerisiyle de örtüşüyor.

Hangisini seçmeli

Gemini 3.8 Live ile başlayın. Arayanı karşılayan, soruları cevaplayan, potansiyel müşteriyi niteleyen ya da tek bir araçla randevu alan bir ajan, tam da onun için yapıldığı işi yapıyor. Google da onu akıl yürütmeden kaynaklanan gecikmeler olmadan cevap verecek şekilde geliştiriyor.

Aramanın kendisinin düşünmesi gerektiğinde Extended Thinking’e geçin: arka arkaya birkaç araç çağrısı, istisnaları olan bir politika ya da bilgi tabanının birden fazla yerinden bir araya getirilen bir cevap. Düşünmek emek istiyor; onu her yerde değil, aramanın gerçekten ihtiyaç duyduğu yerde kullanın.

Model, ajanın bir ayarı. Aynı ajanı ikisiyle de denemek bir şeyi yeniden kurmak değil, tek bir alanı değiştirmek demek.

Gerçek bir aramada nasıl

İkisini de aradık ve ikisi de doğal bir konuşma sürdürdü.

Yaptığımız kısa ve basit aramalarda ikisi birbirine oldukça benziyordu. Google’ın rakamları da bunu öngörüyor: ölçtükleri fark sohbette değil, çok adımlı görevlerde.

Bu bir ölçüm değil, birkaç aramadan çıkan bir izlenim. İki modeli de ölçmedik; almadığımız bir rakamı yayınlamaktansa hiçbir şey söylememeyi tercih ederiz.

Denemek için

Bir sesli ajanda model ayarlarını açın, konuşma motorunu Realtime’a alın ve sağlayıcı olarak Gemini Live’ı seçin. Ardından model olarak Gemini 3.8 Live’ı ya da Gemini 3.8 Live Extended Thinking’i seçin, bir ses belirleyip arayın. Ajanın sahip olduğu her şey çalışmaya devam ediyor: promptu, bilgi tabanı, araçları, telefon numarası.

Daha çok erken

Bu bir hüküm değil, bir ilk izlenim. Bir izlenimi iddiaya dönüştürecek ölçümler sonra gelecek ve geldiklerinde kendi yazıları olacak.

Gemini 3.8 Live ve Extended Thinking artık Glytos’ta · Glytos