OpenAI, yapay zeka ile sesli iletişimi daha akıcı hale getiren yeni GPT-Live modelini kullanıcılarla buluşturdu. İlk nesil ses özelliklerinden farklı olarak geliştirilen bu yeni altyapı, sohbetlerin sıradan bir robotik etkileşimden çıkıp gerçek bir insan konuşmasına yaklaşmasını hedefliyor. Yapay zeka sektöründe sesli Asistanların evrimi, son yıllarda metin tabanlı etkileşimlerin ötesine geçerek daha doğal bir iletişim biçimi sunmayı amaçlıyor. Bu bağlamda geliştirilen yeni ses altyapısı, insan-bilgisayar etkileşiminde uzun süredir hissedilen gecikme ve sıra bekleme gibi engelleri ortadan kaldırmayı hedefleyen önemli bir adım olarak öne çıkıyor. Günlük hayatın temposu içerisinde sesli asistanların daha verimli kullanılabilmesi, özellikle mobil cihazlarda pratik ve kesintisiz bir deneyim gerektiriyor.
Tam Çift Yönlü Mimari ile Kesintisiz İletişim

Daha önceki sesli modlar, konuşmaları sırayla işleyen bir yapı üzerine kuruluydu ve kısa duraklamaları cümlenin bittiği şeklinde yorumlayabiliyordu. Yeni GPT-Live modeli ise "full-duplex" yani tam çift yönlü bir mimari kullanıyor. Bu sayede sistem, siz konuşurken sizi dinlemeye devam ediyor ve kısa onay sesleri çıkarabiliyor. Sektörde tam çift yönlü iletişim olarak bilinen bu teknoloji, ses sinyallerinin aynı anda hem gönderilmesine hem de alınmasına olanak tanıyor. Böylece geleneksel telsiz mantığıyla çalışan eski nesil sistemlerin aksine, karşılıklı konuşma akışı kesintiye uğramadan, doğal bir tempo ile sürdürülebiliyor.
Uygulama, karmaşık sorularla karşılaştığında arka planda daha gelişmiş modellere veri aktarımı yaparak akışı bozmadan yanıt üretebiliyor. Konuşma esnasında ekranda hareketli bir küre beliriyor ve uygulama arka planda veya telefon kilitliyken bile çalışmayı sürdürüyor. Metin kutusunun sağındaki dalga biçimli ses simgesine dokunularak başlatılan bu süreç, kullanıcıların herhangi bir zorluk yaşamadan hızlıca sesli moda geçiş yapabilmesini sağlıyor.
Planlara Göre Model Seçenekleri ve Özelleştirme

Yeni ses altyapısı Android ve iOS uygulamalarının yanı sıra web tarayıcıları üzerinden de erişilebilir durumda. ChatGPT ekosistemindeki abonelik modellerine göre farklı sürümler sunuluyor. Pro, Plus ve Go aboneleri GPT-Live-1 sürümünden yararlanırken, ücretsiz plandakiler GPT-Live-1 mini sürümüne erişebiliyor. Bu yapılandırma, farklı kullanım yoğunluklarına ve ihtiyaçlara sahip kitlelerin sisteme erişimini dengeliyor.
Kullanıcılar, ayarlar menüsünden ses modelinin zeka düzeyini Instant, Medium veya High olmak üzere üç farklı seçenekten biri olarak belirleyebiliyor. Bununla birlikte, sistem şu aşamada ekran veya video paylaşımı özelliklerini desteklemiyor. Gelişmiş özelleştirme seçenekleri sunan platformda, kullanıcılar dilerlerse ayarlar bölümünden eski ses modeline diledikleri zaman geri dönebiliyor. Bu esneklik, yeni altyapıya geçiş yapmak istemeyen veya alışkanlıklarını değiştirmek arzusunda olmayan aboneler için bir alternatif oluşturuyor.

