OpenAI, GPT-Live-1 Modelini Geliştirici API'sine Dahil Etti
Yeni yapay zeka ses modeli, eş zamanlı dinleme ve konuşma yeteneklerinin yanı sıra kesintisiz akış ve araç entegrasyonu sunuyor.
OpenAI, daha doğal ses deneyimleri oluşturulmasını sağlayan GPT-Live-1 modelini geliştiricilerin kullanımına sundu.
GPT-Live-1 API Üzerinden Sunuldu
OpenAI, ses odaklı uygulamalar ve iş süreçleri geliştirmek isteyenler için yeni GPT-Live-1 modelini API üzerinden erisime acti.
Daha önce ChatGPT içerisinde duyurulan bu güçlü model, aynı anda hem dinleme hem de konuşma yapabilme kapasitesine sahiptir.
Gelişmiş Ses Yetenekleri ve Özellikler
Yeni sürüm, geliştiricilerin ses deneyimlerini yönlendirmesine ve kişiselleştirmesine olanak tanıyan bir odakla piyasaya sürüldü.
Sistem istemleri aracılığıyla ton, hız ve stil ayarlanabilirken, arka plan gürültüsü yönetimi de başarılı bir şekilde gerçekleştiriliyor.
Kesinti Yönetimi ve Araç Delegasyonu
Gelen ve giden sesleri tek bir model üzerinden işleyen yapı sayesinde kesinti yönetimi önceki sistemlere kıyasla belirgin biçimde iyileşti.
Model, daha derin akıl yürütme ve eylemleri GPT-6 Astra gibi arka uç metin modellerine ve araçlarına kolayca devredebiliyor.
Performans ve Maliyet Detayları
GPT-Live-1, Full Duplex Bench performansını GPT-Realtime-2.1 modeline göre 30 yüzde puanı oranında artırmayı başardı.
Ön uç ses katmanı için API'deki kullanım maliyeti ise dakika başına 0.05 dolar olarak belirlendi.