OpenAI, GPT-Live-1 Modelini Geliştirici API'sine Dahil Etti

Serdar HocamYazar & Editör

Yeni yapay zeka ses modeli, eş zamanlı dinleme ve konuşma yeteneklerinin yanı sıra kesintisiz akış ve araç entegrasyonu sunuyor.

◉ 0 okunma
Build more natural voice experiences with GPT‑Live‑1 in the API

OpenAI, daha doğal ses deneyimleri oluşturulmasını sağlayan GPT-Live-1 modelini geliştiricilerin kullanımına sundu.

GPT-Live-1 API Üzerinden Sunuldu

OpenAI, ses odaklı uygulamalar ve iş süreçleri geliştirmek isteyenler için yeni GPT-Live-1 modelini API üzerinden erisime acti.

Daha önce ChatGPT içerisinde duyurulan bu güçlü model, aynı anda hem dinleme hem de konuşma yapabilme kapasitesine sahiptir.

Gelişmiş Ses Yetenekleri ve Özellikler

Yeni sürüm, geliştiricilerin ses deneyimlerini yönlendirmesine ve kişiselleştirmesine olanak tanıyan bir odakla piyasaya sürüldü.

Sistem istemleri aracılığıyla ton, hız ve stil ayarlanabilirken, arka plan gürültüsü yönetimi de başarılı bir şekilde gerçekleştiriliyor.

Kesinti Yönetimi ve Araç Delegasyonu

Gelen ve giden sesleri tek bir model üzerinden işleyen yapı sayesinde kesinti yönetimi önceki sistemlere kıyasla belirgin biçimde iyileşti.

Model, daha derin akıl yürütme ve eylemleri GPT-6 Astra gibi arka uç metin modellerine ve araçlarına kolayca devredebiliyor.

Performans ve Maliyet Detayları

GPT-Live-1, Full Duplex Bench performansını GPT-Realtime-2.1 modeline göre 30 yüzde puanı oranında artırmayı başardı.

Ön uç ses katmanı için API'deki kullanım maliyeti ise dakika başına 0.05 dolar olarak belirlendi.