Google, Dolgu Kelimeleri Temizleyen Gemini 3.5 Transcribe Yapay Zeka Modelini Tanıttı
Geliştirilen yeni Gemini 3.5 Transcribe modeli, konuşma esnasındaki duraksama ifadelerini ayıklıyor, özel terminolojiyi tanıyor ve üç konuşmacıya kadar ses ayrımı yapabiliyor.
Google, ses kayıtlarındaki gereksiz aksamaları otomatik olarak temizleyen ve 85'ten fazla dili destekleyen yeni yapay zeka modeli Gemini 3.5 Transcribe'ı kullanıma sundu.
Gelişmiş Ses Metinleştirme Özellikleri
Google'ın duyurduğu Gemini 3.5 Transcribe modeli, önceki Chirp 3 modeline kıyasla çok dilli performans ve kelime hata oranlarında önemli bir ilerleme sergiliyor. Model, ses kayıtlarındaki duraksama kelimelerini otomatik olarak ayıklama ve metni doğal biçimlendirme imkanı veriyor.
Kullanıcılar sisteme özel bir kelime dağarcığı tanımlayarak teknik terimlerin ve özel yazımların manuel düzeltmeye gerek kalmadan doğru şekilde yazıya dökülmesini sağlayabiliyor. Ayrıca önceden kaydedilmiş seslerde üç konuşmacıya kadar ses kaynağı tespiti yapılabiliyor ve kelime düzeyinde zaman damgası eklenebiliyor.
Erişim Durumu ve Geliştirici Desteği
Gemini 3.5 Transcribe, macOS Gemini uygulamasında İngilizce dilinde ve Android'deki Rambler dikte özelliğinde belirli ülke ile dillerde kullanıma sunuldu. Geliştiriciler ise modele AI Studio ve Antigravity üzerindeki Gemini API kamuya açık önizlemesi aracılığıyla erişebiliyor.
Google, özelliğin yakında Chrome tarayıcısına da geleceğini açıkladı. Şirket ayrıca Haziran ayında taahhüt edilen Gemini 3.5 Pro modelinin yayınlanmasını bekletmeye devam ediyor.
Diğer Modeller İçin Erteleme Açıklaması
Duyuru sürecinde Gemini 3.5 Live ve Gemini 3.5 Live Experimental güncellemelerinin de çıkacağı bilgisi yer almıştı. Ancak Google sonradan bir bilgilendirme yaparak bugün sadece 3.5 Transcribe modelinin sunulduğunu, diğer modeller için yeni bir tarih verilmediğini belirtti.