· FikirPilot
ElevenLabs, daha doğal ve bağlama duyarlı ses üretimi sunan yeni modellerini duyurdu. Eleven v4, 90’dan fazla dili desteklerken Turbo düşük gecikmeye odaklanıyor.
Yapay zeka ses teknolojileri şirketi ElevenLabs, metinden sese modelleri Eleven v4 ve Eleven v4 Turbo’yu tanıttı. Yeni mimariye sahip Eleven v4; tonlama, tempo, duygu ve bağlamı değerlendirerek daha doğal konuşmalar üretmeyi, uzun içeriklerde ise konuşmacı tutarlılığını korumayı hedefliyor.
Model, tek bir komutta birden fazla ses etiketi kullanmaya izin veriyor. Eleven v4, 10 saniyelik kayıttan ses klonlayabiliyor ve Professional Voice Clone özelliğini yeniden getiriyor.
Her iki model 90’dan fazla dili destekliyor; Eleven v3’te bu sayı yaklaşık 70’ti. Japonca, Brezilya Portekizcesi, Mandarin ve Kantonca için kalite artışı hedefleniyor. Çağrı merkezleri ve sesli yapay zeka ajanlarına yönelik Eleven v4 Turbo’da çift yönlü akış kullanılıyor; şirket testlerinde ilk ses için yaklaşık 150 milisaniyelik medyan, çıkarımda ise yaklaşık 100 milisaniyelik gecikme ölçüldü. Eleven v4 ayrıca 10 bin karaktere kadar içerik üretebiliyor.
Kaynak: FikirPilot · TRBülten tarafından derlendi