ElevenLabs 10 saniyelik ses kaydıyla sesi klonlayabiliyor

Yapay zeka ses üretim platformlarından biri olan ElevenLabs, daha fazla ifade kontrolü, sesli asistanlar için daha düşük gecikme süresi ve 90’dan fazla dil desteği sunan ElevenLabs v4 ve v4 Turbo adlı iki yeni konuşma modelini kullanıma sundu.

ElevenLabs 10 saniyelik ses kaydıyla sesi klonlayabiliyor
Yayınlama: 28.09.2026
0
A+
A-

HANDE BERKTAN

Dünyanın en gelişmiş yapay zeka ses üretim platformlarından ElevenLabs, daha fazla ifade kontrolü, sesli asistanlar için daha düşük gecikme süresi ve 90’dan fazla dil desteği sunan ElevenLabs v4 ve v4 Turbo adlı iki yeni konuşma modelini kullanıma sundu.

Şirket, v3 modelini geçen yıl piyasaya sürmüş ve bu yılın başlarında Varşova’daki bir etkinlikte modelin tanıtımını yapmıştı. ElevenLabs, v4 nesli modeller için daha iyi kontrol ve daha hızlı ses kopyalama (klonlama) imkânı tanıyan yeni bir mimari benimsiyor. Şirket, v4 ile birlikte kullanıcıların sadece 10 saniyelik bir ses kaydıyla bir sesi klonlayabileceklerini belirtti.

REKLAM

REKLAM

Model, daha uzun metin bölümlerinde ses kimliğini daha iyi koruyor. Ayrıca, metni seslendirirken ifadeleri değiştirmek amacıyla metnin bağlamını da dikkate alıyor. V4 sürümünde, kullanıcıların birden fazla etiketi bir arada kullanmasına ve modelin bu sıralamayı takip etmesine olanak tanıyor.

Önceki sürüm 70 dili destekliyordu. ElevenLabs, yeni sürümle birlikte bu sayıyı 90 dile çıkarmak için çalışmalar yürüttü. Girişim, kalite açısından en büyük başarının Japonca, Brezilya Portekizcesi, Mandarin ve Kantonca dillerinde gözlemlendiğini belirtti.

Yapay zeka ses modellerinde, rekabet artıyor

ElevenLabs, iş hacminin yüzde 55’inden fazlasının büyük şirketlerden gelmesiyle birlikte, geçtiğimiz yıl kurumsal ses hizmetleri alanındaki faaliyetlerini hızla büyüttü. Şirket, daha akıcı bir konuşma deneyimi sağlamak adına gecikme süresi düşürülen yeni sürümün, ses tabanlı yapay zeka ajanları için son derece uygun olduğunu ifade etti. Ayrıca v4 sürümü, arka plandaki LLM modelin yanıt üretmeye başladığı anda ses oluşturma işlemine başlayabiliyor. Dahası model; sorunların daha iyi çözüme kavuşturulması amacıyla, gerginlik içeren durumları, tırmanan anlaşmazlıkları ve bekletme süreçlerini farklı şekillerde yönetebiliyor.

REKLAM

REKLAM

Cartesia, Deepgram, Fish Audio, Boson ve WellSaid Labs gibi girişimlerin etkileyici ve doğal tınılı konuşma modelleri geliştirmesiyle birlikte, bu alandaki rekabet kızıştı. Google ve OpenAI gibi dev şirketler de kendi ses modellerini geliştirdi.

Bir Yorum Yazın

Ziyaretçi Yorumları - 0 Yorum

Henüz yorum yapılmamış.