Model AI Voice Terbaru ElevenLabs v4 Hadir dengan 90 Bahasa

Update Terbaru ElevenLabsElevenLabs resmi meluncurkan dua model AI suara terbaru pada Senin, yaitu ElevenLabs v4 dan v4 Turbo. Keduanya hadir dengan sejumlah peningkatan, mulai dari kontrol ekspresi yang lebih baik, latensi lebih rendah untuk voice agent, hingga dukungan lebih dari 90 bahasa.

Baca Juga : 10 Ai Voice Over Indonesia: COPAS Teks Jadi Suara

Sebelumnya, perusahaan telah merilis model v3 pada tahun lalu. ElevenLabs juga sempat memperkenalkan model generasi terbaru ini dalam sebuah acara di Warsawa pada awal tahun. Untuk generasi v4, ElevenLabs menggunakan arsitektur baru yang memungkinkan pengguna mendapatkan kontrol suara lebih baik sekaligus proses cloning yang lebih cepat.

Menariknya, dengan ElevenLabs v4, pengguna disebut bisa melakukan voice cloning hanya dengan 10 detik rekaman audio. Hal ini membuat proses pembuatan suara digital menjadi lebih praktis dibandingkan sebelumnya.

Kontrol Ekspresi Suara Lebih Detail

Dari sisi kreativitas, ElevenLabs v4 membawa peningkatan dalam mempertahankan identitas suara ketika membaca teks yang lebih panjang. Model ini juga mampu memahami konteks dari teks sebelum membacakannya, sehingga ekspresi suara dapat berubah menyesuaikan isi yang sedang disampaikan.

Pada model v3, ElevenLabs sudah memperkenalkan inline tags yang digunakan untuk menentukan ekspresi suara. Kini, kemampuan tersebut diperluas pada v4. Pengguna dapat menggabungkan beberapa tag sekaligus dan model akan mengikuti urutan ekspresi yang telah ditentukan.

Dengan kemampuan ini, suara yang dihasilkan bisa terasa lebih dinamis dan sesuai dengan konteks teks yang diberikan.

Kini Mendukung Lebih dari 90 Bahasa

ElevenLabs juga meningkatkan jumlah bahasa yang didukung. Versi sebelumnya mendukung sekitar 70 bahasa, sedangkan generasi terbaru ini telah diperluas menjadi lebih dari 90 bahasa.

Perusahaan mengatakan peningkatan kualitas paling besar terlihat pada beberapa bahasa, termasuk bahasa Jepang, Portugis Brasil, Mandarin, dan Kanton.

Peningkatan tersebut membuat model terbaru ElevenLabs tidak hanya berfokus pada bahasa Inggris, tetapi juga semakin serius mengembangkan kemampuan suara untuk berbagai pasar global.

Dirancang untuk Voice Agent

Selain kebutuhan kreatif, ElevenLabs melihat v4 sebagai model yang cocok untuk kebutuhan voice agent. Perusahaan diketahui telah mengembangkan bisnis panggilan untuk pelanggan perusahaan dengan cukup cepat selama satu tahun terakhir.

Lebih dari 55% bisnis ElevenLabs saat ini berasal dari perusahaan besar. Model v4 dirancang dengan latensi yang lebih rendah sehingga percakapan dengan voice agent dapat terasa lebih lancar.

Model ini bahkan dapat mulai menghasilkan audio ketika LLM yang berada di belakangnya mulai menghasilkan jawaban. Selain itu, v4 juga dapat menangani situasi seperti konfrontasi, eskalasi, dan hold secara berbeda untuk membantu proses penyelesaian masalah.

Persaingan Model AI Suara Semakin Ketat

Perkembangan model suara AI saat ini semakin ramai. Sejumlah startup seperti Cartesia, Deepgram, Fish Audio, Boson, dan WellSaid Labs juga telah mengembangkan model suara yang lebih ekspresif.

Tidak hanya startup, perusahaan teknologi besar seperti Google dan OpenAI juga terus meningkatkan kemampuan model suara mereka.

Di tengah persaingan tersebut, ElevenLabs sendiri mendapatkan pendanaan sebesar US$500 juta dari Sequoia pada awal tahun. Pendanaan tersebut membuat valuasi perusahaan mencapai US$11 miliar.

Bahkan, sudah muncul kabar mengenai putaran pendanaan berikutnya yang berpotensi meningkatkan valuasi ElevenLabs menjadi US$22 miliar.

Dari sisi bisnis, pendapatan tahunan ElevenLabs juga mengalami peningkatan signifikan. Annualized revenue run rate perusahaan naik dari sekitar US$330 juta pada awal tahun menjadi lebih dari US$600 juta.

Baca Juga : ElevenLabs Rilis AI Musik yang Bisa Ganti Genre di Tengah Lagu

Perusahaan juga terus melakukan perekrutan secara agresif di berbagai pasar, termasuk India, Eropa, dan Brasil. Jumlah karyawan ElevenLabs kini telah mencapai lebih dari 800 orang.

Leave a Reply

Your email address will not be published. Required fields are marked *

←