Mulai dari konten yang Anda buat: penampilan emosional, konten untuk penonton lokal, suara Anda sendiri, atau narasi stabil. Semua skor kartu di bawah memakai kumpulan video internal yang sama.
Drama, hiburan, dan penampilan emosional
Nightingale
Untuk kreator dan studio yang menginginkan penyampaian premium pada perubahan emosi. Nightingale meraih rata-rata tertinggi dalam pelacakan ekspresi sumber pada kedua bahasa yang diuji.
Video internal · Pelacakan ekspresi: EN 0.45, KO 0.54. Skor ini mengukur intensitas suara, bukan kualitas keseluruhan.
Kuliah, video perusahaan, dan penonton lokal
Oriole
Aksen yang terdengar alami bagi penonton lokal, berdasarkan evaluasi pendengaran. Pilih Oriole untuk kuliah dan video perusahaan yang membutuhkan suara konsisten antarkalimat.
Video internal · Konsistensi suara bahasa Inggris: 0.661, rata-rata tertinggi. Untuk bahasa Korea, Wren memimpin.
Suara Anda, wawancara, dan produksi skala besar
Finch
Untuk kreator yang ingin mempertahankan suara sendiri saat melakukan dubbing wawancara atau seluruh kanal. Finch meraih rata-rata kemiripan suara tertinggi dalam bahasa Inggris dan dirancang untuk mempertahankan suara dengan biaya produksi rendah.
Video internal · Kemiripan suara bahasa Inggris: 0.564. Fokusnya mempertahankan suara dengan biaya rendah; periksa aksen Inggris dan Spanyol sebelum menerbitkan.
Kuliah, narasi perusahaan, dan pembacaan stabil
Wren
Untuk pengajar dan bisnis yang membutuhkan narasi stabil. Wren cocok untuk naskah kuliah, pengenalan perusahaan, dan konten bacaan, dengan rata-rata konsistensi suara bahasa Korea tertinggi pada video internal.
Video internal · Konsistensi suara bahasa Korea: 0.713. Prediksi kealamian bahasa Inggris: 3.64/5, skor otomatis, bukan penilaian pendengar.
Dodo adalah model Expressive sebelumnya dan disertakan dalam tolok ukur sebagai konteks. Ketersediaan model dan ketentuan penggunaan ditampilkan di dalam produk.
Cara kami mengevaluasi dubbing
Kualitas dubbing memiliki beberapa dimensi. Kami menilai kemiripan suara dengan pembicara, kesesuaiannya dengan ekspresi asli, dan konsistensinya sepanjang adegan. Kami juga memeriksa terjemahan, kesalahan pengenalan ucapan, dan ketepatan waktu.
01
Identitas suara
Apakah suara hasil dubbing masih menyerupai pembicara asli?
Kemiripan dengan suara pembicara asli
02
Ekspresi
Apakah intensitas suara mengikuti penampilan dalam sumber?
Korelasi aktivasi vokal · Analisis nada
03
Konsistensi
Apakah suara yang dihasilkan tetap konsisten antarbaris?
Kemiripan suara antarbaris berurutan
Tolok ukur tim teknik · 22 September 2026
Jelajahi hasil pengukuran.
Pilih kumpulan data, bahasa target, dan metrik untuk membandingkan model. Skor memakai skala dan kondisi evaluasi yang ditampilkan untuk setiap metrik.
| Model | 00.250.50.751 | Rata-rata |
|---|---|---|
| Wren | 0.341 | |
| Dodo | 0.353 | |
| Oriole | 0.323 | |
| Finch | 0.564 | |
| Nightingale | 0.414 |
Sumber: benchmark tim engine Perso, dikoreksi 22 September 2026. Baris yang disorot memiliki rata-rata terbaik untuk metrik terpilih; hasil seri disorot bersama. Ini bukan klaim signifikansi statistik atau kualitas keseluruhan.
Finch memiliki rata-rata tertinggi pada keempat bahasa target ucapan bacaan publik dan video internal bahasa Inggris. Pada video internal bahasa Korea, Nightingale mendapat 0.486 dan Finch 0.483; hasilnya berdekatan.
Kondisi evaluasi
Ucapan bacaan publik: 13 pasangan bahasa, dengan sumber Korea, Inggris, Portugis, dan Mandarin serta target Inggris, Spanyol, Portugis, dan Korea. Hasil dirata-ratakan per kelompok pembaca. Video internal: 29 pasangan dubbing, 16 ke bahasa Inggris dan 13 ke bahasa Korea.
Pada FLEURS, Wren, Dodo, Oriole, dan Finch menerima transkrip dan waktu serta berbagi terjemahan tetap. Nightingale menjalankan pengenalan ucapan dan terjemahan sendiri. Keempat model pertama dinilai dari klip bersih per baris; keluaran Nightingale dipisahkan suaranya dan disejajarkan dengan jendela kalimat sumber. Pada video internal, setiap model menjalankan terjemahannya sendiri. Kesalahan pengenalan dinilai pada trek penuh untuk semua model dalam kumpulan tersebut.
Data publik ucapan bacaan berlisensi CC BY 4.0. Hasil mencakup bahasa dan konten terpilih, bukan seluruh skenario produksi. Tidak ada peringkat model gabungan yang dihitung.
Skor kartu berasal dari satu kumpulan video internal. Penjelajah juga mencakup data publik ucapan yang dibacakan. Evaluasi pendengaran memberi bukti terpisah tentang kualitas aksen.
13
Pasangan bahasa FLEURS
Data publik ucapan yang dibacakan. Sumber: Korea, Inggris, Portugis, dan Mandarin. Target: Inggris, Spanyol, Portugis, dan Korea. 64 kalimat per bahasa sumber, dikelompokkan menurut pembaca. CC BY 4.0.
29
Pasangan video internal
Kumpulan terpisah video yang menyerupai konten pelanggan, dengan 16 pasangan dubbing ke bahasa Inggris dan 13 ke bahasa Korea. Mengevaluasi konten dengan waktu lebih ketat dan kondisi audio lebih beragam.
Apa yang dapat disampaikan hasil ini
Evaluasi FLEURS menyediakan transkrip dan waktu kepada Wren, Dodo, Oriole, dan Finch, dengan satu terjemahan bersama. Nightingale menjalankan pengenalan ucapan dan terjemahannya sendiri. Ini adalah hasil proses lengkap dalam kondisi terdokumentasi, bukan perbandingan terkontrol khusus TTS.
Evaluasi pendengaran: dalam panel buta September 2026, Oriole memiliki tingkat temuan aksen asing terendah, 8%. Ini hasil panel pendengar, bukan skor aksen otomatis. Satu metrik tidak dapat menggambarkan seluruh pengalaman mendengar.
Sumber: benchmark tim engine Perso, dikoreksi 22 September 2026. Skor kartu: video internal, 16 pasangan dubbing bahasa Inggris dan 13 bahasa Korea. Selisih rata-rata yang kecil tidak membuktikan keunggulan yang andal. Periksa penggunaan kredit saat menggunakan produk.
Apakah premium berarti skor tertinggi pada setiap metrik?
Tidak. Nightingale adalah penawaran mesin premium kami. Model yang berbeda memimpin pengukuran yang berbeda. Identitas suara, ekspresi, terjemahan, dan waktu harus dipertimbangkan secara terpisah.
Mengapa memisahkan pengukuran dari mendengarkan?
Metrik otomatis memeriksa sinyal tertentu. Metrik tersebut tidak sepenuhnya menangkap alur, nuansa emosi, atau kesesuaian penampilan dengan adegan. Mendengarkan tetap penting.
Apakah bahasa tolok ukur mewakili semua bahasa yang didukung?
Tidak. Hasil FLEURS di sini mencakup empat bahasa target; kumpulan video internal mencakup Inggris dan Korea. Hasil tidak boleh digeneralisasi ke semua bahasa atau jenis konten.
Jelajahi Perso Dubbing dan pilih model yang sesuai untuk proyek Anda berikutnya.
Jelajahi Perso Dubbing →