Начните с задач: эмоциональная игра, контент для местной аудитории, ваш собственный голос или ровное повествование. Все показатели в карточках получены на одном внутреннем наборе видео.
Драмы, развлекательные шоу и эмоциональная игра
Nightingale
Для авторов и студий, которым нужна премиальная передача эмоциональных перепадов. Nightingale лидирует по среднему показателю отслеживания исходной экспрессии в обоих протестированных языках.
Внутренние видео · Отслеживание экспрессии: EN 0.45, KO 0.54. Показатели измеряют интенсивность голоса, а не общее качество.
Лекции, корпоративные видео и местная аудитория
Oriole
Естественный для местной аудитории акцент, по результатам прослушивания. Выбирайте Oriole для лекций и корпоративных видео, где важна стабильность голоса между предложениями.
Внутренние видео · Стабильность голоса на английском: 0.661, наивысшее среднее. На корейском лидирует Wren.
Ваш голос, интервью и массовое производство
Finch
Для авторов, которые хотят сохранить свой голос при дубляже интервью или целого канала. Finch показал наивысшую среднюю схожесть голоса на английском и разработан для сохранения голоса при низкой стоимости производства.
Внутренние видео · Схожесть голоса на английском: 0.564. Акцент на сохранении голоса и низкой стоимости; проверяйте английский и испанский акцент перед публикацией.
Лекции, корпоративное повествование и ровное чтение
Wren
Для преподавателей и компаний, которым нужна ровная озвучка. Wren подходит для текстов лекций, презентаций компаний и чтения вслух, показывая наивысшую среднюю стабильность голоса на корейском во внутренних видео.
Внутренние видео · Стабильность голоса на корейском: 0.713. Прогноз естественности на английском: 3.64/5, автоматическая оценка, а не оценка слушателей.
Dodo: предыдущая модель Expressive, включённая в тесты для контекста. Доступность моделей и условия использования указаны в продукте.
Как мы оцениваем дубляж
У качества дубляжа несколько измерений. Мы оцениваем, на кого похож голос, как он следует выразительности оригинала и насколько стабилен в течение сцены. Также проверяем перевод, ошибки распознавания речи и временное соответствие.
01
Сходство с исходным голосом
Похож ли голос в дубляже на голос исходного говорящего?
Сходство с голосом исходного говорящего
02
Выразительность
Следует ли интенсивность голоса исполнению в оригинале?
Корреляция активации голоса · Анализ высоты тона
03
Стабильность
Остаётся ли сгенерированный голос согласованным от реплики к реплике?
Сходство голоса в соседних репликах
Тестирование команды разработки · 22 сентября 2026
Изучите измерения.
Выберите набор данных, целевой язык и показатель для сравнения моделей. Для каждого показателя приведены шкала и условия оценки.
| Модель | 00.250.50.751 | Среднее |
|---|---|---|
| Wren | 0.341 | |
| Dodo | 0.353 | |
| Oriole | 0.323 | |
| Finch | 0.564 | |
| Nightingale | 0.414 |
Источник: бенчмарк команды движков Perso, исправлен 22 сентября 2026 года. Выделены строки с лучшим средним по выбранному показателю; равные результаты выделены вместе. Это не утверждение о статистической значимости или общем качестве.
Finch имеет наивысшее среднее для всех четырёх целевых языков открытого чтения и внутренних английских видео. Во внутренних корейских видео Nightingale получает 0.486, Finch — 0.483; результаты близки.
Условия оценки
Открытые данные чтения: 13 языковых пар. Исходные языки: корейский, английский, португальский, китайский; целевые: английский, испанский, португальский, корейский. Результаты усреднены по группам чтецов. Внутренние видео: 29 пар дубляжа, 16 на английский и 13 на корейский.
В FLEURS Wren, Dodo, Oriole и Finch получают транскрипт и время и используют фиксированный перевод. Nightingale сам распознаёт речь и переводит. Первые четыре оцениваются по чистым отдельным репликам; голос в выводе Nightingale отделяется и выравнивается по временным окнам исходных предложений. Во внутренних видео каждая модель переводит самостоятельно. Ошибка распознавания для всех моделей этого набора оценивается по полным дорожкам.
Открытые данные чтения доступны по CC BY 4.0. Результаты охватывают выбранные языки и контент, а не все производственные сценарии. Общий рейтинг моделей не рассчитывается.
Показатели карточек взяты из одного внутреннего набора видео. В таблице также есть открытые данные чтения вслух. Качество акцента обосновано отдельной оценкой при прослушивании.
13
Языковые пары FLEURS
Открытые данные чтения вслух. Исходные языки: корейский, английский, португальский и китайский. Целевые: английский, испанский, португальский и корейский. 64 предложения на исходный язык с группировкой по чтецам. CC BY 4.0.
29
Внутренние видеопары
Отдельный набор видео, похожих на клиентский контент: 16 пар дубляжа на английский и 13 на корейский. Оценивает контент с более жёсткими временными рамками и разнообразными аудиоусловиями.
Что показывают эти результаты
В FLEURS Wren, Dodo, Oriole и Finch получают транскрипт, временные метки и общий перевод. Nightingale самостоятельно распознаёт речь и переводит. Это результаты полного процесса в документированных условиях, а не контролируемое сравнение только TTS.
Оценка при прослушивании: в слепом тестировании сентября 2026 года у Oriole была наименьшая доля замечаний об иностранном акценте, 8%. Это результат группы слушателей, а не автоматическая оценка акцента. Один показатель не отражает всё впечатление от прослушивания.
Источник: бенчмарк команды движков Perso, исправлен 22 сентября 2026 года. Карточки: внутренние видео, 16 пар дубляжа на английском и 13 на корейском. Небольшие различия средних не доказывают надёжного преимущества. Проверяйте расход кредитов при использовании продукта.
Означает ли премиум лучший балл по каждой метрике?
Нет. Nightingale: наш премиальный движок. Разные модели лидируют в разных измерениях. Сходство голоса, выразительность, перевод и временное соответствие следует рассматривать отдельно.
Зачем разделять измерения и прослушивание?
Автоматические метрики анализируют конкретные сигналы. Они не полностью отражают плавность, эмоциональные нюансы и уместность исполнения в сцене. Прослушивание остаётся необходимым.
Представляют ли языки тестов все поддерживаемые языки?
Нет. Здесь FLEURS охватывает четыре целевых языка, а внутренний набор видео: английский и корейский. Нельзя обобщать результаты на все языки и типы контента.
Откройте Perso Dubbing и выберите модель для следующего проекта.
Открыть Perso Dubbing →