감정이 풍부한 연기, 현지 시청자용 콘텐츠, 나만의 목소리, 안정적인 나레이션. 제작 목적에 맞춰 선택하세요. 아래 카드의 점수는 모두 내부 영상 세트를 기준으로 합니다.
드라마·예능·감정 표현이 풍부한 콘텐츠
Nightingale
감정 변화가 큰 장면을 프리미엄 품질로 전달하려는 크리에이터와 스튜디오에 적합합니다. Nightingale은 평가한 두 언어 모두에서 원본 표현 추적 평균 점수가 가장 높았습니다.
내부 영상 · 표현 추적: 영어 0.45, 한국어 0.54. 전체 품질이 아닌 목소리 강도의 변화를 측정한 점수입니다.
강의·기업 홍보·현지 시청자용 콘텐츠
Oriole
청취 평가에서 현지 시청자에게 자연스럽게 들리는 억양이 강점으로 나타났습니다. 문장이 바뀌어도 목소리를 일관되게 유지해야 하는 강의와 기업 영상에 적합합니다.
내부 영상 · 영어 목소리 일관성: 0.661, 평균 1위. 한국어 일관성은 Wren이 가장 높았습니다.
나만의 목소리·인터뷰·대량 제작
Finch
인터뷰나 채널 전체를 더빙할 때 자신의 목소리를 유지하고 싶은 크리에이터에게 적합합니다. Finch는 영어 평가에서 화자 유사도 평균 1위를 기록했으며, 목소리 유지와 저비용 제작에 초점을 맞춘 모델입니다.
내부 영상 · 영어 화자 유사도: 0.564. 목소리 유지와 저비용에 초점을 맞춥니다. 영어·스페인어 억양은 발행 전 확인하세요.
강의·기업 나레이션·안정적인 낭독
Wren
안정적인 나레이션이 필요한 교육자와 기업에 추천합니다. Wren은 강의 대본, 기업 소개, 낭독 콘텐츠에 적합하며 내부 영상 세트에서 한국어 목소리 일관성 평균이 가장 높았습니다.
내부 영상 · 한국어 목소리 일관성: 0.713. 영어 자연스러움 예측: 3.64/5, 청취 평가가 아닌 자동 평가 점수입니다.
Dodo는 이전 Expressive 모델이며 비교 맥락을 위해 벤치마크에 포함했습니다. 모델 제공 여부와 이용 조건은 제품에서 확인할 수 있습니다.
더빙 품질 평가 기준
더빙 품질은 여러 측면으로 평가해야 합니다. 누구의 목소리처럼 들리는지, 원본의 표현을 얼마나 잘 따라가는지, 장면 전체에서 얼마나 일관되게 유지되는지 살펴봅니다. 번역, 음성 인식 오류, 타이밍도 함께 평가합니다.
01
화자 유사도
더빙된 목소리가 원래 화자의 목소리와 닮아 있나요?
원본 화자와의 목소리 유사도
02
표현
목소리의 강도가 원본의 연기를 따라가나요?
각성도 상관관계 · 피치 분석
03
일관성
생성된 목소리가 대사 사이에서도 일관되게 유지되나요?
연속 대사 간 음성 유사도
엔진팀 벤치마크 · 2026년 9월 22일
측정 결과를 살펴보세요.
데이터셋, 대상 언어, 평가 항목을 선택해 모델별 점수를 비교하세요. 항목별 척도와 평가 조건도 함께 확인할 수 있습니다.
| 모델 | 00.250.50.751 | 평균 |
|---|---|---|
| Wren | 0.341 | |
| Dodo | 0.353 | |
| Oriole | 0.323 | |
| Finch | 0.564 | |
| Nightingale | 0.414 |
출처: Perso 엔진팀 벤치마크, 2026년 9월 22일 수정. 선택한 지표에서 가장 좋은 평균값을 강조하며 동점은 함께 표시합니다. 통계적으로 유의한 차이나 종합 품질 우위를 뜻하지 않습니다.
Finch는 공개 낭독 데이터의 4개 대상 언어와 내부 영어 영상에서 평균이 가장 높았습니다. 내부 한국어 영상은 Nightingale 0.486, Finch 0.483으로 결과가 근접합니다.
평가 조건
공개 낭독 데이터: 13개 언어 쌍. 원본은 한국어·영어·포르투갈어·중국어, 대상은 영어·스페인어·포르투갈어·한국어입니다. 결과는 낭독자 그룹별로 평균합니다. 내부 영상: 영어 16쌍, 한국어 13쌍, 총 29쌍의 더빙 결과입니다.
FLEURS에서 Wren, Dodo, Oriole, Finch는 대본과 타이밍을 제공받고 고정 번역을 공유합니다. Nightingale은 음성 인식과 번역을 자체 수행합니다. FLEURS에서 Wren, Dodo, Oriole, Finch는 깨끗한 대사별 클립으로 평가하며, Nightingale 결과는 음성 분리 후 원본 문장의 시간 구간에 맞춥니다. 내부 영상에서는 각 모델이 자체 번역을 수행합니다. 해당 데이터의 모든 모델은 전체 트랙을 기준으로 음성 인식 오류를 평가합니다.
공개 낭독 데이터의 라이선스는 CC BY 4.0입니다. 결과는 일부 언어와 콘텐츠를 대상으로 하며 모든 제작 상황을 포괄하지 않습니다. 모델 종합 순위는 산출하지 않습니다.
카드 점수는 동일한 내부 영상 세트를 기준으로 합니다. 비교표에는 공개 낭독 데이터도 포함됩니다. 억양 품질은 별도의 청취 평가를 근거로 설명합니다.
13
FLEURS 언어쌍
공개 낭독 음성 데이터입니다. 원본 언어는 한국어, 영어, 포르투갈어, 중국어이며 대상 언어는 영어, 스페인어, 포르투갈어, 한국어입니다. 원본 언어당 64개 문장을 낭독자별로 묶었습니다. CC BY 4.0.
29
내부 영상쌍
고객 콘텐츠와 유사한 별도의 영상 데이터로, 영어 더빙 16쌍과 한국어 더빙 13쌍으로 구성됩니다. 대사를 말할 시간이 더 짧고 음향 조건도 다양한 콘텐츠를 평가합니다.
이 결과로 알 수 있는 것
FLEURS 평가에서는 Wren, Dodo, Oriole, Finch에 대본과 타이밍, 하나의 공통 번역을 제공합니다. Nightingale은 음성 인식과 번역을 자체 수행합니다. 따라서 이는 명시된 조건의 처리 과정 전체에 대한 결과이며, TTS만 분리해 통제한 비교가 아닙니다.
청취 평가 기준: 2026년 9월 블라인드 패널에서 Oriole의 외국인 억양 지적률은 8%로 가장 낮았습니다. 자동 억양 점수가 아닌 청취 패널의 평가 결과입니다. 하나의 지표가 전체 청취 경험을 설명하지는 못합니다.
출처: Perso 엔진팀 벤치마크, 2026년 9월 22일 수정. 카드 점수는 내부 영상의 영어 16쌍, 한국어 13쌍을 평가한 결과입니다. 작은 평균 차이만으로 확실한 우위를 판단할 수 없습니다. 크레딧 사용량은 제품 이용 시 확인해 주세요.
프리미엄이면 모든 지표에서 가장 높은 점수인가요?
아닙니다. Nightingale은 프리미엄 더빙 엔진이며, 평가 항목에 따라 가장 높은 점수를 받은 모델은 다릅니다. 화자 유사도, 표현, 번역, 타이밍을 각각 비교해 주세요.
측정과 청취를 구분하는 이유는 무엇인가요?
자동 평가는 음성의 특정 특징을 측정합니다. 대사가 자연스럽게 이어지는지, 감정 표현이 섬세한지, 장면에 어울리는지는 점수만으로 판단하기 어렵습니다. 실제 결과를 직접 들어보세요.
벤치마크 언어가 모든 지원 언어를 대표하나요?
아닙니다. 여기의 FLEURS 결과는 네 대상 언어, 내부 영상은 영어와 한국어를 다룹니다. 결과를 모든 언어나 콘텐츠 유형으로 일반화해서는 안 됩니다.
Perso Dubbing에서 다음 프로젝트에 맞는 모델을 선택해 보세요.
Perso Dubbing 살펴보기 →