Perso Dubbing · 에이전트 스킬
Perso Dubbing의 자막 번역기는 100개 언어를 지원하는 음성 인식으로 영상을 자막으로 만든 다음, 그 SRT를 AI 에이전트에게 넘겨 번역합니다. 더빙 요금 없이 음성 인식 요금만 내면 됩니다. 파일이든 폴더든 URL이든 지정하면, 번역된 자막 파일이 원본 옆에 저장되어 돌아옵니다.
무료 체험 · 신용카드 불필요 · 스킬을 실행하는 모든 AI 에이전트와 호환
∞
폴더 단위 배치: 웹은 작업당 1개 파일
상한 없음
영상 길이: 웹은 30분 제한
모든 URL
URL 소스: 웹은 YouTube, TikTok, Drive 지원
0
다운로드 클릭: 파일이 원본 옆에 저장됨
작동 방식
영상에서 번역된 자막까지, 한 번의 지시로
/srt 스킬이 전체 파이프라인을 실행합니다. 평소 쓰는 말로 작업을 설명하면 에이전트가 모든 단계를 처리합니다.
01
미디어를 지정하세요
영상 · 폴더 · URL
파일 하나, 폴더 전체, 또는 링크를 에이전트에게 주세요. YouTube, TikTok, Drive 등 모든 직접 URL을 지원합니다.
02
자막 추출
100개 언어 STT
100개 언어를 지원하는 음성 인식이 오디오를 정확한 원어 SRT로 변환합니다.
03
에이전트가 번역
에이전트 모델 · 0 크레딧
AI 에이전트가 자체 모델 안에서 SRT를 요청한 모든 언어로 번역합니다. Perso 크레딧은 쓰이지 않습니다.
04
파일이 원본 옆에 저장
.srt × 언어 수
언어별 SRT 파일 하나씩, 원본 영상 옆에 정리되어 저장됩니다. 다운로드 클릭은 한 번도 필요 없습니다.
실제 동작 보기
에이전트가 하는 걸 직접 보세요
폴더 안의 영상들에서 자막을 추출하고 번역하는 과정을 짧게 보여드립니다. 수동 업로드도, 다운로드도 없습니다.
에이전트 vs 웹
에이전트 스킬이 앞서는 여섯 가지
Perso Dubbing 웹 워크스페이스와 비교했습니다.
폴더 전체를 한 번에
웹은 작업당 파일 하나(2 GB)만 받습니다. 스킬은 폴더, 파일, URL을 섞어 처리하므로 영상 × 언어 조합 전부가 한 배치로 돌아갑니다.
영상 길이 무관
긴 녹화본은 무손실로 분할해 처리한 뒤 다시 병합합니다. 웹 에디터는 영상 하나를 30분으로 제한하지만, 에이전트는 크레딧이 있는 만큼 계속 실행됩니다.
어디서든 링크로
웹은 YouTube, TikTok, Drive 링크를 읽고, 에이전트는 여기에 더해 모든 직접 영상 URL을 받습니다. 파일 업로드는 mp4, mov, webm, mp3, wav, m4a를 지원합니다.
무인 재시도
대기열이 가득 차면 스킬이 5분마다 다시 확인하고, 중단된 작업을 체크포인트에서 이어갑니다. 밤새 켜두어도 이중 과금이 없습니다.
다운로드까지 처리
결과물이 원본 파일 옆에 언어별로 정리되어 저장됩니다. 웹은 대신 파일별 또는 ZIP 다운로드를 제공합니다.
자막에는 더빙 요금이 없습니다
스킬은 음성 인식만 실행하고, 번역은 에이전트가 직접 합니다. 웹에서는 번역된 SRT를 받으려면 더빙 프로젝트를 전부 돌려야 합니다.
자세히 보기
더빙 요금 없이, 번역된 자막만
두 경로 모두 번역된 SRT 파일로 끝납니다. 다만 그 과정에서 지불하는 비용이 크게 다릅니다.
웹 워크스페이스
1. 더빙 프로젝트를 생성합니다. 음성 생성을 포함한 전체 파이프라인이 실행됩니다.
2. 완료될 때까지 기다린 뒤 다운로드 메뉴를 엽니다.
3. 더빙의 부산물로 번역된 SRT를 받습니다.
음성 인식만으로는 원어 전사본만 나오므로, 더빙 없이는 번역 자막을 받을 수 없습니다.
비용: 더빙 요금 전액
에이전트 · /srt 스킬
1. 스킬이 음성 인식 프로젝트만 생성합니다. 음성은 생성되지 않습니다.
2. 원어 SRT가 돌아옵니다.
3. 에이전트가 요청한 모든 언어로 번역하며, Perso 크레딧은 소모되지 않습니다.
언어별 SRT 파일 하나씩, 원본 영상 옆에 정리되어 저장됩니다.
비용: 음성 인식 요금만
기능별 비교
굵게 표시된 쪽이 더 나은 선택입니다.
웹 에디터가 여전히 나은 영역
과장하지 않겠습니다. 정밀 작업에는 워크스페이스가 여전히 더 나은 도구입니다. 둘은 같은 계정과 같은 크레딧으로 돌아갑니다.
구간 편집
원문이나 번역문을 수정하고, 문장 하나만 다시 번역하고, 화자를 지정하고, 내보내기 전에 오디오를 미리 들어볼 수 있습니다.
음성 제어
더빙 작업을 위한 TTS 모델 3종, 보이스 클로닝 라이브러리, 영상당 최대 10명의 화자를 지원합니다.
추가 입출력
직접 만든 SRT를 업로드하고, 커스텀 사전을 적용하고, 자막을 영상에 입히고, VTT·타임스탬프·화자별 시트로 내보낼 수 있습니다.
해상도 선택
에디터 화면에서 1080p 또는 4K 출력을 바로 선택할 수 있습니다.
세 단계면 바로 시작
새로 익힐 인터페이스가 없습니다. 클릭은 에이전트가 합니다.
01
스킬을 설치하고 키를 연결하세요
AI 에이전트에 Perso Dubbing 스킬을 추가하고, developers.perso.ai에서 발급받은 API 키를 연결하세요.
02
영상을 지정하세요
파일, 폴더, 또는 URL을 주세요. 그리고 평소 쓰는 말로 요청하면 됩니다. “자막을 추출해서 스페인어와 일본어로 번역해줘.”
03
SRT 파일을 받으세요
원어 전사본과 목표 언어별 SRT 파일이 원본 영상 옆에 저장됩니다.
자막 번역기 자주 묻는 질문
영상에서 자막을 어떻게 번역하나요?
AI 에이전트에 Perso Dubbing 스킬을 설치하고 API 키를 연결한 뒤, 영상 파일·폴더·URL과 원하는 언어를 지정하세요. 100개 언어를 지원하는 음성 인식으로 자막을 추출하고 번역해, SRT 파일을 영상 옆에 저장합니다.
영상을 더빙하지 않고 번역 자막만 받을 수 있나요?
네. 스킬은 음성 인식 프로젝트만 생성하고(음성은 생성되지 않습니다), 번역은 에이전트가 SRT를 직접 처리합니다. 음성 인식 요금만 내면 되고, 번역 단계는 Perso 크레딧을 소모하지 않으므로 더빙 요금이 발생하지 않습니다.
ChatGPT나 Claude가 영상 자막을 번역할 수 있나요?
원본 영상만으로는 안 됩니다. 언어 모델은 영상 파일의 오디오를 들을 수 없습니다. Perso Dubbing 스킬과 함께 쓰면 Perso의 음성 인식이 먼저 영상을 자막으로 만들고, 그다음 에이전트가 그 SRT를 원하는 언어로 번역합니다.
어떤 영상 포맷을 지원하나요?
스킬은 mp4, mov, webm, mp3, wav, m4a 파일을 지원합니다. 본인 콘텐츠라면 URL(YouTube, TikTok, Google Drive 또는 모든 직접 영상 링크)도 받을 수 있습니다.
영상 길이 제한이 있나요?
고정된 상한은 없습니다. 스킬이 긴 영상을 무손실로 분할해 각 부분을 처리하고 결과를 병합하므로, 크레딧이 충분하다면 몇 시간짜리 녹화본도 문제없습니다. 반면 웹 에디터는 영상 하나를 30분으로 제한합니다.
폴더 안의 영상 자막을 한 번에 번역할 수 있나요?
네. 배치 처리가 이 스킬의 핵심입니다. 폴더를 주면 하위까지 검색해 영상과 언어 조합 전부를 대기열에 넣고, 대기열이 가득 차면 5분마다 자동으로 재시도하며, 중단된 작업은 체크포인트에서 이중 과금 없이 이어갑니다.
자막 번역 비용은 얼마인가요?
추출은 음성 인식 요금으로 과금되고, 번역은 에이전트 자체 모델에서 돌아가므로 Perso 크레딧을 쓰지 않습니다. 신용카드 없이 무료 체험이 가능하니 실제 영상으로 먼저 시험해보세요.
자막은 어떤 언어로 번역할 수 있나요?
음성 인식은 100개 원어를 지원하며, 에이전트는 요청하는 사실상 모든 언어로 SRT를 번역합니다. 더빙된 음성까지 필요하다면 Perso Dubbing이 같은 워크플로우에서 99+개 언어로 음성을 생성합니다.
이미 가지고 있는 SRT 파일은 어떻게 번역하나요?
에이전트가 기존 SRT 파일을 바로 번역할 수 있고, 이 단계는 Perso를 거치지 않으므로 크레딧이 들지 않습니다. 스킬이 필요한 경우는 영상이나 오디오에서 시작할 때입니다. 음성 인식이 먼저 미디어를 자막으로 만듭니다.
에이전트에게 한 번만 지시하세요. 영상 폴더를 넣으면 번역된 SRT 파일이 나옵니다. 음성 인식 요금만으로.