Perso Dubbing · エージェントスキル
Perso Dubbingの字幕翻訳ツールは、100言語対応の音声認識で動画を字幕に変換し、そのSRTをAIエージェントに渡して翻訳させます。吹替料金は不要で、speech-to-text料金のみ。ファイル、フォルダ、URLを指定すれば、翻訳済みの字幕ファイルが元のファイルの隣に保存されます。
無料トライアル · クレジットカード不要 · スキルを実行できるすべてのAIエージェントに対応
∞
フォルダ一括処理: ウェブはジョブあたり1ファイル
上限なし
動画の長さ: ウェブは30分制限
あらゆるURL
URLソース: ウェブはYouTube、TikTok、Drive対応
0
ダウンロードのクリック: ファイルは元の場所に保存
仕組み
動画から翻訳済み字幕まで、指示一つで
/srtスキルがパイプライン全体を実行します。自然言語でジョブを記述すれば、エージェントがすべてのステップを処理します。
01
メディアを指定
動画 · フォルダ · URL
エージェントにファイル、フォルダ全体、またはリンクを渡しましょう。YouTube、TikTok、Drive、その他あらゆる直接URLに対応しています。
02
字幕を抽出
100言語STT
100言語対応の音声認識が、音声を正確な原語SRTに変換します。
03
エージェントが翻訳
エージェントモデル · 0クレジット
AIエージェントが自身のモデル内でSRTをリクエストされたすべての言語に翻訳します。Persoクレジットは消費されません。
04
ファイルは元の場所に保存
.srt × 言語数
言語ごとに1つのSRT。ソース動画の隣に整理されて保存され、ダウンロードのクリックは一切不要です。
実際の動作を見る
エージェントの動作をご覧ください
動画フォルダから字幕を抽出して翻訳するスキルのショートウォークスルー。手動アップロードもダウンロードも不要です。
エージェント vs ウェブ
エージェントスキルが優れている6つの理由
Perso Dubbingウェブワークスペースとの比較です。
フォルダ丸ごと一括処理
ウェブはジョブあたり1ファイル(2 GB)のみ。スキルはフォルダ、ファイル、URLを組み合わせて処理するため、動画×言語のすべての組み合わせが1つのバッチで実行されます。
動画の長さは自由
長い録画はロスレスで分割処理され、再結合されます。ウェブエディタは1動画あたり30分に制限されますが、エージェントはクレジットが続く限り実行できます。
どこからでもリンクで
ウェブはYouTube、TikTok、Driveのリンクに対応し、エージェントはさらにあらゆる直接動画URLを受け付けます。ファイルアップロードはmp4、mov、webm、mp3、wav、m4aに対応。
自動リトライ
キューが満杯のとき、スキルは5分ごとに再チェックし、中断されたジョブをチェックポイントから再開します。一晩放置しても二重課金はありません。
ダウンロード処理済み
結果はソースファイルの隣に言語別に整理して保存されます。ウェブはファイル単位またはZIPダウンロードを提供します。
字幕に吹替料金は不要
スキルはspeech-to-textのみを実行し、エージェントがSRTを自ら翻訳します。ウェブでは翻訳済みSRTの取得にフル吹替プロジェクトが必要です。
詳しく見る
翻訳済み字幕を、吹替料金なしで
どちらの方法も翻訳済みSRTファイルで完了します。その過程で支払う費用が大きく異なります。
ウェブワークスペース
1. 吹替プロジェクトを作成します。音声生成を含むフルパイプラインが実行されます。
2. 完了を待ち、ダウンロードメニューを開きます。
3. 吹替の副産物として翻訳済みSRTを取得します。
speech-to-text単体では原語のトランスクリプトのみが生成されるため、吹替なしでは翻訳字幕は利用できません。
コスト: 吹替料金の全額
エージェント · /srtスキル
1. スキルがspeech-to-textプロジェクトのみを作成します。音声は生成されません。
2. 原語のSRTが返されます。
3. エージェントがリクエストされたすべての言語に翻訳します。Persoクレジットは消費されません。
言語ごとに1つのSRT。ソース動画の隣に整理されて保存されます。
コスト: speech-to-text料金のみ
機能別比較
太字の側がより優れています。
ウェブエディタが依然として優れている点
誇張なし: 精密作業には引き続きワークスペースがより優れたツールです。どちらも同じアカウントと同じクレジットで動作します。
セグメント編集
原文または翻訳済みの行を編集し、一文だけ再翻訳し、話者を割り当て、エクスポート前にオーディオをプレビューできます。
音声コントロール
3種類のTTSモデル、ボイスクローニングライブラリ、吹替作業用に動画あたり最大10話者に対応。
追加の入出力
自作のSRTをアップロードし、カスタム辞書を適用し、字幕を動画に焼き込み、VTT、タイムスタンプ、話者別シートでエクスポートできます。
解像度の選択
エディタインターフェースで直接1080pまたは4K出力を選択できます。
3ステップですぐに開始
新しいインターフェースを覚える必要はありません。クリック操作はエージェントが行います。
01
スキルをインストールしてキーを接続
AIエージェントにPerso Dubbingスキルを追加し、developers.perso.aiからAPIキーを接続してください。
02
動画を指定
ファイル、フォルダ、またはURL。自然言語でリクエストするだけです。“字幕を抽出してスペイン語と日本語に翻訳して。”
03
SRTファイルを受け取る
原語のトランスクリプトに加え、ターゲット言語ごとに1つのSRTファイルがソース動画の隣に保存されます。
字幕翻訳ツール FAQ
動画から字幕を翻訳するにはどうすればよいですか?
AIエージェントにPerso Dubbingスキルをインストールし、APIキーを接続して、動画ファイル、フォルダ、またはURLと希望する言語を指定してください。100言語対応の音声認識で字幕を抽出して翻訳し、SRTファイルを動画の隣に保存します。
動画を吹き替えずに翻訳済み字幕を取得できますか?
はい。スキルはspeech-to-textプロジェクトのみを作成し(音声は生成されません)、エージェントが出力されたSRTを自ら翻訳します。speech-to-text料金のみで、翻訳ステップはPersoクレジットを消費しないため、吹替料金は発生しません。
ChatGPTやClaudeは動画の字幕を翻訳できますか?
元の動画からは翻訳できません。言語モデルは動画ファイルの音声を聞くことができません。Perso Dubbingスキルと組み合わせれば、Persoの音声認識がまず動画を字幕に変換し、その後エージェントがそのSRTをリクエストされた言語に翻訳します。
対応している動画形式は?
スキルはmp4、mov、webm、mp3、wav、m4aファイルに対応しています。自分のコンテンツであればURL(YouTube、TikTok、Google Drive、その他あらゆる直接動画リンク)も受け付けます。
動画の長さに制限はありますか?
固定の上限はありません。スキルが長い動画をロスレスで分割し、各パートを処理して結果を結合するため、クレジットが足りる限り数時間の録画でも問題なく動作します。一方、ウェブエディタは1動画あたり30分に制限されます。
動画フォルダ全体の字幕を一括で翻訳できますか?
はい。バッチ処理こそがこのスキルの存在意義です。フォルダを指定すれば再帰的に検索し、動画と言語のすべての組み合わせをキューに入れ、キューが満杯の場合は5分ごとに自動リトライし、中断されたジョブをチェックポイントから二重課金なしで再開します。
字幕翻訳のコストはいくらですか?
抽出はspeech-to-text料金で課金され、翻訳はエージェント自身のモデル内で実行されるためPersoクレジットは消費されません。クレジットカード不要の無料トライアルがあるので、まず実際の動画でテストできます。
字幕はどの言語に翻訳できますか?
音声認識は100のソース言語をカバーし、エージェントはリクエストされた事実上すべての言語にSRTを翻訳します。吹替音声も必要であれば、Perso Dubbingが同じワークフローから99+言語で音声を生成します。
すでに持っているSRTファイルを翻訳するには?
エージェントが既存のSRTファイルをそのまま翻訳でき、このステップはPersoを一切経由しないためクレジットは不要です。スキルが必要になるのは動画や音声から開始する場合です。音声認識がまずメディアを字幕に変換します。
エージェントへの指示は一度だけ。動画フォルダを入れれば、翻訳済みSRTファイルが出てきます。speech-to-text料金のみで。