Perso Dubbing · エージェントスキル

AI字幕翻訳ツール: あらゆる動画から字幕を抽出して翻訳

AI字幕翻訳ツール: あらゆる動画から字幕を抽出して翻訳

AI字幕翻訳ツール: あらゆる動画から字幕を抽出して翻訳

Perso Dubbingの字幕翻訳ツールは、100言語対応の音声認識で動画を字幕に変換し、そのSRTをAIエージェントに渡して翻訳させます。吹替料金は不要で、speech-to-text料金のみ。ファイル、フォルダ、URLを指定すれば、翻訳済みの字幕ファイルが元のファイルの隣に保存されます。

無料トライアル · クレジットカード不要 · スキルを実行できるすべてのAIエージェントに対応

フォルダ一括処理: ウェブはジョブあたり1ファイル

上限なし

動画の長さ: ウェブは30分制限

あらゆるURL

URLソース: ウェブはYouTube、TikTok、Drive対応

0

ダウンロードのクリック: ファイルは元の場所に保存

仕組み

動画から翻訳済み字幕まで、指示一つで

/srtスキルがパイプライン全体を実行します。自然言語でジョブを記述すれば、エージェントがすべてのステップを処理します。

01

メディアを指定

動画 · フォルダ · URL

エージェントにファイル、フォルダ全体、またはリンクを渡しましょう。YouTube、TikTok、Drive、その他あらゆる直接URLに対応しています。

02

字幕を抽出

100言語STT

100言語対応の音声認識が、音声を正確な原語SRTに変換します。

03

エージェントが翻訳

エージェントモデル · 0クレジット

AIエージェントが自身のモデル内でSRTをリクエストされたすべての言語に翻訳します。Persoクレジットは消費されません。

04

ファイルは元の場所に保存

.srt × 言語数

言語ごとに1つのSRT。ソース動画の隣に整理されて保存され、ダウンロードのクリックは一切不要です。

実際の動作を見る

エージェントの動作をご覧ください

動画フォルダから字幕を抽出して翻訳するスキルのショートウォークスルー。手動アップロードもダウンロードも不要です。

0:00

0:00

0:00

0:00

0:00

0:00

エージェント vs ウェブ

エージェントスキルが優れている6つの理由

Perso Dubbingウェブワークスペースとの比較です。

∞ vs 1

∞ vs 1

フォルダ丸ごと一括処理

ウェブはジョブあたり1ファイル(2 GB)のみ。スキルはフォルダ、ファイル、URLを組み合わせて処理するため、動画×言語のすべての組み合わせが1つのバッチで実行されます。

制限なし vs 30分

制限なし vs 30分

動画の長さは自由

長い録画はロスレスで分割処理され、再結合されます。ウェブエディタは1動画あたり30分に制限されますが、エージェントはクレジットが続く限り実行できます。

あらゆるURL vs 3

あらゆるURL vs 3

どこからでもリンクで

ウェブはYouTube、TikTok、Driveのリンクに対応し、エージェントはさらにあらゆる直接動画URLを受け付けます。ファイルアップロードはmp4、mov、webm、mp3、wav、m4aに対応。

5分

5分

自動リトライ

キューが満杯のとき、スキルは5分ごとに再チェックし、中断されたジョブをチェックポイントから再開します。一晩放置しても二重課金はありません。

0クリック

0クリック

ダウンロード処理済み

結果はソースファイルの隣に言語別に整理して保存されます。ウェブはファイル単位またはZIPダウンロードを提供します。

STTのみ

STTのみ

字幕に吹替料金は不要

スキルはspeech-to-textのみを実行し、エージェントがSRTを自ら翻訳します。ウェブでは翻訳済みSRTの取得にフル吹替プロジェクトが必要です。

詳しく見る

翻訳済み字幕を、吹替料金なしで

どちらの方法も翻訳済みSRTファイルで完了します。その過程で支払う費用が大きく異なります。

ウェブワークスペース

吹替プロジェクトの全工程

吹替プロジェクトの全工程

1. 吹替プロジェクトを作成します。音声生成を含むフルパイプラインが実行されます。

2. 完了を待ち、ダウンロードメニューを開きます。

3. 吹替の副産物として翻訳済みSRTを取得します。

speech-to-text単体では原語のトランスクリプトのみが生成されるため、吹替なしでは翻訳字幕は利用できません。

コスト: 吹替料金の全額

エージェント · /srtスキル

字幕へ直行

字幕へ直行

1. スキルがspeech-to-textプロジェクトのみを作成します。音声は生成されません。

2. 原語のSRTが返されます。

3. エージェントがリクエストされたすべての言語に翻訳します。Persoクレジットは消費されません。

言語ごとに1つのSRT。ソース動画の隣に整理されて保存されます。

コスト: speech-to-text料金のみ

機能別比較

太字の側がより優れています。

機能

機能

ウェブワークスペース

ウェブワークスペース

エージェントスキル

エージェントスキル

入力

入力

ジョブあたり1ファイル · 2 GB

ジョブあたり1ファイル · 2 GB

フォルダ、ファイル、URLを1つのリクエストに混在

フォルダ、ファイル、URLを1つのリクエストに混在

動画の長さ

動画の長さ

1動画あたり最大30分

1動画あたり最大30分

長さ制限なし: 上限はクレジット残高のみ

長さ制限なし: 上限はクレジット残高のみ

URLソース

URLソース

YouTube · TikTok · Drive

YouTube · TikTok · Drive

あらゆる直接動画リンクにも対応

あらゆる直接動画リンクにも対応

キュー

キュー

手動、一度に1ジョブ

手動、一度に1ジョブ

動画×言語のグローバルキュー、5分ごとの自動リトライ

動画×言語のグローバルキュー、5分ごとの自動リトライ

中断時

中断時

アップロードリトライのみ

アップロードリトライのみ

二重課金防止付きのチェックポイント再開

二重課金防止付きのチェックポイント再開

結果

結果

ファイル単位またはZIPダウンロード

ファイル単位またはZIPダウンロード

元ファイルの隣に言語別に自動保存

元ファイルの隣に言語別に自動保存

翻訳済み字幕

翻訳済み字幕

フル吹替プロジェクト経由、吹替料金で

フル吹替プロジェクト経由、吹替料金で

speech-to-text料金: エージェントが無料で翻訳

speech-to-text料金: エージェントが無料で翻訳

セグメント編集

セグメント編集

行の編集、再翻訳、話者の割り当て、プレビュー

行の編集、再翻訳、話者の割り当て、プレビュー

利用不可

利用不可

音声コントロール

音声コントロール

TTSモデル3種、ボイスクローニング、最大10話者

TTSモデル3種、ボイスクローニング、最大10話者

デフォルトエンジン、単一話者

デフォルトエンジン、単一話者

ウェブエディタが依然として優れている点

誇張なし: 精密作業には引き続きワークスペースがより優れたツールです。どちらも同じアカウントと同じクレジットで動作します。

セグメント編集

原文または翻訳済みの行を編集し、一文だけ再翻訳し、話者を割り当て、エクスポート前にオーディオをプレビューできます。

音声コントロール

3種類のTTSモデル、ボイスクローニングライブラリ、吹替作業用に動画あたり最大10話者に対応。

追加の入出力

自作のSRTをアップロードし、カスタム辞書を適用し、字幕を動画に焼き込み、VTT、タイムスタンプ、話者別シートでエクスポートできます。

解像度の選択

エディタインターフェースで直接1080pまたは4K出力を選択できます。

判断基準はシンプルです。バッチ処理と無人作業はエージェントに、精密編集はウェブに任せましょう。

判断基準はシンプルです。バッチ処理と無人作業はエージェントに、精密編集はウェブに任せましょう。

3ステップですぐに開始

新しいインターフェースを覚える必要はありません。クリック操作はエージェントが行います。

01

スキルをインストールしてキーを接続

AIエージェントにPerso Dubbingスキルを追加し、developers.perso.aiからAPIキーを接続してください。

02

動画を指定

ファイル、フォルダ、またはURL。自然言語でリクエストするだけです。“字幕を抽出してスペイン語と日本語に翻訳して。”

03

SRTファイルを受け取る

原語のトランスクリプトに加え、ターゲット言語ごとに1つのSRTファイルがソース動画の隣に保存されます。

字幕翻訳ツール FAQ

動画から字幕を翻訳するにはどうすればよいですか?

AIエージェントにPerso Dubbingスキルをインストールし、APIキーを接続して、動画ファイル、フォルダ、またはURLと希望する言語を指定してください。100言語対応の音声認識で字幕を抽出して翻訳し、SRTファイルを動画の隣に保存します。

動画を吹き替えずに翻訳済み字幕を取得できますか?

はい。スキルはspeech-to-textプロジェクトのみを作成し(音声は生成されません)、エージェントが出力されたSRTを自ら翻訳します。speech-to-text料金のみで、翻訳ステップはPersoクレジットを消費しないため、吹替料金は発生しません。

ChatGPTやClaudeは動画の字幕を翻訳できますか?

元の動画からは翻訳できません。言語モデルは動画ファイルの音声を聞くことができません。Perso Dubbingスキルと組み合わせれば、Persoの音声認識がまず動画を字幕に変換し、その後エージェントがそのSRTをリクエストされた言語に翻訳します。

対応している動画形式は?

スキルはmp4、mov、webm、mp3、wav、m4aファイルに対応しています。自分のコンテンツであればURL(YouTube、TikTok、Google Drive、その他あらゆる直接動画リンク)も受け付けます。

動画の長さに制限はありますか?

固定の上限はありません。スキルが長い動画をロスレスで分割し、各パートを処理して結果を結合するため、クレジットが足りる限り数時間の録画でも問題なく動作します。一方、ウェブエディタは1動画あたり30分に制限されます。

動画フォルダ全体の字幕を一括で翻訳できますか?

はい。バッチ処理こそがこのスキルの存在意義です。フォルダを指定すれば再帰的に検索し、動画と言語のすべての組み合わせをキューに入れ、キューが満杯の場合は5分ごとに自動リトライし、中断されたジョブをチェックポイントから二重課金なしで再開します。

字幕翻訳のコストはいくらですか?

抽出はspeech-to-text料金で課金され、翻訳はエージェント自身のモデル内で実行されるためPersoクレジットは消費されません。クレジットカード不要の無料トライアルがあるので、まず実際の動画でテストできます。

字幕はどの言語に翻訳できますか?

音声認識は100のソース言語をカバーし、エージェントはリクエストされた事実上すべての言語にSRTを翻訳します。吹替音声も必要であれば、Perso Dubbingが同じワークフローから99+言語で音声を生成します。

すでに持っているSRTファイルを翻訳するには?

エージェントが既存のSRTファイルをそのまま翻訳でき、このステップはPersoを一切経由しないためクレジットは不要です。スキルが必要になるのは動画や音声から開始する場合です。音声認識がまずメディアを字幕に変換します。

いつもの作業環境で、字幕を翻訳

いつもの作業環境で、字幕を翻訳

いつもの作業環境で、字幕を翻訳

エージェントへの指示は一度だけ。動画フォルダを入れれば、翻訳済みSRTファイルが出てきます。speech-to-text料金のみで。