文字起こしカテゴリ
オンライン文字起こし:あらゆる録音形式を1つのワークフローで
ForgeFileは、MP3、WAV、MP4、AVI、MOV、SRT、VTTなど、一般的な音声・動画形式すべてに対応して文字起こしを行います。最初に決めるのは、ファイルの形式から始めるか、録音した内容から始めるかだけです。以下の形式ページとワークフローページから、適切なものをお選びください。
定義
音声・動画文字起こし とは?
Audio transcription converts speech in an audio or video file into written text, usually with timestamps and speaker labels, and exports to SRT, VTT or plain text.
- 98% 精度
- 話者認識
- 数分で結果を取得
音声・動画文字起こし のワークフロー
チームに必要なファイル形式、コンテンツの種類、ワークフローを正確に選択できます。各ページは具体的なタスクに合わせて最適化されています。
video transcription
srt transcription
vtt transcription
mp3 transcription
wav transcription
m4a transcription
flac transcription
mp4 transcription
avi transcription
mov transcription
mkv transcription
aac transcription
ogg transcription
amr transcription
wma transcription
webm transcription
mts transcription
音声・動画文字起こし の専門ワークフロー
言語ペアや文書種別ごとのワークフローに対応した階層ページ。
オンライン文字起こしの仕組み - 簡単4ステップ
- 1
音声または動画ファイル(MP3、MP4、WAV、MOV、その他15以上の形式)をアップロード
- 2
文字起こしオプションを選択 - 話者認識、タイムスタンプ、字幕形式
- 3
AIがファイルを処理し、数分で整形された文字起こし結果を作成
- 4
文字起こし結果(TXT、DOCX)または字幕ファイル(SRT、VTT)をすぐにダウンロード
文字起こしでよく使われる形式
音声・動画文字起こしにForgeFileが選ばれる理由
これは文字起こしのカテゴリであり、単一のツールではありません。 以下には、ForgeFileが対応するすべての音声形式(MP3、WAV、M4A、FLAC、AAC、OGG、WMA、AMR)、すべての動画形式(MP4、AVI、MOV、MKV)、両方の字幕形式(SRT、VTT)の専用ページに加えて、よくある録音タイプ向けのワークフローページがあります。実際にお持ちのものに合ったページを選べば、そのために作られたエクスポートオプションにたどり着けます。
ファイルの形式から始める
すでに扱う内容がわかっている場合は、そのページに直接進んでください。音声はMP3、WAV、M4A、FLAC、AAC、OGG、WMA、AMR、動画はMP4、AVI、MOV、MKVです。各形式ページは、コーデック対応から圧縮まで、そのファイル形式に合わせて構成されています。
または録音した内容から始める
どの形式ページが当てはまるかわからない場合は、代わりに録音の種類から始めてください。ForgeFileには、インタビュー、講義、通話、ポッドキャスト、Zoom会議それぞれの専用ワークフローページがあり、各録音タイプの一般的な構成に合わせて作られています。
動画か音声か?
動画の文字起こしは、音声認識を実行する前に音声トラックを抽出するため、動画ファイルには音声ファイルには不要な工程が1つ加わります。ファイルが動画の場合は、音声用ではなく動画文字起こしのページをご利用ください。その抽出工程を考慮した作りになっています。
文字起こしか字幕か?
通常の文字起こし結果と字幕ファイルは、解決する課題が異なります。読む、検索する、アーカイブするための文書が必要な場合は、上記の形式ページのいずれかをご利用ください。YouTube、Vimeoなどのプラットフォーム向けに動画に合わせたタイミングの字幕が必要な場合は、代わりにSRTまたはVTTのページをご利用ください。これらは通常の文字起こし結果ではなく、時間同期された字幕ファイルをエクスポートします。
まだどこから始めればよいか迷っていますか?音声・動画のページはファイル形式を、ワークフローページは録音の種類をカバーしています。どちらの経路も同じ文字起こしエンジンにたどり着きますが、より早くそこに到達できるよう調整されています。
よくある質問 - オンライン文字起こし
AI文字起こしの精度はどれくらいですか?
精度は、情報源が音声か動画かではなく、録音の音声品質によって決まります。動画の文字起こしは、最初に音声トラックを抽出してから、同じ方法で文字起こしを行います。ファイルに合わせて上記の音声または動画のページを選べば、どちらでも同じ精度が期待できます。
文字起こしにはどのくらい時間がかかりますか?
ほとんどのファイルは、長さにかかわらず2〜5分で文字起こしされます。1時間の録音でも通常3〜4分で結果が返されます。処理時間はファイルサイズやサーバーの負荷によって異なりますが、結果は常に同一セッション内で確実に届きます。
対応している音声・動画形式は何ですか?
このカテゴリでは、すべての形式に専用ページがあります。音声:MP3、WAV、M4A、FLAC、AAC、OGG、AMR、WMA。動画:MP4、AVI、MOV、MKV。文書ではなく字幕が必要な場合は、代わりにSRTまたはVTTのページをご利用ください。
複数の話者を識別できますか?
はい - 話者分離は、特定の形式だけでなく、このカテゴリのすべての音声・動画ページで利用できます。ファイルに合った形式またはワークフローページを選んでご利用ください。
どの字幕形式で出力できますか?
SRTとVTTは、文字起こしページ内の設定ではなく、このカテゴリの別々のページです。ほとんどの動画プレーヤーや編集ソフトとの互換性が必要な場合はSRTページを、HTML5のWeb動画やYouTubeなどのプラットフォーム向けにはVTTページをご利用ください。字幕ではなく文書が必要な場合は、代わりに上記の形式ページのいずれかをご利用ください。
音声・動画データのプライバシーは保護されますか?
はい。このカテゴリのすべてのページ - 音声、動画、字幕、ユースケースのワークフローのいずれも - ファイルを転送中に暗号化し、処理後に削除します。
文字起こしにはアカウント作成が必要ですか?
無料アカウントの作成は1分もかかりません。クレジットカード不要。無料プランでは短いファイルを無料で文字起こしでき、有料プランでは長いファイル、一括処理、書き起こし履歴が利用できます。
英語以外の言語のファイルも文字起こしできますか?
はい。ForgeFileはスペイン語、フランス語、ドイツ語、ポルトガル語、イタリア語、日本語、中国語、アラビア語、ヒンディー語など30以上の言語の文字起こしに対応しています。言語は自動検出されるほか、最良の結果を得るために手動で選択することもできます。