Video to Text の使い方 | アップロード、文字起こし、エクスポート
ファイルのアップロードから言語設定、文字起こしの開始、CSV・SRT・VTT・TXT 形式でのエクスポートまでの手順を解説します。
Video to Text の使い方はシンプルです。サインインして、対応ファイルをアップロードし、言語設定を選び、文字起こしが終わるのを待ち、必要な形式で結果をエクスポートします。
このガイドでは、アプリの現在の流れを解説します。形式の詳細を先に知りたい方は、Video to Text の対応メディア形式を、言語の選び方を知りたい方は、Video to Text の対応言語をご覧ください。
ステップ 1: サインインしてクレジットを確認する
文字起こしを始める前に、アカウントにサインインしてください。アプリは処理を開始する前に、アカウントへのアクセスと利用可能なクレジットを確認します。
新規ユーザーには30 の無料クレジットが付与されます。残りクレジットが選択したファイルに対して不足している場合、文字起こしの開始前にチャージするよう促す表示が出ます。
ステップ 2: 対応する音声または動画ファイルをアップロードする
アップロードエリアをクリックして、ファイルを選択してください。
Video to Text が現在受け付けているファイル形式は次のとおりです。
- 音声:
.aac,.flac,.m4a,.mp3,.oga,.ogg,.opus,.wav - 動画:
.mp4,.m4v,.mov,.mkv,.webm
アップロードのルールも重要です。
- 最大ファイルサイズ:5 GB
- メディアの最大長:10 時間未満
いずれかの上限を超えると、文字起こしが始まる前にワークフローが停止します。
ステップ 3: 言語オプションを選ぶ
ファイルを選んだら、録音内容に合った言語設定を選びます。
- 言語がわかっている場合は、特定の言語を選択します
- わからない場合は自動検出を使います
- 録音の中で言語が切り替わる場合は多言語検出を使います
この選択が特に重要になるのは、長時間のインタビュー、ポッドキャスト、国際的なチームミーティングです。
ステップ 4: 必要に応じて話者ラベルをオンにする
話者ラベルは、複数人が登場する会話で役立ちます。このオプションを有効にすると、文字起こしの内容を話者ごとに分けられるため、確認もエクスポート結果も読みやすくなります。
特に次のような場面で効果を発揮します。
- ミーティング
- インタビュー
- パネルディスカッション
- 授業の録音
ステップ 5: アップロードと文字起こしの完了を待つ
ファイルを送信すると、アプリはストレージへのアップロードを行い、その後文字起こしを開始します。処理中は進行状況のメッセージが表示されます。
Video to Text は短時間での処理を念頭に設計されていますが、全体の所要時間はいくつかの要素に左右されます。
- ファイルの長さ
- アップロード速度
- ファイルサイズ
- 音声がクリアかどうか
所要時間の目安を詳しく知りたい方は、Video to Text にはどれくらい時間がかかる?をお読みください。
ステップ 6: 文字起こし結果をエクスポートする
文字起こしが完了すると、エクスポートページに移動します。文字起こし結果は次の形式でエクスポートできます。
csvsrtvtttxt
次の作業に合わせて形式を選びましょう。
- 字幕には
srtかvtt - 表計算での確認や、構造化データとしての受け渡しには
csv - プレーンテキストの編集やメモには
txt
ワークフローの要約
短いバージョンだけ知りたい方のために、手順をまとめました。
- サインインします。
- 対応ファイルをアップロードします。
- ファイルが 5 GB 未満かつ 10 時間未満であることを確認します。
- 言語オプションを選びます。
- 必要なら話者ラベルをオンにします。
- 文字起こしを開始します。
- 完成した文字起こしを
csv、srt、vtt、txtのいずれかでエクスポートします。
より良い結果のためのコツ
- 手元にある最もクリーンなソースファイルをアップロードしましょう。
- 可能な限り正しい言語オプションを使いましょう。
- グループでの会話では話者ラベルをオンにしましょう。
- チームメンバーごとに必要な出力が違う場合は、複数の形式でエクスポートしましょう。
