手元のYouTubeリンクをそのまま利用
通常の動画URL、youtu.beの共有リンク、公開ショート、公開ライブ配信アーカイブに対応します。非公開、削除済み、ログイン必須、ローカルネットワークのソースは利用できません。
公開YouTube動画、ショート、ライブ配信アーカイブのリンクを貼り付けます。動画内の音声を処理し、検索可能な文章、タイムスタンプ、再利用できる字幕ファイルを生成します。
YouTubeのURLからタイムスタンプ付き文字起こしを作成
公開YouTubeリンクをすでに持っている人向けの専用入口です。他の文字起こしツールと同じプロジェクト型ランタイムを使い、動画の発話を検索できる根拠、学習ノート、引用、字幕、編集可能な台本として保存します。
通常の動画URL、youtu.beの共有リンク、公開ショート、公開ライブ配信アーカイブに対応します。非公開、削除済み、ログイン必須、ローカルネットワークのソースは利用できません。
公開動画の音声を音声認識向けに準備するため、YouTube上に利用可能な字幕トラックがなくても処理できます。
標準モードが話し言葉を自動判定し、単語単位の時刻を返します。検索、引用、チャプターノート、字幕作成に利用できます。
完成したプロジェクト成果物をTXT、構造化JSON、SubRip SRT、WebVTTでダウンロードできます。同じ動画の再文字起こしは不要です。

公開されている長い授業を検索可能なノートに変換し、引用や復習に必要なタイムスタンプを保持します。
このYouTube講義を、言語の自動判定とタイムスタンプ付きで文字起こししてください。
発話の時間位置へ戻れる検索可能な文字起こしと字幕ファイル。
公開インタビュー、座談会、ポッドキャスト動画で発言者を分けたい場合は、話者対応モードを選べます。
このYouTubeインタビューを、話者ラベルと単語タイムスタンプ付きで文字起こししてください。
編集確認、引用、番組ノートに使える話者別の区間。
クレジットは実際の文字起こし時間で精算されます。時刻付きテキストには標準モード、発言者の区別には話者識別モードを選びます。
言語を自動判定し、単語単位のタイムスタンプを生成します。話者ラベルは追加しません。
話者ラベルと音声イベントに対応します。キーターム指定時は1時間540クレジットです。
完了結果には選択したモード、実時間、出力情報が残ります。TXT、JSON、SRT、VTTの再ダウンロードで追加の文字起こし料金は発生しません。
公開リンクまたはアップロードしたファイルを、時刻情報付きの構造化テキストと複数の出力形式へ変換します。

公開動画URLを貼るか、音声・動画ファイルを1つアップロードします。サンドボックスで取得と正規化を行ってから文字起こしします。

音声を検索可能な本文、時刻付き単語、読みやすい区間へ正規化します。高精度モードでは話者と音声イベントも保持できます。

完了した結果をTXT、JSON、SRT、WebVTTとして再利用でき、追加の文字起こしは発生しません。
講義を検索し、タイムスタンプ付きの引用を残し、動画の再生位置を何度も探さずに内容を確認できます。
発話内容を台本として取り出し、字幕、チャプター、番組ノート、ニュースレター、二次コンテンツに活用できます。
公開ウェビナー、インタビュー、デモ、解説動画をテキスト化してから、主張や要点を整理できます。
動画、ショート、youtu.be、ライブ配信アーカイブのURLを1つ追加します。ログインせずに公開アクセスできる必要があります。
単語タイムスタンプ付きテキストは1分10クレジットの標準モードを使います。話者ラベルが必要な場合は話者識別モードを指定します。
プロジェクトで文字起こし結果を開き、次の作業向けにTXT、JSON、SRT、VTTをダウンロードします。
YouTube、TikTok、Bilibiliなどの公開URLを貼るか、動画・音声ファイルをアップロード。検索本文、単語時刻、任意の話者ラベル、字幕を取得できます。
50 MB以下のMP4または対応音声ファイルを1つアップロード。話し声を検索可能な文章、単語タイムスタンプ、再利用できる文字起こし・字幕ファイルへ変換します。
音声にアクセスできる公開Reelまたは動画投稿のURLを貼り付け、検索可能な本文、タイムスタンプ、字幕ファイルを作成します。
公開TikTok動画URLを1件貼り付け、発話を検索本文とタイムスタンプへ変換し、字幕ファイルを出力します。
必要ありません。対応する公開YouTube動画の音声を処理できるため、YouTube上の字幕トラックだけに依存しません。
通常の公開動画URL、youtu.be共有リンク、公開ショート、公開ライブ配信アーカイブに対応します。非公開、削除済み、ログイン必須、地域制限付きの動画は処理できない場合があります。
標準文字起こしは1分につき10クレジットです。話者識別モードは1時間440クレジット、キーターム指定時は1時間540クレジットです。
はい。完成した文字起こし成果物は、TXT、構造化JSONに加えてSRTとVTT字幕として出力できます。
公開リンクを1つ貼り付け、文字起こし、タイムスタンプ、字幕ダウンロードを同じプロジェクトに保存できます。