從公開的 Instagram 頁面開始
貼上一個無須登入即可存取的 Reel 或影片貼文網址。流程不會要求提供 Instagram 登入憑證,也不會繞過私人帳號限制。
貼上含有可取得語音內容的公開 Reel 或影片貼文網址,即可產生可搜尋文字、時間戳與字幕檔案,無須重新上傳媒體。
Instagram 影片轉文字:將公開 Reel 轉成附時間戳的逐字稿
這個入口適合處理公開發布於 Instagram Reels 或影片貼文中的語音內容。系統會將可取得的音訊轉成專案逐字稿,用於修正字幕、審核引文、社群媒體研究與內容再利用。私人帳號、Stories、需要登入的頁面、已刪除貼文,以及沒有可用音訊的貼文,都不能作為轉錄來源。
貼上一個無須登入即可存取的 Reel 或影片貼文網址。流程不會要求提供 Instagram 登入憑證,也不會繞過私人帳號限制。
標準轉錄模式會自動辨識口語語言並保留單字級時間,方便搜尋、引用、製作字幕及審核短影片。
訪談或多人短片需要區分發言者時,請選擇說話者辨識模式,避免讓標準模式猜測其不支援的說話者資訊。
受專案權限保護的結果可下載為 TXT、結構化 JSON、SRT 和 WebVTT,無須再次執行轉錄。

將公開知識型 Reel 的語音內容整理成文字,用於審核、合規引用或提供無障礙文字。
轉錄這個公開的 Instagram Reel,自動辨識語言並保留時間戳。
產生可搜尋的語音逐字稿、時間定位及字幕下載檔案。
品牌訪談或活動短片含有多個聲音時,使用說話者模式保留發言輪次。
使用說話者模式轉錄這個公開的 Instagram 訪談影片。
產生適合編輯審核、引用及社群媒體文案的說話者段落。
點數依實際轉錄長度計算。只需要附時間的文字時選擇標準轉錄;需要區分發言者時,則選擇說話者辨識模式。
自動辨識語言並產生詞級時間戳;此模式不會新增說話者標籤。
支援說話者與音訊事件標籤;啟用關鍵字引導時,每小時 540 點。
結果會儲存在專案中,並記錄所選模式與實際長度;下載 TXT、JSON、SRT、VTT 不會再次扣除轉錄點數。
一個公開連結或上傳檔案會被處理成附時間資訊的結構化文字,並可重複下載為多種格式。

貼上公開影片網址,或上傳音訊/影片檔案。系統會先下載並標準化媒體,再開始轉錄。

語音會統整為可搜尋全文、附時間的字詞及易讀段落;精準模式還可保留說話者與音訊事件。

完成後的結果可直接重複使用為純文字、結構化 JSON、SRT 字幕或 WebVTT,不會再次執行轉錄。
審核已發布的語音內容、修正字幕,並保存公開行銷 Reel 中已核准的說法。
將公開的創作者觀點轉成可搜尋文字,同時保留可回到原始影片的時間位置。
還原 Reel 腳本,用於字幕、內容摘要、在地化準備,或註明來源的內容再利用。
使用無須登入即可存取的 Reel 或影片貼文;私人、已刪除、需要登入或沒有音訊的貼文無法轉錄。
標準模式適合產生附時間的文字;確實需要說話者或音訊事件標籤時,請選擇說話者辨識模式。
開啟已完成的成果,下載 TXT、JSON、SRT 或 VTT,用於字幕、研究或編輯工作。
貼上 YouTube、抖音、Bilibili 等公開影片連結,或上傳一個影音檔案,即可取得可搜尋的文字、逐字時間戳、選用講者標籤和字幕。
支援公開的 YouTube 影片、Shorts 和直播重播。系統會處理影片中的語音,產生可搜尋的文字、時間戳與可重複使用的字幕檔案。
上傳一個不超過 50 MB 的 MP4 或支援的音訊檔案,將其中的語音轉成可搜尋文字、逐字時間資訊,以及可重複使用的逐字稿或字幕檔案。
貼上一個公開的 TikTok 影片連結,擷取可搜尋的口播文字與時間資訊,並直接匯出字幕,無須上傳影片。
適用於含有可取得語音內容的公開 Reels 與影片貼文。不支援私人帳號、Stories、已刪除貼文及需要登入的頁面。
只有公開來源實際提供可用影片或音訊時才能轉錄。沒有口述媒體的靜態圖片貼文無法進行語音辨識。
標準轉錄每分鐘 10 點。說話者辨識模式每小時 440 點,啟用關鍵字引導時每小時 540 點。
可以。完成後的逐字稿可下載為 SRT、VTT、TXT 和結構化 JSON。
從一個可存取的 Reel 或影片網址開始,將逐字稿、時間資訊和字幕檔案儲存在專案中。