支持 YouTube 等主流平台
支持 YouTube、Vimeo、TikTok、抖音、Bilibili、X、Instagram、Facebook、Twitch 和 Dailymotion 的公开页面。
粘贴 YouTube、抖音、Bilibili 等公开视频链接,或上传一个音视频文件,获得可搜索文字、词级时间戳、可选说话人标签和字幕。
AI 视频转文字:生成时间戳与字幕
转写流程支持公开视频平台页面、公开媒体直链和项目上传文件,并复用现有任务、用量计费和项目结果流程。所有处理都在受保护的服务端环境中完成。
支持 YouTube、Vimeo、TikTok、抖音、Bilibili、X、Instagram、Facebook、Twitch 和 Dailymotion 的公开页面。
标准模式自动识别语言并返回词级时间戳,但不会添加无法可靠识别的说话人标签。
访谈需要区分发言人、保留音频事件或使用关键词引导时,可以选择说话人识别模式。
结果统一为全文、语言、时长、词、段落、说话人和来源信息,并可导出 JSON、TXT、SRT、VTT。

为双人访谈保留词级时间和说话人段落,便于剪辑与引用审核。
用精准模式转写这段访谈,并保留说话人标签。
生成项目内可搜索文字稿,并提供 SRT 与 VTT。
单人课程不需要区分说话人时,使用标准模式生成时间戳文字稿。
使用标准转写模式处理这节课程,并自动识别语言。
生成可搜索、带词级时间且不猜测说话人的文字稿。
积分按实际转写时长结算。只需根据输出需求选择模式,无需了解底层服务。
自动识别语言并生成词级时间戳;此模式不添加说话人标签。
支持说话人和音频事件标签;启用关键词引导时每小时 540 积分。
结果记录所选模式、实际时长和未支持选项,文字稿与导出链接受原项目权限保护。
一个公开链接或上传文件,会被处理成带时间信息的结构化文字,并可重复下载为多种格式。

粘贴公开视频 URL,或上传一个音频/视频文件。沙箱会先下载并标准化媒体,再开始转写。

语音会统一为可搜索全文、带时间的词和可读段落;精准模式还可保留说话人和音频事件。

完成后的结果可以直接复用为纯文本、结构化 JSON、SRT 字幕或 WebVTT,不会再次执行转写。
为节目笔记、金句、章节和编辑交接生成可审核的说话人文字稿。
把录课转成可搜索笔记和字幕文件,用于无障碍与本地化。
在总结主题或提取决策前,先保留带时间戳的原始证据。
粘贴公开 URL 或上传一个音视频文件;私网和本地地址会被拒绝。
标准模式用于生成时间戳文字;需要说话人或音频事件标签时,选择说话人识别模式。
在项目中查看文字稿,并下载 JSON、TXT、SRT 或 VTT。
支持公开 YouTube 视频、Shorts 和直播回放。系统处理视频中的语音,生成可搜索文字、时间戳和可复用字幕文件。
上传一个不超过 50 MB 的 MP4 或受支持音频文件,把其中的语音转成可搜索文字、词级时间和可复用逐字稿或字幕文件。
粘贴包含可访问口播音频的公开 Reel 或视频帖子 URL,生成可搜索文字、时间戳和字幕文件,无需重新上传媒体。
粘贴一个公开 TikTok 视频链接,提取可搜索口播文字与时间信息,并直接导出字幕,无需上传视频。
支持 YouTube、Vimeo、TikTok、抖音、Bilibili、X/Twitter、Instagram、Facebook、Twitch、Dailymotion 的公开页面,以及公开媒体直链和上传文件。
标准转写每分钟 10 积分。说话人识别模式每小时 440 积分;启用关键词引导时每小时 540 积分。
公开 URL 预处理最长支持 24 小时、最大下载 4 GB,并按 30 分钟分块。私有和局域网 URL 会被拒绝;实际处理限制可能更低。
所有结果都可导出 JSON、TXT、SRT 和 VTT。需要说话人和音频事件标签时,请选择说话人识别模式。
从一个 URL 或文件开始,再把文字稿用于字幕、笔记、研究和后续内容。