Envie um MP4 para transcrição
Anexe um arquivo de vídeo ou áudio diretamente do seu dispositivo. Cada tarefa aceita uma fonte, e o sistema de envio compartilhado aplica o limite máximo de 50 MB ao arquivo.
Envie um arquivo MP4 ou de áudio compatível de até 50 MB. Converta o conteúdo falado em texto pesquisável, marcações de tempo por palavra e arquivos de transcrição ou legenda para download e reutilização.
Converter MP4 em texto com marcações de tempo
Use este conversor de MP4 em texto quando a gravação já estiver salva no seu dispositivo. Envie um arquivo MP4 ou de áudio compatível, transcreva o áudio falado sem precisar de uma faixa de legendas existente e mantenha o texto pesquisável, as marcações de tempo e os downloads de legendas como um item protegido do projeto.
Anexe um arquivo de vídeo ou áudio diretamente do seu dispositivo. Cada tarefa aceita uma fonte, e o sistema de envio compartilhado aplica o limite máximo de 50 MB ao arquivo.
O reconhecimento de fala funciona a partir do áudio da mídia, portanto o MP4 não precisa ter legendas incorporadas nem um arquivo de legendas separado.
A transcrição padrão detecta automaticamente o idioma falado e retorna marcações de tempo por palavra para revisão, citações, edição e geração de legendas.
Reutilize o resultado concluído em TXT, JSON estruturado, SubRip SRT ou WebVTT sem enviar e transcrever o mesmo arquivo novamente.

Envie a gravação de uma apresentação e preserve a explicação falada como texto pesquisável com marcações de tempo para consultar depois.
Transcreva esta apresentação em MP4 com detecção automática de idioma e marcações de tempo por palavra.
Uma transcrição no projeto e arquivos de legenda vinculados à linha do tempo da gravação.
Escolha o modo com identificação de participantes para uma entrevista, um painel ou uma conversa gravada localmente que precise identificar cada turno de fala.
Transcreva esta entrevista enviada com rótulos de participante e marcações de tempo por palavra.
Segmentos com identificação de participantes para revisão editorial, citações e notas do programa.
Os créditos são calculados com base na duração real da transcrição. Escolha a transcrição padrão para texto com marcações de tempo ou a transcrição com identificação de participantes quando o diálogo precisar ser atribuído.
Inclui detecção automática de idioma e marcações de tempo por palavra. Este modo não adiciona rótulos de participante.
Adiciona rótulos de participante e marcadores de eventos de áudio. Ativar a orientação por termos-chave custa 540 créditos por hora.
O resultado concluído registra o modo selecionado, a duração real e as exportações. Os downloads em TXT, JSON, SRT e VTT não iniciam outra tarefa de transcrição.
Veja como um link público ou arquivo enviado se transforma em texto estruturado com dados de tempo e formatos reutilizáveis para download.

Cole a URL pública de um vídeo ou envie um arquivo de áudio ou vídeo. O ambiente baixa e normaliza a fonte antes da transcrição.

A fala é normalizada em texto pesquisável, palavras com marcações de tempo e segmentos legíveis. O modo com identificação de participantes também pode manter os rótulos de participante e os eventos de áudio.

Reutilize o resultado concluído como texto simples, JSON estruturado, legendas SRT ou WebVTT sem iniciar outra tarefa de transcrição.
Transforme uma edição exportada ou um arquivo de câmera em um roteiro pesquisável antes de selecionar citações, legendas e capítulos.
Preserve evidências com marcações de tempo de uma gravação enviada antes de produzir resumos ou extrair decisões.
Crie anotações e arquivos de legenda a partir de aulas gravadas para revisão, acessibilidade e encaminhamento para localização.
Escolha um arquivo MP4 ou de áudio compatível no seu dispositivo. Divida ou compacte uma fonte maior antes de enviá-la.
Escolha a transcrição padrão por 10 créditos por minuto para obter texto com marcações de tempo por palavra ou o modo com identificação de participantes quando forem necessários rótulos reais de participante ou marcadores de eventos de áudio.
Abra a transcrição concluída no projeto e baixe os arquivos TXT, JSON, SRT ou VTT para edição, anotações ou legendas.
Cole a URL pública de um vídeo compatível ou envie um arquivo de mídia. Este conversor de vídeo para texto cria uma transcrição pesquisável, com marcação de tempo por palavra, identificação opcional de falantes e arquivos prontos para legendas.
Cole o link de um vídeo público, Short ou replay de transmissão ao vivo do YouTube. Gere a transcrição do vídeo com marcações de tempo por palavra, texto pesquisável e arquivos de legenda reutilizáveis.
Cole a URL de um Reel ou de uma publicação de vídeo pública do Instagram com áudio falado acessível. Gere a transcrição do Reel com marcações de tempo e arquivos de legenda sem precisar enviar a mídia novamente.
Cole o link de um vídeo público do TikTok. Transcreva o áudio falado em texto pesquisável, preserve marcações de tempo úteis e exporte legendas sem precisar enviar o clipe.
Anexe um arquivo MP4 ou de áudio compatível, escolha o modo de transcrição e inicie a tarefa do projeto. O resultado inclui texto pesquisável e pode incluir marcações de tempo por palavra, legendas ou rótulos de participante.
Cada tarefa de transcrição aceita um arquivo de vídeo ou áudio enviado de até 50 MB. Uma gravação maior precisa ser compactada ou dividida antes do envio.
Sim. O processo transcreve o áudio falado e não exige que o arquivo contenha uma faixa de legendas incorporada.
Sim. Toda transcrição concluída pode ser exportada em SRT e VTT, além de TXT e JSON. A transcrição com identificação de participantes custa 440 créditos por hora ou 540 créditos por hora com orientação por termos-chave; a transcrição padrão custa 10 créditos por minuto.
Anexe um arquivo e mantenha a transcrição, as marcações de tempo e os downloads de legendas juntos no mesmo projeto.