Genera una transcripción de TikTok desde una URL pública
Empieza con la URL de un vídeo de TikTok accesible públicamente. No se solicitan credenciales de ninguna cuenta y las publicaciones privadas o inaccesibles siguen sin estar disponibles.
Pega un enlace a un vídeo público de TikTok. Transcribe el audio hablado a texto consultable, conserva marcas de tiempo útiles y exporta subtítulos sin subir el vídeo.
Transcribir vídeo de TikTok con marcas de tiempo
Este generador de transcripciones de TikTok convierte el audio hablado de la URL de un vídeo público en texto consultable con marcas de tiempo. Úsalo para comprobar subtítulos, analizar tendencias, extraer citas, preparar localizaciones o reutilizar guiones. No se pueden obtener vídeos privados, eliminados, que requieran iniciar sesión, estén restringidos por región o no sean accesibles por cualquier otro motivo; el flujo de trabajo no elude los controles de acceso de TikTok.
Empieza con la URL de un vídeo de TikTok accesible públicamente. No se solicitan credenciales de ninguna cuenta y las publicaciones privadas o inaccesibles siguen sin estar disponibles.
La transcripción estándar detecta el idioma hablado y devuelve marcas de tiempo por palabra para revisar ganchos, afirmaciones, llamadas a la acción y subtítulos.
Elige el modo con reconocimiento de hablantes cuando un sketch, una entrevista o un vídeo callejero contenga voces distintas que deban atribuirse.
Reutiliza la transcripción guardada en el proyecto como TXT o JSON para analizarla y como SRT o VTT para crear subtítulos.

Convierte un TikTok promocional público en texto consultable para que un equipo pueda revisar el gancho inicial, las afirmaciones y la llamada a la acción.
Transcribe este TikTok público con marcas de tiempo por palabra.
Texto hablado con marcas de tiempo para analizar la campaña y comprobar los subtítulos.
Usa el modo con reconocimiento de hablantes cuando un TikTok público alterne entre un entrevistador y varios participantes.
Transcribe esta entrevista callejera de TikTok con etiquetas de hablante.
Diálogo etiquetado para citas, notas de edición y subtítulos.
Los créditos se calculan a partir de la duración real de la transcripción. Elige la transcripción estándar para obtener texto con marcas de tiempo o la transcripción con reconocimiento de hablantes cuando sea necesario atribuir el diálogo.
Incluye detección automática del idioma y marcas de tiempo por palabra. Este modo no añade etiquetas de hablante.
Añade etiquetas de hablante y de eventos de audio. Si se activa la guía de términos clave, el coste es de 540 créditos por hora.
El resultado guarda el modo seleccionado, la duración real y las exportaciones. Descargar TXT, JSON, SRT o VTT no inicia otra transcripción.
Descubre cómo un enlace público o un archivo subido se convierte en texto estructurado con datos de tiempo y formatos de descarga reutilizables.

Pega la URL de un vídeo público o sube un archivo de audio o vídeo. El entorno aislado descarga y normaliza la fuente antes de transcribirla.

El habla se normaliza y se convierte en texto consultable, palabras con marcas de tiempo y segmentos legibles. El modo con reconocimiento de hablantes también puede conservar las etiquetas de hablante y los eventos de audio.

Reutiliza el resultado como texto sin formato, JSON estructurado, subtítulos SRT o WebVTT sin iniciar otra transcripción.
Busca ganchos hablados y mensajes recurrentes en referencias públicas de TikTok antes de redactar un briefing creativo.
Compara la pista de audio con los subtítulos publicados y prepara archivos SRT o VTT corregidos para un flujo de trabajo autorizado.
Extrae el guion hablado con marcas de tiempo antes de traducirlo, revisar citas o adaptar el contenido de forma responsable.
Añade el enlace de un vídeo accesible públicamente. No se pueden procesar fuentes privadas, eliminadas, que requieran iniciar sesión o que estén bloqueadas.
Elige la transcripción estándar para obtener marcas de tiempo por palabra o el modo con reconocimiento de hablantes cuando necesites etiquetas para distinguirlos.
Abre el resultado del proyecto y descarga archivos TXT, JSON, SRT o VTT para analizarlos, editarlos o trabajar con subtítulos.
Pega la URL pública de un vídeo compatible o sube un archivo multimedia. Este conversor de vídeo a texto crea una transcripción consultable, marcas de tiempo por palabra, etiquetas de hablante opcionales y archivos listos para subtítulos.
Pega el enlace de un vídeo público, Short o repetición de una emisión en directo de YouTube. Genera la transcripción del vídeo con marcas de tiempo por palabra, texto consultable y archivos de subtítulos reutilizables.
Sube un archivo MP4 o de audio compatible de hasta 50 MB. Convierte el contenido hablado en texto consultable, marcas de tiempo por palabra y archivos descargables de transcripción o subtítulos que podrás reutilizar.
Pega la URL de un Reel o una publicación de vídeo pública de Instagram con audio hablado accesible. Genera la transcripción del Reel con marcas de tiempo y archivos de subtítulos sin volver a subir el contenido.
Introduce la URL de un vídeo público de TikTok. El sistema procesa el audio y guarda en el proyecto un texto con marcas de tiempo en el que se pueden hacer búsquedas.
Las fuentes previstas son páginas de vídeos de TikTok accesibles públicamente. Es posible que no se puedan obtener publicaciones privadas, eliminadas, que requieran iniciar sesión, estén restringidas por región o no estén disponibles por cualquier otro motivo.
La transcripción estándar cuesta 10 créditos por minuto. La transcripción con reconocimiento de hablantes cuesta 440 créditos por hora, o 540 créditos por hora con guía de términos clave.
Sí. Descarga el resultado como TXT o JSON estructurado para trabajar con la transcripción, o como archivos SRT y VTT con marcas de tiempo para crear subtítulos.
Empieza con un enlace público y conserva en tu proyecto el texto hablado, las marcas de tiempo y los archivos de subtítulos.