Más de 90 idiomas · etiquetas de hablantes · SRT / VTT · resultados en ~1 minuto

Convierte audio y video en texto preciso

Sube un pódcast, una reunión o una clase — audio o video. Detectamos el idioma, etiquetamos quién dijo qué y te devolvemos texto buscable, con reproducción por frase y exportación de subtítulos.

Inicia sesión para transcribir tu primer archivo

Las cuentas gratuitas tienen 3 transcripciones cada día. Sin tarjeta de crédito, sin cuenta atrás de prueba.

Gratis: 3 archivos al día, de hasta 30 minutos cada uno, se renueva a medianoche UTC · una grabación de 30 minutos tarda alrededor de un minuto · sin tarjeta de crédito

Compatible conMP3WAVM4AAACFLACOGGMP4MOVWEBMMKV

Gratis cada día.

3 transcripciones gratis cada día — y cada archivo recibe el kit completo, no una versión recortada.

Etiquetas de hablantes

Una casilla, y cada línea vuelve etiquetada por voz y con código de tiempo.

Editor con reproducción por frase

Haz clic en cualquier frase para escuchar ese momento exacto — verificar una cita lleva segundos.

Subtítulos en un clic

Exporta SRT o VTT y llévalo directo a YouTube, Premiere o Final Cut.

Seis formatos de exportación

TXT, DOCX, PDF, CSV, SRT, VTT — descarga varios de una vez.

Un historial buscable

Encuentra el minuto en que salió un tema en lugar de volver a escuchar horas de grabación.

Video directo

Sube MP4, MOV, WEBM o MKV tal cual — sin extraer el audio antes.

Lo usanPodcastersPeriodistasEstudiantesInvestigadoresEquipos de productoAbogadosMédicosEditores de videoCreadores de cursos

Impulsado por Whisper.

El modelo de voz de OpenAI procesa tus archivos — aquí te contamos cuándo es preciso y cuándo no.

Dos motores, enrutados automáticamente

Whisper se encarga de la mayoría de archivos; un motor de diarización toma el relevo con audio largo o de varios hablantes. Lo decide el archivo — tú nunca eliges modelo.

Precisión honesta

Casi perfecto con un micrófono decente. Espera fallos en nombres, jerga y voces solapadas — sin promesas del 100%. Prueba con tu propio audio gratis.

Marcas de tiempo verificables

Tiempos nativos del modelo, normalmente con precisión de un segundo — haz clic en cualquier línea y compárala con el audio.

Más de 90 idiomas, detectados automáticamente

Inglés, español, japonés, chino y más. Las grabaciones mixtas se resuelven al idioma dominante.

Privado por defecto

Almacenado cifrado, nunca usado para entrenar modelos, ningún humano lo escucha — desaparece cuando lo borras.

Precio fijo, nada de taxímetro.

Los servicios por minuto convierten una sola hora de audio en una factura de 10–15 $. Aquí, un precio fijo cubre todo lo que transcribas en un mes — y el plan gratuito nunca caduca.

Gratis

$0/ para siempre

Para probarlo — o para un uso ligero del día a día.

  • 3 transcripciones al día, todos los días
  • Archivos de hasta 30 minutos / 50MB
  • Marcas de tiempo y etiquetas de hablantes
  • Exportación a TXT, PDF, DOCX, CSV, SRT, VTT
  • Más de 90 idiomas
  • Cola de procesamiento estándar
Más popular

Ilimitado

$10/ mes, facturado anualmente (120 $)

Para quienes transcriben como parte de su trabajo.

  • Transcripciones ilimitadas
  • Identificación de hablantes en cada archivo
  • Todas las herramientas de IA — resúmenes, limpieza, traducción
  • Procesamiento prioritario
  • Sin límite de duración por archivo — archivos de hasta 100MB

Preguntas que la gente hace de verdad.

Sobre precisión, privacidad, límites y qué significa realmente «gratis». Incluidas las escépticas.

¿Qué tan preciso es, en serio?

Con audio limpio — un micrófono decente, uno o dos hablantes, poco ruido de fondo — espera un texto casi perfecto con fallos ocasionales en nombres y jerga. La precisión baja con muchas voces solapadas, acentos marcados o salas ruidosas. La mejor prueba es tu propio audio: las primeras transcripciones son gratis.

¿Por qué tengo que iniciar sesión con Google?

El inicio de sesión es lo que nos permite dar a cada persona una cuota diaria gratuita real en lugar de una muestra de un solo uso. Un clic con Google — sin inventar contraseñas ni verificar el correo, y solo recibimos tu nombre, email y avatar.

¿Qué incluye realmente el plan gratuito?

3 transcripciones cada día, para siempre — cada una de hasta 30 minutos. No es una prueba de 7 días ni un crédito único. El contador se reinicia a medianoche UTC. Si necesitas más o archivos más largos, el plan Ilimitado elimina ambos techos.

¿Qué idiomas se admiten?

Más de 90, incluidos inglés, español, portugués, francés, alemán, japonés, coreano y chino. El idioma se detecta automáticamente — las grabaciones con varios idiomas suelen resolverse al dominante.

¿Puede con archivos de video?

Sí. Sube MP4, MOV, WEBM o MKV y transcribimos la pista de audio directamente — no hace falta extraer el audio antes.

¿Cómo funciona la identificación de hablantes?

Marca «Identificar hablantes» antes de subir. La IA separa las voces y etiqueta cada segmento (Hablante 1, Hablante 2, …). Es más fiable con turnos claros — entrevistas, reuniones, pódcasts — y menos cuando la gente habla a la vez.

¿Puedo fiarme de las marcas de tiempo?

Vienen directamente del modelo de voz y suelen estar a menos de un segundo del audio. Haz clic en cualquier línea del editor para escuchar la grabación original en ese momento y comprobarlo tú mismo. Las exportaciones de subtítulos conservan los tiempos originales de cada segmento, así que los subtítulos encajan en tu editor de video.

¿Mi audio es privado?

Tus archivos son privados de tu cuenta, se almacenan cifrados, nunca se comparten y nunca se usan para entrenar modelos de IA. La transcripción corre solo en sistemas automatizados — ningún humano escucha tu audio. Borra un archivo y desaparece de nuestro almacenamiento.

¿Qué puedo exportar?

Documentos PDF y DOCX, texto plano (TXT), hojas de cálculo (CSV) y archivos de subtítulos (SRT, VTT) — con marcas de tiempo opcionales por sección. Puedes seleccionar varios formatos y descargarlos de una vez.

¿Exactamente qué formatos de archivo puedo subir?

Audio: MP3, WAV, M4A, AAC, FLAC, OGG, OPUS, WMA, AIFF. Video: MP4, MOV, WEBM, MKV, MPEG, AVI. Si tu grabadora o editor lo produjo, casi seguro que funciona — y si algún formato falla, dínoslo y lo añadimos.

¿Por qué es tanto más barato que la transcripción humana?

Porque ningún humano hace el trabajo. Un transcriptor profesional cobra 1–2 $ por minuto de audio y necesita días; un modelo de voz nos cuesta centavos por hora y tarda alrededor de un minuto. Cambias un pequeño margen de precisión por una diferencia de precio de cien veces — y para lo que vayas a publicar, puedes hacer clic en cada línea y verificarla contra el audio.

¿Cuánto puedo transcribir realmente?

Gratis: 3 archivos al día, todos los días — hasta 90 grabaciones al mes sin pagar un centavo. Ilimitado: sin tope en el número de transcripciones; la única regla es una cuenta por persona.

¿Quién está detrás de esto?

Hola 👋 — Transcript.so lo construye un equipo independiente y pequeño, no un gigante inflado de capital riesgo. Respondemos nuestro propio correo de soporte, publicamos mejoras cada semana y mantenemos el servicio rápido y asequible porque nuestros costes están diseñados para ser bajos.

La próxima grabación no tiene por qué convertirse en una tarde entera tecleando.

Tu primera transcripción está a un minuto — gratis, sin tarjeta.

Transcribe un archivo — gratis