Más de 90 idiomas · etiquetas de hablantes · SRT / VTT · resultados en ~1 minuto
Convierte audio y video en texto preciso
Sube un pódcast, una reunión o una clase — audio o video. Detectamos el idioma, etiquetamos quién dijo qué y te devolvemos texto buscable, con reproducción por frase y exportación de subtítulos.
Inicia sesión para transcribir tu primer archivo
Las cuentas gratuitas tienen 3 transcripciones cada día. Sin tarjeta de crédito, sin cuenta atrás de prueba.
Gratis: 3 archivos al día, de hasta 30 minutos cada uno, se renueva a medianoche UTC · una grabación de 30 minutos tarda alrededor de un minuto · sin tarjeta de crédito
Gratis cada día.
3 transcripciones gratis cada día — y cada archivo recibe el kit completo, no una versión recortada.
Etiquetas de hablantes
Una casilla, y cada línea vuelve etiquetada por voz y con código de tiempo.
Editor con reproducción por frase
Haz clic en cualquier frase para escuchar ese momento exacto — verificar una cita lleva segundos.
Subtítulos en un clic
Exporta SRT o VTT y llévalo directo a YouTube, Premiere o Final Cut.
Seis formatos de exportación
TXT, DOCX, PDF, CSV, SRT, VTT — descarga varios de una vez.
Un historial buscable
Encuentra el minuto en que salió un tema en lugar de volver a escuchar horas de grabación.
Video directo
Sube MP4, MOV, WEBM o MKV tal cual — sin extraer el audio antes.
Impulsado por Whisper.
El modelo de voz de OpenAI procesa tus archivos — aquí te contamos cuándo es preciso y cuándo no.
Dos motores, enrutados automáticamente
Whisper se encarga de la mayoría de archivos; un motor de diarización toma el relevo con audio largo o de varios hablantes. Lo decide el archivo — tú nunca eliges modelo.
Precisión honesta
Casi perfecto con un micrófono decente. Espera fallos en nombres, jerga y voces solapadas — sin promesas del 100%. Prueba con tu propio audio gratis.
Marcas de tiempo verificables
Tiempos nativos del modelo, normalmente con precisión de un segundo — haz clic en cualquier línea y compárala con el audio.
Más de 90 idiomas, detectados automáticamente
Inglés, español, japonés, chino y más. Las grabaciones mixtas se resuelven al idioma dominante.
Privado por defecto
Almacenado cifrado, nunca usado para entrenar modelos, ningún humano lo escucha — desaparece cuando lo borras.
Precio fijo, nada de taxímetro.
Los servicios por minuto convierten una sola hora de audio en una factura de 10–15 $. Aquí, un precio fijo cubre todo lo que transcribas en un mes — y el plan gratuito nunca caduca.
Gratis
$0/ para siempre
Para probarlo — o para un uso ligero del día a día.
- 3 transcripciones al día, todos los días
- Archivos de hasta 30 minutos / 50MB
- Marcas de tiempo y etiquetas de hablantes
- Exportación a TXT, PDF, DOCX, CSV, SRT, VTT
- Más de 90 idiomas
- Cola de procesamiento estándar
Ilimitado
$10/ mes, facturado anualmente (120 $)
Para quienes transcriben como parte de su trabajo.
- Transcripciones ilimitadas
- Identificación de hablantes en cada archivo
- Todas las herramientas de IA — resúmenes, limpieza, traducción
- Procesamiento prioritario
- Sin límite de duración por archivo — archivos de hasta 100MB
Preguntas que la gente hace de verdad.
Sobre precisión, privacidad, límites y qué significa realmente «gratis». Incluidas las escépticas.
¿Qué tan preciso es, en serio?
Con audio limpio — un micrófono decente, uno o dos hablantes, poco ruido de fondo — espera un texto casi perfecto con fallos ocasionales en nombres y jerga. La precisión baja con muchas voces solapadas, acentos marcados o salas ruidosas. La mejor prueba es tu propio audio: las primeras transcripciones son gratis.
¿Por qué tengo que iniciar sesión con Google?
El inicio de sesión es lo que nos permite dar a cada persona una cuota diaria gratuita real en lugar de una muestra de un solo uso. Un clic con Google — sin inventar contraseñas ni verificar el correo, y solo recibimos tu nombre, email y avatar.
¿Qué incluye realmente el plan gratuito?
3 transcripciones cada día, para siempre — cada una de hasta 30 minutos. No es una prueba de 7 días ni un crédito único. El contador se reinicia a medianoche UTC. Si necesitas más o archivos más largos, el plan Ilimitado elimina ambos techos.
¿Qué idiomas se admiten?
Más de 90, incluidos inglés, español, portugués, francés, alemán, japonés, coreano y chino. El idioma se detecta automáticamente — las grabaciones con varios idiomas suelen resolverse al dominante.
¿Puede con archivos de video?
Sí. Sube MP4, MOV, WEBM o MKV y transcribimos la pista de audio directamente — no hace falta extraer el audio antes.
¿Cómo funciona la identificación de hablantes?
Marca «Identificar hablantes» antes de subir. La IA separa las voces y etiqueta cada segmento (Hablante 1, Hablante 2, …). Es más fiable con turnos claros — entrevistas, reuniones, pódcasts — y menos cuando la gente habla a la vez.
¿Puedo fiarme de las marcas de tiempo?
Vienen directamente del modelo de voz y suelen estar a menos de un segundo del audio. Haz clic en cualquier línea del editor para escuchar la grabación original en ese momento y comprobarlo tú mismo. Las exportaciones de subtítulos conservan los tiempos originales de cada segmento, así que los subtítulos encajan en tu editor de video.
¿Mi audio es privado?
Tus archivos son privados de tu cuenta, se almacenan cifrados, nunca se comparten y nunca se usan para entrenar modelos de IA. La transcripción corre solo en sistemas automatizados — ningún humano escucha tu audio. Borra un archivo y desaparece de nuestro almacenamiento.
¿Qué puedo exportar?
Documentos PDF y DOCX, texto plano (TXT), hojas de cálculo (CSV) y archivos de subtítulos (SRT, VTT) — con marcas de tiempo opcionales por sección. Puedes seleccionar varios formatos y descargarlos de una vez.
¿Exactamente qué formatos de archivo puedo subir?
Audio: MP3, WAV, M4A, AAC, FLAC, OGG, OPUS, WMA, AIFF. Video: MP4, MOV, WEBM, MKV, MPEG, AVI. Si tu grabadora o editor lo produjo, casi seguro que funciona — y si algún formato falla, dínoslo y lo añadimos.
¿Por qué es tanto más barato que la transcripción humana?
Porque ningún humano hace el trabajo. Un transcriptor profesional cobra 1–2 $ por minuto de audio y necesita días; un modelo de voz nos cuesta centavos por hora y tarda alrededor de un minuto. Cambias un pequeño margen de precisión por una diferencia de precio de cien veces — y para lo que vayas a publicar, puedes hacer clic en cada línea y verificarla contra el audio.
¿Cuánto puedo transcribir realmente?
Gratis: 3 archivos al día, todos los días — hasta 90 grabaciones al mes sin pagar un centavo. Ilimitado: sin tope en el número de transcripciones; la única regla es una cuenta por persona.
¿Quién está detrás de esto?
Hola 👋 — Transcript.so lo construye un equipo independiente y pequeño, no un gigante inflado de capital riesgo. Respondemos nuestro propio correo de soporte, publicamos mejoras cada semana y mantenemos el servicio rápido y asequible porque nuestros costes están diseñados para ser bajos.
La próxima grabación no tiene por qué convertirse en una tarde entera tecleando.
Tu primera transcripción está a un minuto — gratis, sin tarjeta.
Transcribe un archivo — gratis