MediaJournalists

Transcripción de entrevistas para periodistas

La transcripción de entrevistas para periodistas puede ahorrar hasta un 90% del tiempo si se usa correctamente. Este artículo explica el flujo de trabajo paso a paso, los errores comunes, la normativa de accesibilidad (Ley 13/2022) y cómo herramientas como Speechyou pueden integrarse en la rutina periodística.

Updated 20 ago 2026 · 9 min read

Read this use case in 36 other languages

¿Por qué la transcripción de entrevistas para periodistas sigue siendo un cuello de botella?

Pocas tareas en el periodismo moderno consumen tanto tiempo como la transcripción manual de una entrevista. Una grabación de 45 minutos puede requerir dos o tres horas de trabajo repetitivo, y el riesgo de perder matices o citas textuales es alto. La forma más eficiente de trabajar hoy es apoyarse en herramientas de transcripción automática, siempre que se entiendan sus límites y se integren correctamente en el flujo de trabajo.

Este artículo explica cómo un periodista puede usar la transcripción de entrevistas para periodistas de manera profesional, desde la preparación hasta la exportación, con consejos prácticos, referencias legales y una visión honesta sobre lo que la tecnología puede —y no puede— hacer.

Puntos clave

  • La transcripción automática reduce el tiempo de procesamiento, pero requiere revisión humana para garantizar la precisión de citas y nombres propios.
  • La Ley 13/2022 General de Comunicación Audiovisual establece obligaciones de accesibilidad que afectan a medios con contenidos grabados.
  • El formato de subtítulos (SRT, VTT) puede servir tanto para accesibilidad como para la búsqueda rápida de fragmentos.
  • La calidad del audio de entrada determina en gran medida la calidad de la transcripción; un micrófono adecuado y una sala silenciosa son inversiones que valen la pena.
  • Speechyou admite más de 1.700 idiomas, lo que resulta útil para periodistas que cubren fuentes multilingües.

El flujo de trabajo real: de la grabación al texto usable

Antes de la entrevista: preparar el audio para la transcripción

La transcripción empieza mucho antes de pulsar el botón de grabar. Un periodista que planifica una entrevista para un reportaje de investigación o una crónica debe considerar:

  • Calidad del micrófono. Un micrófono externo, aunque sea un modelo de solapa básico, mejora drásticamente la relación señal-ruido. Los micrófonos de portátiles o teléfonos móviles suelen captar ruido de fondo que confunde al motor de transcripción.
  • Entorno acústico. Una sala con eco, tráfico exterior o conversaciones paralelas genera errores. Si no se puede controlar el entorno, hay que informar a la herramienta de que el audio puede tener baja calidad.
  • Consentimiento informado. En España, la Ley Orgánica de Protección de Datos exige informar a la persona entrevistada sobre la grabación y el uso posterior. Esto es especialmente relevante si se va a transcribir con una herramienta en la nube.

Durante la entrevista: grabar con inteligencia

Conviene grabar en dos formatos simultáneamente: un archivo de alta calidad (WAV o FLAC) como respaldo y un archivo comprimido (MP3 o M4A) para subir a la herramienta de transcripción. Algunas plataformas aceptan enlaces a reuniones de Zoom, Teams o Google Meet, pero la experiencia demuestra que subir el archivo directamente da más control sobre el resultado.

Después de la entrevista: subir, transcribir y revisar

Una vez que se tiene el archivo de audio, el proceso es:

  1. Subir el archivo a la herramienta de transcripción (por ejemplo, Speechyou).
  2. Elegir el idioma o idiomas presentes. Si la entrevista mezcla español e inglés, la detección automática suele funcionar, pero conviene verificarlo.
  3. Esperar el procesamiento. En archivos de hasta 60 minutos, el tiempo de espera es de unos pocos minutos.
  4. Descargar el borrador en texto plano o en formato de subtítulos (SRT, VTT).

Aquí viene el paso más importante: la revisión. Ningún sistema automático alcanza una precisión del 100% en nombres propios, siglas, acentos regionales o palabras técnicas. El periodista debe leer la transcripción, corregir errores y marcar las citas que piensa usar. La recomendación es dedicar al menos 15 minutos de revisión por cada hora de grabación.

Errores comunes que cometen los periodistas al transcribir (y cómo evitarlos)

  • Confiar ciegamente en la transcripción automática. Un error típico es copiar una cita directamente sin verificar. Si la cita aparece en un medio y el entrevistado la niega, el periodista es responsable.
  • No etiquetar a los hablantes. La mayoría de las herramientas diferencian voces si el audio es limpio, pero no siempre. Es mejor identificar a cada persona con un nombre o un código (Ej: "Entrevistador:", "Fuente:").
  • Ignorar los metadatos. Fecha, hora, duración y contexto de la entrevista son datos que deben acompañar al archivo final. Algunas herramientas permiten añadirlos; si no, el periodista debe hacerlo manualmente.
  • No usar la función de búsqueda. Las transcripciones largas son difíciles de navegar. La búsqueda por palabras clave permite localizar temas concretos sin leer todo el texto.

Tabla comparativa: formatos de salida según el uso

FormatoUso principalVentajasInconvenientes
TXTNotas internas, borradoresLigero, compatible con cualquier editorNo conserva marcas de tiempo ni etiquetas de hablante
DOCXArtículo, dossierPermite edición con estilos, ideal para Word o Google DocsPuede perder formato al convertir a otros formatos
SRTSubtítulos para vídeo o accesibilidadEstándar universal, aceptado por YouTube y reproductoresCada línea tiene un límite de caracteres; no apto para texto largo
VTTSubtítulos para web (HTML5)Soporta colores, posiciones y estilosMenos compatible con software antiguo que SRT
JSONIntegración con bases de datos o aplicacionesEstructura de datos programableNo legible directamente; requiere conocimientos técnicos

Nota: La elección del formato depende del destino final. Para un artículo, TXT o DOCX es suficiente. Para un reportaje multimedia, SRT o VTT añaden capas de accesibilidad y búsqueda.

La perspectiva de Corneliu desde Speechyou: cómo diseñamos para periodistas

En Speechyou, no creemos que la transcripción automática vaya a reemplazar el criterio del periodista. Nuestra obsesión es reducir el tiempo que se pierde en tareas mecánicas para que puedas dedicarte a lo que importa: contrastar datos, encontrar la historia y redactar con precisión.

Cuando diseñamos los flujos de trabajo, pensamos en tres cosas:

  1. La velocidad de la primera versión. Un periodista necesita un borrador en minutos, no en horas. Por eso optimizamos el procesamiento para archivos de hasta 60 minutos.
  2. La flexibilidad de idiomas. Con más de 1.700 idiomas disponibles, cubrimos desde entrevistas en lenguas cooficiales (catalán, euskera, gallego) hasta testimonios en lenguas minoritarias.
  3. La exportación sin fricción. Sabemos que el formato de salida es clave: SRT para subtítulos, VTT para web, TXT para notas. La compatibilidad con herramientas de edición debe ser inmediata.

No prometemos una precisión mágica. Te prometemos un punto de partida sólido que tú, como periodista, convertirás en un texto fiable.

Accesibilidad y marco legal: lo que la Ley 13/2022 exige a los medios

La Ley 13/2022, de 7 de julio, General de Comunicación Audiovisual (BOE) establece obligaciones de accesibilidad para los servicios de comunicación audiovisual. En concreto, los canales de televisión deben garantizar el subtitulado para personas sordas, la audiodescripción y la lengua de signos en determinados porcentajes de su programación.

Aunque esta ley se aplica principalmente a televisiones y plataformas de vídeo bajo demanda, los periodistas que producen contenido multimedia deben conocerla porque:

  • Si tu medio publica entrevistas en vídeo, es recomendable incluir subtítulos (SRT o VTT) para cumplir con los estándares de accesibilidad.
  • La Comisión Nacional de los Mercados y la Competencia (CNMC) actúa como punto de contacto único para quejas sobre accesibilidad. Esto significa que los ciudadanos pueden reclamar si un medio no ofrece subtítulos.
  • La Universitat Autònoma de Barcelona ofrece un máster en audiodescripción y subtitulado para personas sordas que forma profesionales en este ámbito, lo que indica que la demanda de contenido accesible está creciendo.

Para un periodista, esto supone una oportunidad: generar contenido que cumpla con la normativa y que llegue a una audiencia más amplia. La transcripción automática, combinada con la revisión humana, puede producir subtítulos de calidad sin un coste desorbitado.

Cómo organizar el trabajo en equipo: espacios de trabajo y permisos

Las redacciones modernas trabajan de forma colaborativa. Un reportaje puede involucrar a un redactor, un editor, un verificador de datos y un diseñador multimedia. La transcripción debe estar accesible para todos, pero con distintos niveles de permiso.

En la práctica, se puede:

  • Crear un espacio de trabajo por proyecto (Ej: "Elecciones 2025").
  • Asignar permisos de edición solo al redactor principal y al editor.
  • Dar permisos de solo lectura al verificador y al diseñador.
  • Compartir enlaces de transcripción en lugar de archivos adjuntos, para evitar duplicados.

Esta organización evita que dos personas corrijan el mismo error o que se pierdan versiones antiguas. Además, las herramientas de búsqueda permiten localizar declaraciones clave sin tener que leer todas las transcripciones.

Preguntas frecuentes

1. ¿Qué precisión tiene la transcripción automática para entrevistas en español?

La precisión depende de la calidad del audio, la claridad del hablante y la presencia de ruido de fondo. En condiciones óptimas (micrófono externo, sala silenciosa, un solo hablante), puede superar el 95% de precisión. Sin embargo, nombres propios, siglas y acentos regionales suelen requerir corrección manual. Es una herramienta de productividad, no un sustituto de la revisión humana.

2. ¿Puedo transcribir entrevistas que mezclan varios idiomas?

Sí, muchas herramientas de transcripción, como Speechyou, admiten detección automática de idiomas. Si la entrevista alterna entre español e inglés, el sistema debería reconocer ambos idiomas. No obstante, si hay cambios bruscos o terceros idiomas poco comunes, es mejor configurar manualmente los idiomas esperados.

3. ¿Qué formatos de exportación son útiles para periodistas?

Los más comunes son TXT (notas), DOCX (borradores editables), SRT (subtítulos para vídeo) y VTT (subtítulos para web). Si trabajas con herramientas de edición de vídeo, el formato SRT es el estándar. Para artículos, DOCX permite conservar formato y estilos.

4. ¿La transcripción automática es legal para entrevistas confidenciales?

Depende de la política de privacidad de la herramienta. Es importante revisar dónde se almacenan los archivos de audio y las transcripciones. Para entrevistas sensibles (fuentes anónimas, información clasificada), se recomienda usar herramientas que permitan el procesamiento local o que ofrezcan garantías contractuales de protección de datos. La Ley de Protección de Datos española exige informar a la persona entrevistada sobre el uso de la grabación.

5. ¿Puedo usar la transcripción para generar subtítulos automáticos?

Sí, los formatos SRT y VTT están diseñados para subtítulos. La transcripción automática puede servir como base, pero los subtítulos requieren sincronización de marcas de tiempo y, a menudo, una edición para que quepan en pantalla. Es un proceso semiautomático: la máquina genera el texto, el humano lo ajusta.

6. ¿Cuánto tiempo se ahorra usando transcripción automática frente a la manual?

Una entrevista de 60 minutos puede transcribirse manualmente en 3-4 horas. Con transcripción automática, el borrador está listo en 5-10 minutos, y la revisión posterior lleva unos 15-30 minutos. El ahorro es de aproximadamente un 90% del tiempo, siempre que se dedique el tiempo necesario a la corrección.

7. ¿Qué debo hacer si el audio tiene mucho ruido de fondo?

En primer lugar, intenta mejorar la calidad del audio antes de subirlo: filtros de reducción de ruido en software de edición (Audacity, Adobe Audition) pueden ayudar. Si el ruido persiste, la transcripción contendrá errores. En ese caso, es mejor subir el audio con una nota indicando que hay ruido, y luego dedicar más tiempo a la revisión manual.

Conclusión: la transcripción como herramienta, no como muleta

La transcripción de entrevistas para periodistas ha dejado de ser un trabajo artesanal para convertirse en un proceso híbrido. La inteligencia artificial acelera la fase de producción del borrador, pero el juicio, la verificación y la edición siguen siendo responsabilidad del periodista. La Ley 13/2022 añade una capa de exigencia en accesibilidad que convierte la transcripción en una oportunidad para llegar a más audiencias.

Si quieres probar cómo Speechyou puede integrarse en tu flujo de trabajo, puedes empezar hoy mismo desde app.speechyou.com/sign-up. No necesitas tarjeta de crédito para las primeras transcripciones.

Fuentes citadas:

Research

Sources and further reading

  1. Ley 13/2022, de 7 de julio, General de Comunicación Audiovisual Agencia Estatal Boletín Oficial del Estado
  2. Accesibilidad: Punto de contacto único (PCU) | CNMC Comisión Nacional de los Mercados y la Competencia
  3. Audiodescripción y Subtitulado para Personas Sordas (máster) Universitat Autònoma de Barcelona
  4. Descripción del sistema de codificación TEXTOS ORALES (CORPES XXI) Real Academia Española

Speech to editable text

Ready to Try Speechyou?

Turn recorded speech into editable text in Español and explore a practical transcription workflow for your team.

Related Media Use Cases