Identificación de hablantes
El reconocimiento de voz con IA detecta y etiqueta a los distintos hablantes, para que las entrevistas y reuniones se lean con claridad.
Sube cualquier archivo de audio o vídeo, pega un enlace de YouTube, Vimeo o Instagram, o graba directamente desde tu micrófono. La IA transcribe el habla a texto con alta precisión, identificación automática de hablantes y traducción con un clic a más de 100 idiomas.
Transcribir
Transcribe audio y vídeo a texto con IA en más de 100 idiomas.
Abrir espacio de trabajo completo6 créditos por minuto.

Aspectos destacados
El reconocimiento de voz con IA detecta y etiqueta a los distintos hablantes, para que las entrevistas y reuniones se lean con claridad.
Pega un enlace de YouTube, Vimeo o Instagram, o extrae un archivo de Google Drive, Dropbox o OneDrive, sin descarga manual.
Activa la traducción automática para obtener la transcripción en tu idioma de destino junto con el texto en el idioma de origen.
Cómo funciona
Sube un archivo de hasta 2 GB, pega una URL de streaming o graba directamente en el navegador.
El habla se segmenta, se marca con marcas de tiempo y se etiqueta por hablante, con traducción opcional aplicada.
Descarga en SRT, VTT, TXT, PDF, DOCX o CSV, con o sin marcas de tiempo.
Capacidades
Tareas habituales
Preguntas frecuentes
Se admiten MP3, MP4, WAV, M4A, FLAC, OGG, WebM, MOV y AVI, hasta 2 GB por archivo.
Sí. Pega directamente la URL de YouTube, Vimeo o Instagram y la herramienta obtiene y transcribe el audio sin necesidad de una descarga manual.
Las transcripciones se exportan como SRT, VTT, TXT, PDF, DOCX o CSV, con o sin marcas de tiempo. También puedes traducir automáticamente la transcripción a más de 100 idiomas antes de exportar.
Sí. La identificación automática de hablantes etiqueta quién habla, algo útil para entrevistas, paneles y reuniones.
6 créditos por minuto de audio. El coste en créditos se muestra antes de confirmar el trabajo.