Elige una grabación
Añade un archivo de audio o vídeo compatible, o graba desde el micrófono.
Separa distintas voces como Hablante 1, Hablante 2 y más, sin sacar la grabación de tu dispositivo.
Elige en la lista completa de idiomas de Whisper o deja que la herramienta detecte automáticamente el idioma hablado. Incluye español, inglés, chino, árabe, hindi, japonés, ruso, vietnamita y muchos más.
Esta herramienta usa el modelo de reconocimiento de voz Whisper de código abierto para transcribir audio y vídeo localmente. LocalScribe no está afiliado a OpenAI. Más sobre la transcripción Whisper →
Tu archivo permanece privado y se procesa en tu dispositivo.
La transcripción rápida está seleccionada por defecto.
Añade un archivo de audio o vídeo compatible, o graba desde el micrófono.
Selecciona el idioma hablado o usa la detección automática y sigue el progreso en pantalla.
Corrige el texto y guárdalo como TXT, SRT o subtítulos WebVTT.
La diarización opcional analiza características de las voces y alinea etiquetas anónimas con la transcripción. No reconoce nombres ni identidades.
Distingue participantes en llamadas y conversaciones grabadas al revisar notas y decisiones.
Separa preguntas y respuestas para obtener una transcripción más fácil de leer.
Etiqueta cambios de voz en episodios, tertulias y conversaciones grabadas.
Descarga texto y subtítulos con prefijos de hablante después de revisar el resultado.
La grabación que selecciones y la transcripción terminada permanecen en tu dispositivo. La herramienta de transcripción no las sube a nuestros servidores.
Estima quién habló y cuándo. Esta herramienta usa etiquetas anónimas como Hablante 1 y Hablante 2; no identifica a personas por su nombre.
Sí. Al activarla, la transcripción y el análisis de voces se realizan en tu dispositivo. La primera vez, el navegador descarga y guarda modelos adicionales.
Depende de la grabación. Las voces superpuestas, el ruido, las respuestas breves y las voces parecidas pueden causar errores; revisa las etiquetas antes de publicar.
La función opcional realiza una segmentación y comparación de voces adicional después de transcribir. Solo usa estos modelos cuando activas las etiquetas.