Elige una grabación
Agrega un archivo de audio o video compatible, o graba con el micrófono.
Separa las voces como Hablante 1, Hablante 2 y así sucesivamente, mientras la grabación permanece en tu dispositivo.
Elige uno de los 99 idiomas del modelo Whisper o permite que la herramienta detecte automáticamente el idioma hablado. Incluye español, inglés, chino, árabe, hindi, japonés, ruso, vietnamita y muchos más.
Esta herramienta usa el modelo abierto de reconocimiento de voz Whisper para transcribir audio y video localmente. LocalScribe no está afiliado a OpenAI. Conoce más sobre la transcripción Whisper →
Tu archivo permanece privado y se procesa en tu dispositivo.
La transcripción rápida está seleccionada de forma predeterminada.
Agrega un archivo de audio o video compatible, o graba con el micrófono.
Selecciona el idioma hablado o usa la detección automática y sigue el avance en pantalla.
Corrige el texto y guárdalo como TXT, SRT o WebVTT.
La diarización opcional analiza características de las voces y alinea etiquetas anónimas con la transcripción. No reconoce nombres ni identidades.
Distingue a los participantes en llamadas y conversaciones grabadas al revisar notas y decisiones.
Separa preguntas y respuestas para obtener una transcripción más fácil de leer.
Etiqueta los cambios de voz en episodios, mesas de diálogo y conversaciones.
Descarga texto y subtítulos con prefijos de hablante después de revisar el resultado.
La grabación que selecciones y la transcripción terminada permanecen en tu dispositivo. La herramienta procesa todo localmente y no envía esos archivos a nuestros servidores.
Es una estimación de quién habló y cuándo. La herramienta usa etiquetas anónimas como Hablante 1 y Hablante 2; no identifica a las personas por su nombre.
Sí. Al activarla, la transcripción y el análisis de voces se realizan en tu dispositivo. La primera vez, el navegador descarga y guarda modelos adicionales.
Depende de la grabación. Las voces encimadas, el ruido, las respuestas breves y las voces parecidas pueden causar errores; revisa las etiquetas antes de publicar.
La función opcional realiza segmentación y comparación adicional de voces después de transcribir. Los modelos extra solo se usan cuando activas las etiquetas.