Escolha uma gravação
Adicione um arquivo de áudio ou vídeo compatível ou grave pelo microfone.
Separe as vozes como Falante 1, Falante 2 e assim por diante, mantendo a gravação no seu dispositivo.
Escolha um dos 99 idiomas do modelo Whisper ou deixe a ferramenta detectar automaticamente o idioma falado. A lista inclui português, inglês, espanhol, chinês, árabe, hindi, japonês, russo, vietnamita e muitos outros.
Esta ferramenta usa o modelo aberto de reconhecimento de fala Whisper para transcrever áudio e vídeo localmente. O LocalScribe não tem vínculo com a OpenAI. Saiba mais sobre a transcrição Whisper →
Seu arquivo permanece privado e é processado no seu dispositivo.
A transcrição rápida vem selecionada por padrão.
Adicione um arquivo de áudio ou vídeo compatível ou grave pelo microfone.
Selecione o idioma falado ou use a detecção automática e acompanhe o progresso na tela.
Corrija o texto e salve em TXT, SRT ou WebVTT.
A diarização opcional analisa características das vozes e alinha rótulos anônimos à transcrição. Ela não reconhece nomes nem identidades.
Diferencie participantes em chamadas e conversas gravadas ao revisar anotações e decisões.
Separe perguntas e respostas para obter uma transcrição mais fácil de ler.
Marque as mudanças de voz em episódios, mesas-redondas e conversas.
Baixe texto e legendas com prefixos de falante depois de revisar o resultado.
A gravação selecionada e a transcrição concluída permanecem no seu dispositivo. A ferramenta processa tudo localmente e não envia esses arquivos aos nossos servidores.
É uma estimativa de quem falou e quando. A ferramenta usa rótulos anônimos como Falante 1 e Falante 2; ela não identifica pessoas pelo nome.
Sim. Quando ativada, a transcrição e a análise das vozes acontecem no seu dispositivo. No primeiro uso, o navegador baixa e armazena modelos adicionais.
Depende da gravação. Falas sobrepostas, ruído, respostas curtas e vozes parecidas podem causar erros; revise os rótulos antes de publicar.
O recurso opcional faz uma segmentação e comparação adicional das vozes depois da transcrição. Os modelos extras só são usados quando você ativa os rótulos.