Escolha uma gravação
Adicione um arquivo de áudio ou vídeo compatível ou grave pelo microfone.
Transforme mídia falada em texto com marcações de tempo, corrija no editor e baixe um arquivo de legenda SRT ou WebVTT.
Escolha na lista completa de idiomas do Whisper ou deixe a ferramenta detectar automaticamente o idioma falado. Inclui português, inglês, espanhol, chinês, árabe, hindi, japonês, russo, vietnamita e muitos outros.
Esta ferramenta usa o modelo de reconhecimento de fala Whisper de código aberto para transcrever áudio e vídeo localmente. O LocalScribe não é afiliado à OpenAI. Saiba mais sobre transcrição Whisper →
Seu arquivo permanece privado e é processado no seu dispositivo.
A transcrição rápida está selecionada por padrão.
Adicione um arquivo de áudio ou vídeo compatível ou grave pelo microfone.
Selecione o idioma falado ou use a detecção automática e acompanhe o progresso na tela.
Corrija o texto e salve em TXT, SRT ou legendas WebVTT.
Gere uma transcrição com marcações de tempo para entrevistas, aulas, apresentações, podcasts e vídeos e revise antes de exportar.
Baixe um arquivo de legendas amplamente compatível, com blocos numerados e marcações de tempo.
Exporte WebVTT para sites, reprodutores de vídeo na web e plataformas de publicação compatíveis.
Revise nomes, números e termos especializados antes de baixar o texto final.
Escolha entre 99 idiomas de transcrição compatíveis para gravações internacionais.
A gravação selecionada e a transcrição concluída permanecem no seu dispositivo. A ferramenta de transcrição não envia esses arquivos aos nossos servidores.
Selecione o vídeo local, execute a transcrição, revise o texto e escolha SRT nos botões de download.
Ambos armazenam o texto das legendas e as marcações de tempo. SRT é amplamente aceito por ferramentas de edição e publicação, enquanto WebVTT foi criado para vídeos na web.
Você pode editar o texto da transcrição na página antes de exportar. A edição detalhada das marcações de tempo ainda não está disponível.
Não. Ela cria arquivos de legenda SRT e VTT separados; o texto não é renderizado na imagem do vídeo.