Wybierz nagranie
Dodaj obsługiwany plik audio lub wideo albo nagraj dźwięk bezpośrednio z mikrofonu.
Rozdzielaj głosy jako Mówca 1, Mówca 2 i kolejne, podczas gdy nagranie pozostaje na Twoim urządzeniu.
Wybierz język z pełnej listy 99 języków modelu Whisper lub pozwól narzędziu automatycznie rozpoznać język nagrania. Lista obejmuje między innymi polski, angielski, hiszpański, chiński, arabski, hindi, japoński, rosyjski i wietnamski.
To narzędzie korzysta z otwartego modelu rozpoznawania mowy Whisper, aby lokalnie transkrybować audio i wideo. LocalScribe nie jest powiązany z OpenAI. Dowiedz się więcej o transkrypcji Whisper →
Twój plik pozostaje prywatny i jest przetwarzany na Twoim urządzeniu.
Szybka transkrypcja jest wybrana domyślnie.
Dodaj obsługiwany plik audio lub wideo albo nagraj dźwięk bezpośrednio z mikrofonu.
Wybierz język nagrania lub automatyczne rozpoznawanie, a następnie obserwuj postęp na ekranie.
Popraw tekst i zapisz go jako TXT albo napisy SRT lub WebVTT.
Opcjonalna diarizacja analizuje cechy głosów i dopasowuje anonimowe etykiety do transkrypcji ze znacznikami czasu. Nie rozpoznaje nazwisk ani tożsamości osób.
Rozróżniaj uczestników nagranych rozmów i dyskusji podczas przeglądania notatek oraz decyzji.
Oddzielaj pytania od odpowiedzi, aby transkrypcja wywiadu była łatwiejsza do czytania.
Oznaczaj zmiany głosu w odcinkach, dyskusjach panelowych i nagranych rozmowach.
Po sprawdzeniu wyniku pobierz tekst i napisy ze znacznikami czasu oraz prefiksami mówców.
Wybrane nagranie i gotowa transkrypcja pozostają na Twoim urządzeniu. Narzędzie przetwarza je lokalnie i nie przesyła tych plików na nasze serwery.
Diarizacja szacuje, kto i kiedy mówił. Narzędzie używa anonimowych etykiet, takich jak Mówca 1 i Mówca 2; nie identyfikuje osób z imienia ani nazwiska.
Tak. Po włączeniu zarówno transkrypcja, jak i analiza głosów odbywają się na Twoim urządzeniu. Przy pierwszym użyciu przeglądarka pobiera i zapisuje w pamięci podręcznej dodatkowe modele.
Jakość zależy od nagrania. Nakładające się wypowiedzi, szum tła, krótkie odpowiedzi i podobne głosy mogą powodować błędy, dlatego sprawdź etykiety przed publikacją.
Ta opcjonalna funkcja po transkrypcji wykonuje osobną segmentację i porównanie głosów. Dodatkowe modele i przetwarzanie są używane tylko po włączeniu etykiet mówców.