← Narzędzia plików lokalnych
Narzędzia plików lokalnych · działa lokalnie

Prywatny transkrybent audio na tekst

Przekształć mowę z posiadanego pliku audio lub wideo w edytowalny tekst za pomocą przypiętego wielojęzycznego modelu, który działa tylko w tej przeglądarce.

Twoje dane robocze pozostają w tej przeglądarce.

Przetwarzanie odbywa się wyłącznie za pomocą interfejsów API przeglądarki; nic nie jest przesyłane do serwisu YTSave, interfejsu API multimediów ani serwera proxy.

Dlaczego do narzędzie jest przydatne

Przekształć mowę z posiadanego pliku audio lub wideo w edytowalny tekst za pomocą przypiętego wielojęzycznego modelu, który działa tylko w tej przeglądarce.

Jak do działa

Przeglądarka dekoduje i miesza wybrane nagranie do monofonicznego dźwięku 16 kHz, a następnie lokalnie hostowany skwantyzowany model Whisper wykonuje ograniczone rozpoznawanie mowy w WebAssembly.

Praktyczny przykład

Wybierz krótki klip z wywiadu, opcjonalnie wybierz jego język mówiony, sprawdź transkrypcję pod kątem błędów rozpoznawania i pobierz zwykły tekst UTF-8.

Walidacja

Obliczenie jest deterministyczne i wyjaśnia błędy walidacji zamiast po cichu zmieniać nieprawidłowe dane wejściowe.

Granica prywatności

Dane wejściowe i wyjściowe pozostają w tej karcie. Kopiowanie i pobieranie odbywają się za pośrednictwem interfejsów API przeglądarki, bez przesyłania na serwer.

Paszport wyniku

Każde uruchomienie zgłasza swój tryb narzędzia, znacznik czasu i rozmiar wejścia / wyjścia, dzięki czemu przekształcone dane mogą być kontrolowane.