なぜこのツールが役立つのか
このブラウザ内だけで動作する固定の多言語モデルを使って、所有している音声または動画ファイルの音声を編集可能なテキストに変換します。
このサイトに対して公開された完全な、QA 承認版を選択します。
このブラウザ内だけで動作する固定の多言語モデルを使って、所有している音声または動画ファイルの音声を編集可能なテキストに変換します。
準備完了。作業データはこのブラウザに保存されます。
ファイルはこのデバイスに保存されます。処理はブラウザ API のみを使用し、YTSave、メディア API、またはプロキシには何もアップロードされません。
このブラウザ内だけで動作する固定の多言語モデルを使って、所有している音声または動画ファイルの音声を編集可能なテキストに変換します。
ブラウザは選択された録音をデコードしてモノラルの16 kHz音声にミックスし、その後、ローカルでホストされた量子化WhisperモデルがWebAssemblyで範囲指定された音声認識を実行します。
短いインタビュークリップを選択し、必要に応じて話されている言語を選び、認識ミスのないように書き起こしを確認して、プレーンなUTF-8テキストとしてダウンロードします。
計算は決定的であり、無効な入力を静かに変更するのではなく、検証エラーを説明します。
入力と出力はこのタブ内にとどまります。コピーとダウンロードはサーバーアップロードなしでブラウザAPIを通じて行われます。
各実行はツールモード、タイムスタンプ、入出力サイズを報告するため、変換されたデータの監査が可能です。