Mengapa alat ini berguna
Pulihkan teks yang boleh dicari daripada laporan, penyata dan dokumen born-digital sebelum membuat ringkasan, mengindeks atau menyemak kandungannya.
Pilih edisi lengkap yang diluluskan QA yang diterbitkan untuk laman ini.
Ekstrak lapisan teks terbenam daripada PDF tempatan ke dalam fail teks UTF-8 tanpa memuat naik dokumen atau berpura-pura melakukan OCR.
Data kerja anda kekal dalam pelayar ini.
Fail kekal pada peranti ini. Pemprosesan hanya menggunakan API penyemak imbas; tiada apa-apa dimuat naik ke YTSave, API media atau proksi.
Pulihkan teks yang boleh dicari daripada laporan, penyata dan dokumen born-digital sebelum membuat ringkasan, mengindeks atau menyemak kandungannya.
Mozilla PDF.js membaca setiap item teks terbenam pada setiap halaman dalam memori pelayar, mengekalkan penghujung baris yang dinyatakan dan berhenti pada had halaman dan aksara yang dikonfigurasi.
Pilih PDF berasaskan teks, sahkan bilangan halaman dan aksara yang boleh dibaca, kemudian muat turun salinan UTF-8 biasa. Halaman imbasan yang hanya mengandungi imej dengan betul tidak menghasilkan teks yang direka-reka.
Pengiraan adalah deterministik dan menerangkan ralat pengesahan dan bukannya menukar input tidak sah secara senyap.
Input dan output kekal dalam tab ini. Penyalinan dan muat turun berlaku melalui API pelayar tanpa muat naik ke pelayan.
Setiap operasi melaporkan mod alat, cap masa dan saiz input/output supaya data yang diubah suai boleh diaudit.