PDF Estrazione del testo
Utilizza il runtime PDF locale esistente per estrarre il livello di testo PDF, visualizzarlo per pagina, cercare ed esportare il testo o JSON.
Come usare PDF per estrarre il testo
PDF L’estrazione del testo viene elaborata solo nel browser corrente; i dati dell’utente non vengono caricati, trasmessi tramite rete né salvati.
Contenuto da inserire
Seleziona PDF locale e specifica un intervallo di pagine o un termine di ricerca.
Seleziona il metodo di elaborazione
Legge il livello di testo di PDF e lo mostra pagina per pagina, senza usare OCR.
Controlla ed esporta
Dopo aver controllato i numeri di pagina e l’ordine del testo, copia o scarica TXT/JSON.
Limiti e note
- I documenti scansionati e le pagine immagine non vengono riconosciuti automaticamente quando non hanno un livello di testo.
- La codifica dei caratteri, l’ordine di lettura e i layout complessi possono influire sull’ordine del testo; verifica i contenuti importanti pagina per pagina.
- Gli strumenti forniscono solo risultati di elaborazione locale di supporto; le configurazioni importanti, le chiavi, i documenti e i contenuti da pubblicare devono comunque essere verificati nell’ambiente di destinazione.
Domande frequenti
L’input viene caricato sul server?
No. La pagina utilizza solo la memoria del browser, il file locale API e le risorse locali già fornite dal sito.
Perché non è possibile estrarre il testo dalla scansione PDF?
Questo strumento legge solo il livello di testo e non esegue OCR; per i documenti scansionati è necessario un flusso separato di OCR.
Perché i risultati richiedono ancora una verifica manuale?
La sintassi dei casi limite, le convenzioni locali, i lettori di terze parti e l’ambiente di esecuzione di destinazione possono differire; lo strumento non sostituisce la verifica finale.