Impronte e metadati
MD5, SHA-1 e SHA-256, date del file system, dizionario Info e pacchetto XMP. I valori scritti come riferimento interno (1733 0 R) sono seguiti fino al testo vero.
Analisi PDF raccoglie in una sola pagina tutto ciò che un PDF dice di sé e tutto ciò che si può misurare: impronte, metadati Info e XMP, statistiche del testo con la lingua e la leggibilità, i dati pagina per pagina, la struttura e la sicurezza del file, le immagini, i font, gli allegati e le versioni salvate. Il testo non è quello di un copia-incolla: è ricostruito interpretando i contenuti di ogni pagina con le larghezze reali dei caratteri, così righe e parole sono quelle che si vedono. Tutto il PDF si legge nel processo isolato, come nel lettore.
MD5, SHA-1 e SHA-256, date del file system, dizionario Info e pacchetto XMP. I valori scritti come riferimento interno (1733 0 R) sono seguiti fino al testo vero.
Caratteri per classe (lettere, accentate, cifre, punteggiatura, simboli, non leggibili), sistemi di scrittura, parole e parole distinte, numeri, frasi, righe, paragrafi, URL ed email, tempo di lettura, parole più frequenti.
Lingua del testo (italiano, inglese, francese, tedesco, spagnolo) riconosciuta dalle parole funzionali, indice Gulpease per l'italiano e Flesch per l'inglese. Se la lingua dichiarata nel file è diversa da quella del testo, lo segnala.
Formato, rotazione, caratteri, parole, righe, paragrafi, immagini disegnate davvero (non solo elencate fra le risorse), font, annotazioni e l'indicazione «probabile scansione».
Oggetti e stream, linearizzazione, PDF taggato, conformità dichiarata (PDF/A, PDF/UA, PDF/X), etichette di pagina, cifratura e permessi negati, segnalibri, livelli, campi modulo, file incorporati, azioni JavaScript, annotazioni per tipo, link e domini.
Le immagini con miniature ingrandibili, i font, gli allegati e le versioni salvate del documento, ciascuna confrontabile con l'attuale in Confronto PDF.
Un rapporto con le tabelle di ogni sezione e la galleria delle immagini.
/Lang). Probatio la confronta con la lingua riconosciuta nel testo: un manuale in italiano che dichiara zh-CN indica un modello o un programma d'origine diverso, un indizio sulla storia del documento.