Che cosa rende accessibile un PDF — e perché conta
Spec: ISO 14289-1ISO 14289-1Spec: ISO 14289-2ISO 14289-2Spec: ISO 32000-2ISO 32000-2Spec: WCAG 2.2WCAG 2.2
In sintesi
Sezione intitolata “In sintesi”Un PDF accessibile è un PDF che una persona che non può vedere la pagina riesce comunque a leggere, nell’ordine che intendevi, con ogni immagine descritta e ogni intestazione annunciata come intestazione. Questa pagina spiega come un PDF veicola quel significato — contenuto taggato, un albero della struttura, ordine di lettura, testo alternativo — e perché vale la pena farlo bene.
Perché è importante
Sezione intitolata “Perché è importante”Un PDF, per impostazione predefinita, è un insieme di segni a delle coordinate. Dice metti questo glifo qui e dipingi questa immagine lì. Non dice, da solo, questa è un’intestazione, questa riga appartiene a quella colonna, oppure questa immagine mostra un contratto firmato. Un lettore vedente colma quei vuoti istantaneamente a partire dal layout. Uno screen reader non può. Ha soltanto ciò che il file dichiara effettivamente.
Così un PDF non taggato può apparire perfetto e leggersi come un nonsenso: una pagina a due colonne annunciata di traverso, una tabella di dati appiattita in un flusso di numeri scollegati, un grafico semplicemente muto. L’informazione è sulla pagina. Solo che non è raggiungibile. Per milioni di persone è la differenza tra un documento che possono usare e uno che non possono — e, sempre più spesso, la differenza tra un servizio pubblico conforme e un’esposizione legale.
In breve
Sezione intitolata “In breve”- Un PDF taggato porta con sé uno strato parallelo di significato sopra i segni visivi: questa sequenza di glifi è un’intestazione, quel blocco è un elenco, questa regione è una tabella.
- Quei tag pendono da un albero della struttura — uno schema logico del documento, separato da dove le cose si collocano sulla pagina (Spec: ISO 32000-2, §14.7ISO 32000-2 §14.7).
- L’albero fissa l’ordine di lettura, così il contenuto è presentato nella sequenza che intendevi, non nell’ordine in cui i glifi sono capitati a essere dipinti.
- Il contenuto non testuale porta con sé un equivalente testuale: una
descrizione
/Altper un’immagine, testo sostitutivo per una sequenza di glifi che un lettore altrimenti storpierebbe (Spec: ISO 32000-2, §14.8ISO 32000-2 §14.8). - PDF/UA (ISO 14289) è lo standard che dice quando tutto questo è presente e corretto. È ciò che «PDF accessibile» significa come asserzione ingegneristica, non di marketing (Spec: ISO 14289-1ISO 14289-1).
Come lo affronta NextPDF
Sezione intitolata “Come lo affronta NextPDF”Due strati, un solo file
Sezione intitolata “Due strati, un solo file”Pensa a un PDF accessibile come a due strati che viaggiano insieme. Lo strato del contenuto è ciò che vedi: glifi, linee, immagini, collocati a delle coordinate. Lo strato della struttura è ciò che significa: un albero di elementi — documento, intestazioni, paragrafi, elenchi, tabelle, figure — che nomina ogni pezzo di contenuto e lo mette in ordine.
I due sono cuciti insieme dal contenuto marcato (marked content). Ogni sequenza significativa sulla pagina è racchiusa e dotata di un identificatore; l’elemento di struttura corrispondente punta indietro a quell’identificatore. Quel legame è ciò che consente alla tecnologia assistiva di percorrere l’albero logico e, a ogni nodo, trovare i byte esatti sulla pagina che descrive. Fai bene il legame e un’intestazione è annunciata come intestazione; sbaglialo e la struttura è una finzione che non corrisponde a ciò che viene mostrato.
L’ordine di lettura vive nell’albero, non nel layout
Sezione intitolata “L’ordine di lettura vive nell’albero, non nel layout”È l’idea che sorprende le persone. L’ordine che uno screen reader usa è l’ordine dell’albero della struttura, e questo è indipendente da dove il contenuto cade sulla pagina (Spec: ISO 32000-2, §14.7ISO 32000-2 §14.7). Puoi dipingere una barra laterale per ultima e una nota a piè di pagina per prima; finché l’albero le infila nella sequenza intesa, il documento si legge correttamente. Al contrario, una pagina splendidamente impaginata con un albero scombinato si legge splendidamente sbagliata. Il layout è per gli occhi. L’albero è per tutti gli altri.
Un equivalente testuale per tutto ciò che non è testo
Sezione intitolata “Un equivalente testuale per tutto ciò che non è testo”Una fotografia, un logo, un grafico, un filetto decorativo — nessuno di questi è
fatto di parole, quindi nessuno di essi annuncia alcunché per impostazione
predefinita. Il PDF taggato colma quel vuoto con descrizioni alternative: il
testo /Alt di un’immagine descrive ciò che essa veicola, e /ActualText
fornisce una sostituzione pulita per una sequenza di glifi che altrimenti
sarebbe letta in modo errato, come una legatura o un capolettera stilizzato
(Spec: ISO 32000-2, §14.8ISO 32000-2 §14.8). I segni puramente decorativi
sono taggati come artefatti, così vengono saltati anziché letti come rumore. La
regola è semplice: se porta significato, ottiene un equivalente testuale; se non
lo fa, viene marcato in modo da essere messo da parte.
Come uno screen reader consuma davvero il file
Sezione intitolata “Come uno screen reader consuma davvero il file”Quando la tecnologia assistiva apre un PDF taggato, non legge la pagina. Legge l’albero, e usa i legami del contenuto marcato per portare in superficie il testo di ciascun elemento in ordine.
- OpenThe reader finds the structure tree root in the document catalog, the entry point to the logical document.
- Walk the treeIt traverses the logical hierarchy — document, headings, paragraphs, lists, tables — in structure order.
- Map the roleEach structure type maps to a familiar role, so a heading is announced as a heading and a list as a list.
- Read the contentFor each element it reads the linked page text, or the alternate description when the content is an image.
- Skip the noiseAnything tagged as a decorative artifact is passed over, never spoken.
Poiché la sequenza è la sequenza dell’albero, un report a due colonne taggato correttamente si legge giù per una colonna e poi per l’altra, una tabella si legge cella per cella con le sue intestazioni, e una figura annuncia la propria descrizione invece di restare muta. Il lettore non deve mai indovinare l’intento dell’autore, perché l’intento è registrato nel file.
Lo standard che lo fissa: PDF/UA
Sezione intitolata “Lo standard che lo fissa: PDF/UA”Tutto questo diventa un’asserzione verificabile sotto PDF/UA. PDF/UA-1, pubblicato come ISO 14289-1, enuncia i requisiti a livello di file per un PDF accessibile sopra il modello del PDF taggato (Spec: ISO 14289-1, §7ISO 14289-1 §7). PDF/UA-2, ISO 14289-2, porta quei requisiti sulla base PDF 2.0 e raffina il modo in cui il contenuto reale si mappa sul modello della struttura (Spec: ISO 14289-2, §8ISO 14289-2 §8). PDF/UA governa la struttura del file; le più ampie Web Content Accessibility Guidelines descrivono i risultati rispetto a cui un documento viene misurato, e un’asserzione di conformità nomina il livello effettivamente raggiunto (Spec: WCAG 2.2, §5WCAG 2.2 §5). I due lavorano insieme: PDF/UA dice che la macchina è presente e corretta, WCAG inquadra che cosa significhi un buon risultato per una persona.
Esempio pratico
Sezione intitolata “Esempio pratico”I tag non sono visibili, quindi l’unico modo onesto di verificarli è guardare la struttura che uno strumento riporta. Una pagina accessibile minima ha un albero reale: una radice di documento, un’intestazione, un paragrafo e una figura che porta con sé una descrizione anziché il silenzio.
StructTreeRoot └─ Document ├─ H1 "Quarterly Report" ├─ P "Revenue rose across every region this quarter." └─ Figure /Alt "Bar chart: revenue by region, all four up"Un lettore che percorre questo albero annuncia un’intestazione di primo livello, legge il paragrafo, poi legge la descrizione della figura — in quell’ordine, indipendentemente da dove ciascun elemento sia stato dipinto. Togli l’albero e la stessa pagina diventa tre sequenze scollegate di glifi e un rettangolo muto. I pixel sono identici. L’esperienza no.
Equivoco comune
Sezione intitolata “Equivoco comune”La convinzione frequente è che un PDF «sia accessibile perché il testo è selezionabile». Testo selezionabile significa che i glifi sono caratteri reali anziché un’immagine scansionata — necessario, ma ben lontano dall’essere sufficiente. Testo selezionabile senza un albero della struttura non ha comunque intestazioni, né ordine di lettura, né relazioni tra le celle di una tabella, né descrizioni delle immagini. L’accessibilità riguarda struttura e significato, non la mera presenza di caratteri estraibili. Un file può superare il copia-e-incolla e fallire completamente con uno screen reader.
Una seconda trappola è trattare «taggato» come un distintivo sì/no. Un file può
essere taggato e comunque sbagliato: tag che etichettano in modo errato il
contenuto, un albero il cui ordine non corrisponde all’intento, immagini con
testo /Alt vuoto o inutile. Taggato è l’inizio della conversazione, non la sua
fine.
Limiti e confini
Sezione intitolata “Limiti e confini”Questa pagina spiega i concetti e gli standard che li definiscono. Non è un certificato di conformità, e nessuno strumento può concederne uno da solo.
| Edition | Availability |
|---|---|
| Core | Core scrive PDF taggato: emette un albero della struttura, marca il contenuto decorativo come artefatti e porta con sé il testo alternativo che fornisci. |
| Pro | Aggiunge una mappatura della struttura più ricca per layout complessi — tabelle multilivello, elenchi e figure — così l’albero corrisponde meglio all’ordine di lettura inteso. |
| Enterprise | Aggiunge una verifica e un report di conformità strutturale. Resta una verifica strutturale, non una certificazione — la determinazione finale spetta a un validatore e a un revisore umano. |
Vale la pena enunciare con chiarezza due confini. Primo, il motore può produrre
una struttura corretta, ma non può giudicare la qualità editoriale: porterà
fedelmente con sé una descrizione /Alt che dice «immagine», e questo è
responsabilità dell’autore, non del motore. L’accessibilità è una
collaborazione tra uno strumento che registra il significato e una persona che
lo fornisce. Secondo, un passaggio automatico — incluso un validatore come
veraPDF — conferma che la macchina è presente e ben formata. Non conferma che
una persona che usa uno screen reader riesca effettivamente a comprendere il
risultato. L’approvazione finale è umana. Vedi
validare PDF/A e PDF/UA per come
quella verifica automatica si inserisce.
Documenti correlati
Sezione intitolata “Documenti correlati”- Lo scenario degli standard — dove PDF/UA e WCAG si collocano nella più ampia federazione di standard che NextPDF segue.
- Font: la parte difficile — perché un testo che sembra corretto può comunque essere non ricercabile, e come ciò tocca l’accessibilità.
- Che cos’è davvero un PDF — il modello a oggetti all’interno del quale vive l’albero della struttura.
- Validare PDF/A e PDF/UA — come eseguire una verifica di conformità automatica, e che cosa può e non può dirti.
Glossario
Sezione intitolata “Glossario”- PDF taggato — un PDF che porta con sé uno strato parallelo di tag di struttura sopra il proprio contenuto visivo, così la tecnologia assistiva può raggiungere il significato del documento, non solo i suoi segni.
- Albero della struttura — lo schema logico di un documento (radice, intestazioni, paragrafi, elenchi, tabelle, figure), registrato indipendentemente dal layout della pagina e usato per determinare l’ordine di lettura.
- Ordine di lettura — la sequenza in cui il contenuto è presentato a un lettore, presa dall’albero della struttura anziché da dove i glifi sono stati dipinti.
- Testo alternativo — un equivalente testuale per il contenuto non testuale:
una descrizione
/Altper un’immagine, o una sostituzione/ActualTextper una sequenza di glifi che altrimenti sarebbe letta in modo errato. - Artefatto — contenuto taggato come decorativo (un filetto, uno sfondo, una filigrana) così che un lettore lo salti invece di annunciarlo.
- PDF/UA — PDF/Universal Accessibility, ISO 14289. Lo standard che definisce quando un PDF taggato è genuinamente accessibile. PDF/UA-1 è ISO 14289-1; PDF/UA-2 è ISO 14289-2, sulla base PDF 2.0.