Ir al contenido
getnextpdf.com

Qué hace accesible a un PDF — y por qué importa

Spec: ISO 14289-1Spec: ISO 14289-2Spec: ISO 32000-2Spec: WCAG 2.2

Un PDF accesible es aquel que una persona que no puede ver la página todavía puede leer, en el orden que pretendías, con cada imagen descrita y cada encabezado anunciado como encabezado. Esta página explica cómo un PDF transporta ese significado —contenido etiquetado, un árbol de estructura, orden de lectura, texto alternativo— y por qué merece hacerlo bien.

Un PDF, por defecto, es un conjunto de marcas en coordenadas. Dice pon este glifo aquí y pinta esta imagen allá. No dice, por sí mismo, esto es un encabezado, esta fila pertenece a esa columna ni esta imagen muestra un contrato firmado. Quien lee con vista rellena esas lagunas al instante a partir de la maquetación. Un lector de pantalla no puede. Solo tiene lo que el archivo declara de verdad.

Así que un PDF sin etiquetar puede tener un aspecto perfecto y leerse como un sinsentido: una página a dos columnas anunciada de lado a lado, una tabla de datos aplanada en un flujo de números sin relación, un gráfico que simplemente calla. La información está en la página. Solo que no es alcanzable. Para millones de personas esa es la diferencia entre un documento que pueden usar y uno que no, y, cada vez más, la diferencia entre un servicio público conforme y una exposición jurídica.

  • Un PDF etiquetado transporta una capa paralela de significado sobre las marcas visuales: esta secuencia de glifos es un encabezado, ese bloque es una lista, esta región es una tabla.
  • Esas etiquetas cuelgan de un árbol de estructura —un esquema lógico del documento, separado de dónde se sitúan las cosas en la página (Spec: ISO 32000-2, §14.7).
  • El árbol fija el orden de lectura, de modo que el contenido se presenta en la secuencia que pretendías, no en el orden en que los glifos resultaron pintados.
  • El contenido no textual transporta un equivalente textual: una descripción /Alt para una imagen, texto de reemplazo para una secuencia de glifos que un lector de otro modo destrozaría (Spec: ISO 32000-2, §14.8).
  • PDF/UA (ISO 14289) es el estándar que dice cuándo todo esto está presente y es correcto. Es lo que «PDF accesible» significa como afirmación de ingeniería, no de marketing (Spec: ISO 14289-1).

Piensa en un PDF accesible como dos capas que viajan juntas. La capa de contenido es lo que ves: glifos, líneas, imágenes, situados en coordenadas. La capa de estructura es lo que significa: un árbol de elementos —documento, encabezados, párrafos, listas, tablas, figuras— que nombra cada pieza de contenido y la pone en orden.

Las dos se cosen entre sí mediante el contenido marcado. Cada secuencia con significado en la página se envuelve y recibe un identificador; el elemento de estructura correspondiente apunta de vuelta a ese identificador. Ese enlace es lo que permite que la tecnología de apoyo recorra el árbol lógico y, en cada nodo, encuentre los bytes exactos de la página que describe. Acierta el enlace y un encabezado se anuncia como encabezado; fállalo y la estructura es una ficción que no coincide con lo que se muestra.

El orden de lectura vive en el árbol, no en la maquetación

Sección titulada «El orden de lectura vive en el árbol, no en la maquetación»

Esta es la idea que sorprende a la gente. El orden que usa un lector de pantalla es el orden del árbol de estructura, y eso es independiente de dónde cae el contenido en la página (Spec: ISO 32000-2, §14.7). Puedes pintar una barra lateral en último lugar y una nota al pie en primero; mientras el árbol las enhebre en la secuencia pretendida, el documento se lee correctamente. A la inversa, una página maquetada con primor pero con un árbol revuelto se lee con primor pero mal. La maquetación es para los ojos. El árbol es para todos los demás.

Un equivalente textual para todo lo que no es texto

Sección titulada «Un equivalente textual para todo lo que no es texto»

Una fotografía, un logotipo, un gráfico, una regla decorativa: ninguno de estos son palabras, así que ninguno anuncia nada por defecto. El PDF etiquetado cierra esa laguna con descripciones alternativas: el texto /Alt de una imagen describe lo que transmite, y /ActualText aporta un reemplazo limpio para una secuencia de glifos que de otro modo se leería mal, como una ligadura o una capitular estilizada (Spec: ISO 32000-2, §14.8). Las marcas puramente decorativas se etiquetan como artefactos para que se omitan en vez de leerse como ruido. La regla es simple: si transporta significado, recibe un equivalente textual; si no, se marca para apartarlo.

Cómo consume realmente el archivo un lector de pantalla

Sección titulada «Cómo consume realmente el archivo un lector de pantalla»

Cuando la tecnología de apoyo abre un PDF etiquetado, no lee la página. Lee el árbol, y usa los enlaces de contenido marcado para presentar en orden el texto de cada elemento.

  1. OpenThe reader finds the structure tree root in the document catalog, the entry point to the logical document.
  2. Walk the treeIt traverses the logical hierarchy — document, headings, paragraphs, lists, tables — in structure order.
  3. Map the roleEach structure type maps to a familiar role, so a heading is announced as a heading and a list as a list.
  4. Read the contentFor each element it reads the linked page text, or the alternate description when the content is an image.
  5. Skip the noiseAnything tagged as a decorative artifact is passed over, never spoken.
How a screen reader consumes a tagged PDF: it opens the document, finds the structure tree root, walks the logical tree in order, maps each element to a familiar role, reads the element's text or its alternate description, and skips anything tagged as decorative. The reading sequence comes from the tree, not from where content sits on the page.

Como la secuencia es la secuencia del árbol, un informe a dos columnas etiquetado correctamente se lee por una columna y luego por la otra, una tabla se lee celda a celda con sus encabezados, y una figura anuncia su descripción en vez de callar. El lector nunca tiene que adivinar la intención del autor, porque la intención está registrada en el archivo.

Todo esto se convierte en una afirmación comprobable bajo PDF/UA. PDF/UA-1, publicado como ISO 14289-1, declara los requisitos a nivel de archivo para un PDF accesible sobre el modelo de PDF etiquetado (Spec: ISO 14289-1, §7). PDF/UA-2, ISO 14289-2, traslada esos requisitos a la base de PDF 2.0 y refina cómo el contenido real se asigna al modelo de estructura (Spec: ISO 14289-2, §8). PDF/UA rige la estructura del archivo; las más amplias Web Content Accessibility Guidelines describen los resultados frente a los que se mide un documento, y una afirmación de conformidad nombra el nivel que realmente alcanzó (Spec: WCAG 2.2, §5). Las dos funcionan juntas: PDF/UA dice que la maquinaria está presente y es correcta, WCAG encuadra qué aspecto tiene lo bueno para una persona.

Las etiquetas no son visibles, así que la única forma honesta de comprobarlas es mirar la estructura que reporta una herramienta. Una página accesible mínima tiene un árbol de verdad: una raíz de documento, un encabezado, un párrafo y una figura que transporta una descripción en vez de silencio.

StructTreeRoot
└─ Document
├─ H1 "Quarterly Report"
├─ P "Revenue rose across every region this quarter."
└─ Figure /Alt "Bar chart: revenue by region, all four up"

Un lector que recorre este árbol anuncia un encabezado de nivel uno, lee el párrafo y luego lee la descripción de la figura, en ese orden, sin importar dónde se pintó cada elemento. Quita el árbol y la misma página se convierte en tres secuencias de glifos inconexas y un rectángulo silencioso. Los píxeles son idénticos. La experiencia no.

La creencia frecuente es que un PDF «es accesible porque el texto es seleccionable». El texto seleccionable significa que los glifos son caracteres reales en vez de una imagen escaneada —necesario, pero ni de lejos suficiente. El texto seleccionable sin árbol de estructura sigue sin tener encabezados, sin orden de lectura, sin relaciones de tabla y sin descripciones de imagen. La accesibilidad va de estructura y significado, no meramente de la presencia de caracteres extraíbles. Un archivo puede superar el copiar-y-pegar y fallar por completo ante un lector de pantalla.

Una segunda trampa es tratar «etiquetado» como una insignia de sí o no. Un archivo puede estar etiquetado y aun así estar mal: etiquetas que etiquetan mal el contenido, un árbol cuyo orden no coincide con la intención, imágenes con texto /Alt vacío o inútil. Etiquetado es el comienzo de la conversación, no su final.

Esta página explica los conceptos y los estándares que los definen. No es un certificado de conformidad, y ninguna herramienta puede otorgar uno por sí sola.

PDF/UA structural accessibility — edition availability
EditionAvailability
Core

Core escribe PDF etiquetado: emite un árbol de estructura, marca el contenido decorativo como artefactos y transporta el texto alternativo que suministras.

Pro

Añade una asignación de estructura más rica para maquetaciones complejas —tablas multinivel, listas y figuras— para que el árbol coincida mejor con el orden de lectura pretendido.

Enterprise

Añade una comprobación y un informe de conformidad estructural. Sigue siendo una comprobación estructural, no una certificación: la determinación final corresponde a un validador y a una persona revisora.

Conviene enunciar con claridad dos fronteras. Primera, el motor puede producir una estructura correcta, pero no puede juzgar la calidad editorial: transportará fielmente una descripción /Alt que diga «imagen», y eso recae en el autor, no en el motor. La accesibilidad es una colaboración entre una herramienta que registra el significado y una persona que lo suministra. Segunda, una pasada automatizada —incluido un validador como veraPDF— confirma que la maquinaria está presente y bien formada. No confirma que una persona que use un lector de pantalla pueda entender de verdad el resultado. La aprobación final es humana. Consulta validar PDF/A y PDF/UA para ver cómo encaja esa comprobación automatizada.

  • La ruta de estándares — dónde se sitúan PDF/UA y WCAG en la federación más amplia de estándares que NextPDF sigue.
  • Fuentes: la parte difícil — por qué un texto que tiene buen aspecto puede aun así no ser buscable, y cómo eso afecta a la accesibilidad.
  • Qué es realmente un PDF — el modelo de objetos dentro del que vive el árbol de estructura.
  • Validar PDF/A y PDF/UA — cómo ejecutar una comprobación de conformidad automatizada, y qué puede y qué no puede decirte.
  • PDF etiquetado — un PDF que transporta una capa paralela de etiquetas de estructura sobre su contenido visual, de modo que la tecnología de apoyo pueda alcanzar el significado del documento, no solo sus marcas.
  • Árbol de estructura — el esquema lógico de un documento (raíz, encabezados, párrafos, listas, tablas, figuras), registrado independientemente de la maquetación de la página y usado para determinar el orden de lectura.
  • Orden de lectura — la secuencia en que se presenta el contenido a un lector, tomada del árbol de estructura en vez de de dónde se pintaron los glifos.
  • Texto alternativo — un equivalente textual para el contenido no textual: una descripción /Alt para una imagen, o un reemplazo /ActualText para una secuencia de glifos que de otro modo se leería incorrectamente.
  • Artefacto — contenido etiquetado como decorativo (una regla, un fondo, una marca de agua) para que un lector lo omita en vez de anunciarlo.
  • PDF/UA — PDF/Universal Accessibility, ISO 14289. El estándar que define cuándo un PDF etiquetado es genuinamente accesible. PDF/UA-1 es ISO 14289-1; PDF/UA-2 es ISO 14289-2, sobre la base de PDF 2.0.