Allgemeine Einordnung
Permalink "Allgemeine Einordnung"Adobe bietet mit der Auto-Tag API eine Dienstleistung für Entwickelnde an und stellt die Funktion auch bei Nutzung von Adobe Acrobat Pro zur Verfügung. Sie können über Adobes Service nicht-barrierefreie PDF-Dokumente taggen lassen. Der Service versucht mit KI-Unterstützung, ein möglichst gutes Ergebnis bezüglich Barrierefreiheit zu erzielen.
Allerdings können nicht alle Inhalte automatisch barrierefrei gemacht werden – das Ergebnis muss noch von Hand nachbearbeitet werden. Unter anderem müssen Alternativtexte nachgetragen werden, Formularfelder oder Anmerkungen werden nicht unterstützt und die Lesereihenfolge sowie semantische Tags (z. B. Inhaltsverzeichnisse, Fußnoten) müssen überprüft werden. Fehler in der konzeptionellen oder grafischen Gestaltung eines PDF-Dokuments können beim nachträglichen Tagging nicht behoben werden. D. h. es kann per se nur eine technische Zugänglichkeit erreicht werden.
Laut einer wissenschaftlichen Studie (Tran, 2023) erzeugt die Auto-Tag API von sich aus keine barrierefreien PDF-Dokumente, die nach PDF/UA-Standard barrierefrei sind. Aber für nicht getaggte oder überhaupt nicht barrierefreie PDF-Dokumente kann sie ein guter Startpunkt sein.
Die Ergebnisse der Studie in Kürze:
- 37% der im Matterhorn-Protokoll (PDF Association, 2021) aufgeführten Fehler wurden von der Auto-Tag API entdeckt und behoben, 42% wurden nicht behoben, der Rest konnte nicht geprüft werden.
- Werden nur die Fehler betrachtet, die nicht automatisch geprüft werden können, wurden immerhin 46% der Matterhorn-Fehler behoben.
Die Auto-Tag API gibt es online als Demo unter https://acrobatservices.adobe.com/dc-accessibility-playground/main.html. Es können nur Dokumente mit maximal 10 MB hochgeladen werden. Eine Überprüfung mit mehreren Dokumenten hat Folgendes ergeben: Bei kurzen, strukturell einfachen und vorwiegend textbasierten Dokumenten wird ein guter Tag-Baum erzeugt. Eine händische Überprüfung ist aber auf jeden Fall notwendig. Grafisch komplexe Dokumente erfordern eine umfassende Nacharbeit und werden teilweise nicht oder nicht vollständig bearbeitet. Sie erhalten die Rückmeldung, dass das Dokument zu komplex zur Bearbeitung ist, sowie einen Report in Form einer Excel-Datei.
Neben der Lösung von Adobe gibt es u. a. vergleichbare Services auf Basis der Open Source Docling IBM und Amazon Textract OCR. Die Ergebnisse unterscheiden sich im Detail, in jedem Fall ist eine Nachbearbeitung der Dokumente erforderlich. Mit Hilfe von spezialisierten Werkzeugen wie dem PDFix SDK ist eine automatisierte Korrektur von Standardproblemen möglich.
Verweise
Permalink "Verweise"Interne Links
Permalink "Interne Links"Keine vorhanden
Externe Links in diesem Artikel
Permalink "Externe Links in diesem Artikel"- Matterhorn-Protokoll (PDF Association, 2021)
- Auto-Tag API Demo (Adobe)
- Docling (Docling)
- Amazon Textract OCR (Amazon)
- PDFix SDK (PDFix)
- PDFix Marketplace (PDFix)
Weiterführende Links
Permalink "Weiterführende Links"- PDF Accessibility Auto-Tag API (Adobe)
- KI-unterstützte Korrektur von PDFs zur Verbesserung der Barrierefreiheit—Chancen und Herausforderungen am Beispiel von Adobe’s Auto-Tag API (Hochschule der Medien Stuttgart, Marvin Tran, 2023)
Informationen zu diesem Artikel
Gerne können Sie uns Feedback per E-Mail zu unserer Handreichung senden!