KI-Tools werden immer öfter für die Erzeugung von Alternativtexten eingesetzt. Zum Beispiel als Wordpress-Plugin, welches in der Mediathek verwendet werden kann, um Alternativtexte direkt beim Upload eines Bildes zu erzeugen oder sich per Knopfdruck durch den ganzen Bildetstapel zu arbeiten. Eine einfache, schnelle Lösung. Oder doch nicht?
Alternativtexte, die das Bild beschreiben, aber seine Aussage verfehlen, bestehen jede automatische Prüfung. Sie können dennoch ungenau und damit nicht sinnvoll für sehbehinderte Menschen sein.
Automatisierte Barrierefreiheitsprüfungen (wie z. B. Lighthouse, WAVE oder die Prüfung in Microsoft Office) erkennen meistens nur, ob ein Alt-Text vorhanden ist – aber nicht, wie sinnvoll er ist. Wenn jedoch eine manuelle Prüfung stattfindet oder die KI typische Fehler macht, wird das Bild als „nicht barrierefrei“ eingestuft.
Vorsicht bei KI generierten Alternativtexten. Diese können durch die Barrierefreiheitsprüfung fallen.
1) Fehlender Kontext (Der häufigste Grund)
Eine KI sieht nur das Bild, kennt aber nicht den Zweck der Website.
Beispiel: Ein Bild zeigt eine Tasse Kaffee auf einem Schreibtisch.
KI-generierter Text: "Eine weiße Kaffeetasse auf einem Holztisch neben einer Computertastatur."
Das Problem: Wenn es in dem Artikel um ergonomische Tastaturen geht, ist die Kaffeetasse irrelevant. Wenn es um Kaffeebohnen geht, ist die Tastatur egal. Der Text muss zum umgebenden Inhalt passen.
2) Halluzinationen und Ungenauigkeiten
Künstliche Intelligenz neigt manchmal dazu, Details zu erfinden oder falsch zu interpretieren.
Typischer Fehler: Die KI verwechselt Text auf Schildern, erkennt Emotionen von Personen falsch oder übersieht wichtige Details im Hintergrund. Ein sachlich falscher Alt-Text ist für blinde Menschen irreführend und fällt bei einer Qualitätsprüfung sofort durch.
3) Redundanz und Floskeln
Viele ältere oder einfachere KI-Modelle beginnen Beschreibungen mit Phrasen, die Screenreader ohnehin schon sagen.
Negativ-Beispiel: "Ein Bild von..." oder "Eine Grafik, die ... zeigt."
Da Screenreader dem Nutzer bereits ankündigen, dass es sich um ein Bild handelt, ist das doppelter Text und gilt als schlechter Stil bei der Barrierefreiheit.
4) Content-Filter
Gelegentlich generieren KI-Modelle gar keine Alternativ-Texte. Verantwortlich dafür sind die aktivierten Content-Filter der KI, die eine Textgenerierung blockieren, sobald sensible Inhalte vermutet werden. Bei GPT-4 betrifft dies beispielsweise die Bereiche „Hass“, „Selbstverletzung“, „Sexualität“ und „Gewalt“. In der Praxis zeigt sich jedoch, dass diese Filter oft zu empfindlich kalibriert sind. Ein typisches Beispiel dafür ist die fehlerhafte Aktivierung des Sexualitäts-Filters bei der harmlosen Abbildung einer im Bett schlafenden Frau – mit der Folge, dass die Erstellung des Alternativtextes komplett blockiert wird.
Empfehlung für die Praxis
Nutzen Sie KI gerne als Assistenten, um Zeit zu sparen, aber führen Sie immer eine Qualitätskontrolle durch.
- Prüfen Sie den Kontext: Ergibt der Text im aktuellen Absatz Sinn?
- Halten Sie es kurz: Ein guter Alt-Text ist meistens nur 1 bis 2 Sätze lang.
- Löschen Sie Floskeln: Entfernen Sie Sätze wie „Das Foto zeigt...“.
Spart es Ihnen Zeit, wenn Sie die Alternativtexte generieren lassen?
Einfache Antwort: es kommt darauf an.
Damit generierte Texte möglichst passend sind, müssen sie den umgebenden Kontext, die Zielgruppe und die Aussage des Bildes im Prompt mit angeben. Außerdem müssen Sie die Texte manuell prüfen. Ob es dann noch immer schneller ist, hängt von ihrer Webseite und der Menge der Bilder ab.
Alternativ können Sie Services nutzen, welche bei der Generierung der Texte den umgebenden Inhalt der Webseite analysieren und mit einbeziehen. Aber auch hier ist eine manuelle Prüfung hinterher notwendig.
Finger weg von KI-Generatoren, die nur den Zweck besitzen, dass überhaupt Alternativtexte gesetzt werden. Diese verschwenden Ihre Zeit und können zu einem Scheitern der Barrierefreiheitsprüfung führen.