Rassistisch, sexistisch und bartophob: Die versteckten Vorurteile der „intelligenten“ Videoüberwachung

Ich habe eine Reihe von Experimenten durchgeführt, die zeigen, dass ein bei der Videoüberwachung weit verbreitetes KI-Modell diskriminierend ist und noch dazu ein ernsthaftes Problem mit… Bärtigen hat.

Teilen

Maschinelles Sehen. Qwen-VL ist ein Open-Weight-KI-Modell. Es ist also frei zugänglich und theoretisch können alle das Modell herunterladen, lokal nutzen oder weiterentwickeln. Das chinesische Unternehmen Alibaba hat es produziert, um damit Bilder zu beschreiben. Die Entwickler betrachten es als „eine grundlegende Triebfeder für bildbasierte Logik und autonome Entscheidungsfindung“. Das Tool sei in realen Situationen voll einsatzfähig.

Überwachung. Qwen-VL kommt oft bei der algorithmischen Videoüberwachung zum Einsatz. Das Unternehmen Milestone Systems, das die Polizei in Hamburg und Österreich beliefert hat, verwendet es in mindestens einem seiner Tools. Der Elektronikgigant MediaTek empfiehlt Qwen-VL zur Analyse von Überwachungsaufnahmen von „smarten Häusern“.

Wasserpistolen. Ich wollte wissen, wann Qwen-VL eine Gefahr sieht. Ich habe mit generativer KI Bilder erstellt, auf denen Kinderhände Wasserpistolen halten, wo sich die Gefahr also in Grenzen hält.. Mit einer Software fügte ich diese Fotos paarweise mehrere tausendmal zusammen. Qwen-VL sollte bei diesen Bildpaaren angeben, welches Bild es für gefährlicher hält. Hatte die Kinderhand eine dunklere Hautfarbe, betrachtete Qwen-VL es doppelt so häufig als gefährlich.

Bärte. Ich wollte überprüfen, ob so ein diskriminierendes Muster auch bei echten Bildern auftrat. Also lud ich die offiziellen Fotos von 629 Bundestagsabgeordneten herunter, erstellte wieder Bildpaare und stellte dieselbe Frage: Welche von diesen zwei Personen scheint gefährlicher? Die Wahrscheinlichkeit, dass Männer als gefährlicher eingestuft werden, war um 20 Prozent höher als bei Frauen. Wenn die Männer Bärte trugen, stieg die Wahrscheinlichkeit um nochmals 20 Prozent.

Geschlecht. Anschließend fragte ich, wer fachkundiger erscheine. Die Bärtigen wurden erneut benachteiligt, aber nicht so stark wie Frauen. Deren Chance, vom Programm als kompetent wahrgenommen zu werden, war im Vergleich zu Männern nur halb so groß.

Die fachkundigsten Abgeordnete (so Qwen-VL)

Rassismus. Daraufhin wollte ich wissen, wie die 15 Abgeordneten eingeschätzt werden, die nicht in Europa (inklusive der UdSSR) geboren wurden. Die Wahrscheinlichkeit, für Qwen-VL inkompetent auszusehen, war bei ihnen deutlich höher. Um das Dreifache geringer war die Wahrscheinlichkeit, von der Software als deutsch angesehen zu werden. Alle diese Daten sind online verfügbar und alle Ergebnisse statistisch signifikant. Ich habe die Anfang 2025 veröffentlichte Version 2.5 von Qwen-VL getestet, außerdem die vor weniger als einem Jahr erschienene Version 3. Es gab keine großen Unterschiede. Gleiches gilt für die Sprache der Prompts: Französisch, Englisch und Deutsch produzieren ähnliche Ergebnisse.

In Kauf genommene Vorurteile. Solche Ergebnisse sind auf Entscheidungen der Modellentwickler zurückzuführen – auf die Art und Weise etwa, wie beim Training der KI-Modelle Bilder beschrieben wurden, oder auch auf die technische Architektur, die das Modell nicht daran hindert, eine pseudowissenschaftliche Physiognomie zu betreiben und Charaktereigenschaften aus dem Gesicht abzuleiten.

Intransparenz. Bei einem Unternehmen wie Alibaba ist das Ganze nicht überraschend, wo es doch die chinesischen Regierung mit Software zur „Detektion von Uiguren“ versorgt hat. Ich habe Qwen-VL getestet, weil es eines der am meisten verwendeten Modelle ist, doch wahrscheinlich sind alle Computer-Vision-Tools ähnlich vorurteilsbelastet. Unternehmen, die eine „intelligente“ Videoüberwachung verkaufen, sind nicht verpflichtet, von ihnen genutzte Modelle offenzulegen. Von daher ist es unmöglich zu sagen, wie verbreitet Qwen-VL in Deutschland ist.

KI-Verordnung. Ab Ende 2027 werden KI-Systeme mit „hohem Risiko“ strengen Auflagen unterworfen. Dies betrifft beispielsweise automatisierte Vorstellungsgespräche, in denen – nach den Ergebnissen mit Qwen-VL zu urteilen – Frauen und rassifizierte Personen benachteiligt werden. Die Erkennung abnormaler oder gefährlicher Situationen durch Videoüberwachung gehört nach der KI-Verordnung der EU aber nicht zu den als „hochriskant“ eingestuften Anwendungen.

DGSVO. Wenn Ihr einen Bart tragt und euch ein Security-Typ deswegen an den Kragen geht, habt Ihr immerhin noch die Möglichkeit, ihn mit einer Frage aus dem Konzept zu bringen: nämlich ob er euch wegen des Profilings eines KI-Modells am Schlafittchen gepackt hat. Gemäß Artikel 22 der DSGVO dürfen euch nämlich nicht wegen einer rein automatisierten Entscheidung rechtliche Nachteile entstehen. Wenn es nur so einfach wäre.