Ethik

Der Phänotyp-Katalog benennt ausdrücklich, was er ist und was er nicht ist. Diese Seite dokumentiert die vorgesehenen Verwendungen, die nicht vorgesehenen Verwendungen, die Hinweise zu Quellenverzerrungen und die Abgrenzung gegenüber historischem Missbrauch, an der sich der Datensatz ausrichtet.

Vorgesehene Verwendungen

  • Bias-Audits von Bildverarbeitungssystemen. Strukturierte Ground-Truth-Phänotyp-Labels pro Gruppe ermöglichen es, die gruppenspezifische Genauigkeit geprüfter Bildverarbeitungssysteme (Klassifikatoren für Gesichtsattribute, Hauttondetektoren, Altersschätzer) zu messen.
  • Nach Fitzpatrick ausgewogene Trainings-Teilmengen. Das Feld skin_tone ermöglicht den Aufbau von Trainings- und Evaluierungs-Teilmengen, die über die Fitzpatrick-Verteilung I bis VI ausgewogen sind, mit feinerer Granularität als die in bestehenden Benchmarks üblichen Rassenlabels mit vier Kategorien.
  • KI-Bildgenerierung auf Basis realer Verteilungen. Die Phänotyp-Verteilungen pro Gruppe verankern Prompts für Bildgeneratoren und erzeugen so Vielfalt innerhalb der Gruppe statt stereotyper Ergebnisse durch Mode Collapse.
  • Anthropologisches Nachschlagewerk und Bildung. Der Katalog mit 484 Gruppen und normalisierten Feldern für Herkunftsgebiet / Sprache / ISO-Codes / Religion unterstützt gruppenübergreifende Abfragen, Studienarbeiten und den Einsatz in der Lehre.
  • Multiethnisches Prompt-Grounding für NLP. Strukturierte demografische Embeddings, um die Ausgaben von Sprachmodellen über ethnische Gruppen hinweg zu verankern.

Nicht vorgesehene Verwendungen

Der Datensatz ist für die folgenden Anwendungen nicht geeignet:

  • Individuelle Klassifizierung. Die Vorhersage der ethnischen Gruppe einer Person anhand ihres Fotos. Der Datensatz beschreibt ethnische Gruppen in aggregierter Form; einzelne Zeilen sind keine Trainingsdaten für Klassifikatoren.
  • Identifizierung oder Überwachung. Die Zuordnung von Personen zu Gruppen anhand phänotypischer Merkmale. Die Zeilen pro Bild bewahren die Quell-URLs zu Prüfzwecken; sie sind nicht für biometrischen Abgleich konzipiert, und jede Anwendung, die Personen anhand phänotypischer Merkmale pro Bild per Fingerprinting erfasst, ist ausdrücklich ausgeschlossen.
  • Profilbasierte Diskriminierung. Phänotypbasiertes Filtern von Personen bei Einstellungen, Kreditvergabe, Einwanderung oder in jedem anderen folgenreichen Entscheidungsprozess.
  • Hierarchische Aussagen über Populationen. Unterschiede in den Verteilungen zwischen Gruppen in diesem Datensatz spiegeln den Auswahlrahmen von Wikipedia wider, nicht genetische oder merkmalsbezogene Hierarchien auf Populationsebene. Behauptungen, eine Gruppe sei in irgendeiner phänotypischen Dimension „mehr“ oder „weniger“, werden durch diese Daten nicht gestützt.
  • Kausale genetische Inferenz. Phänotyp-Verteilungen beruhen auf Beobachtung, nicht auf Experimenten. Der Datensatz kann keine Aussagen darüber stützen, welche Genloci welche phänotypischen Variationen bestimmen.

Wir haben diese Grenzen bewusst gezogen. Die Datensatzkarte auf HuggingFace, das Methodik-Paper und diese Ethikseite enthalten alle dieselbe ausdrückliche Erklärung zu nicht vorgesehenen Verwendungen.

Hinweise zu Quellenverzerrungen

Die wichtigste Einschränkung des Datensatzes ist der Wikipedia-Quellrahmen. Jede Zeile pro Bild im Korpus stammt aus einem gemeinfreien Wikipedia-Foto einer Person, die in der Tradition der Wikipedia-Artikel „List of {Ethnicity} people“ erfasst ist. Diese Stichprobe ist:

  • Nach Geschlecht zugunsten von Männern verzerrt. Die Bekanntheit im öffentlichen Leben ist auf Wikipedia in den meisten Kategorien (Politiker, Wissenschaftler, Sportler, historische Persönlichkeiten) männlich geprägt; die grobe Gesamtverzerrung liegt bei ~70 bis 75% Männern.
  • Zugunsten von Personen des öffentlichen Lebens verzerrt. Wissenschaftler, Politiker, Entertainer, Sportler und historische Persönlichkeiten sind im Vergleich zur Allgemeinbevölkerung überrepräsentiert.
  • Durch die englischsprachige Abdeckung verzerrt. Gruppen mit stärkerer Präsenz in der englischsprachigen Wikipedia haben mehr Bildbeobachtungen; dies korreliert lose mit der Größe der anglophonen Diaspora, nicht mit der Größe der ursprünglichen Bevölkerung.
  • Durch das fotografische Zeitalter verzerrt. Persönlichkeiten aus der Zeit vor der Fotografie haben kein Infobox-Bild, daher haben Gruppen, deren Wikipedia-Präsenz überwiegend historisch ist, eine geringere Abdeckung durch Bildbeobachtungen.

Aggregationen pro Gruppe auf der Live-Website weisen ausdrücklich auf diese Einschränkungen hin, wann immer die Quellenaufteilung zu 100% auf Wikipedia entfällt (was derzeit auf jede Aggregation zutrifft). Künftige Versionen, die von Nutzern eingereichte Bilder oder eine zweite gemeinfreie Quelle einbeziehen, werden diese Verzerrung abschwächen.

Abgrenzung gegenüber historischem Missbrauch

Mehrere anatomische Dimensionen im Katalog verwenden ein Vokabular, das in der rassentypologischen Pseudowissenschaft des 19. und frühen 20. Jahrhunderts missbraucht wurde. Das bekannteste Beispiel ist der Kopfindex im Vokabular head-shape: Die Kategorien dolichozephal / mesozephal / brachyzephal wurden in großem Umfang missbraucht, um hierarchische Behauptungen über Populationen zu stützen.

Die Studie von Boas aus dem Jahr 1912 (Changes in bodily form of descendants of immigrants, American Anthropologist 14(3): 530-562) zeigte, dass der Kopfindex innerhalb einer einzigen Generation auf die Umwelt reagiert, und entzog damit jeder Verwendung der Schädelmorphologie als festem Populationsmerkmal die Grundlage. Die heutige kraniofaziale Anthropologie verwendet diese Dimensionen ausschließlich als entwicklungsbezogene, klinische und individuelle Deskriptoren. Der Block mit einordnenden Hinweisen in der Vokabulardatei distanziert sich ausdrücklich vom historischen Missbrauch und beschränkt die Dimension auf klinische (Kraniosynostose-Screening, pädiatrische Orthetik), forensische (individuelle Identifizierung) und individuell beschreibende Verwendungen.

Nachgelagerte Nutzer dieses Datensatzes sollten davon absehen, Kategorien des Kopfindex oder eine andere Dimension des Katalogs auf rassische oder populationstypologische Behauptungen abzubilden. Verteilungen pro Gruppe werden der Vollständigkeit halber dokumentiert, nicht als Definitionen oder Unterscheidungen.

Schemata der Genitalanatomie

Drei Vokabulardateien decken die äußere Genitalanatomie ab (vulva, penis, pubic-region). Sie sind wissenschaftlich veröffentlicht (mit Quellenbelegen, ontologie-interoperabel, gegenüber Gutachtern vertretbar), tragen aber auf Dateiebene das Flag observations_source_policy: "internal_only". Zu diesen Dimensionen werden keine Beobachtungen aus gemeinfreien Fotos erfasst, und keine gelangt in den öffentlichen Datensatz.

Die Begründung: Wikipedia und vergleichbare gemeinfreie Quellen enthalten keine relevanten Fotos; Quellen mit Inhalten für Erwachsene weisen Probleme bei Einwilligung und Herkunft auf, die sie für den Aufbau eines wissenschaftlichen Datensatzes ungeeignet machen; Populationen klinischer Fotos erfordern eine IRB-äquivalente Einwilligung, die ein offener Datensatz nicht garantieren kann. Das Schema wird veröffentlicht, damit die wissenschaftliche Taxonomie transparent ist; Beobachtungen bleiben intern, bis Quellen mit geklärter Einwilligung verfügbar sind.

Lizenz und Weiterverwendung

Der Code ist unter Apache License 2.0 veröffentlicht; der Datensatz ist unter CC BY 4.0 veröffentlicht. Bild-URLs im Datensatz verweisen auf Inhalte von Wikipedia / Wikimedia Commons, die eigenen Lizenzen pro Bild unterliegen (typischerweise CC-BY-SA, gemeinfrei oder verschiedene Creative-Commons-Varianten); prüfen Sie die Referenz-URL jeder Zeile, bevor Sie die eigentlichen Bilddateien weiterverbreiten.

Die freizügige Lizenzierung ist beabsichtigt. Wissenschaftliche Forschende, Teams der Fairness-Forschung und KI-Entwickler, die den Datensatz mit anderer Namensnennung spiegeln oder für eine fachspezifische Nutzung umbenennen möchten, sind ausdrücklich eingeladen, dies zu tun. Die Artefakte sind so angelegt, dass sie jeden einzelnen Host und jeden Markenkontext überdauern.

Mehr erfahren: Über uns · Methodik · FAQ · Glossar