Anmeldung Registrierung
Auto Hell Dunkel
Erweiterte Suche
  1. Startseite
  2. Podcasts
  3. Data Science Deep Dive Podcast
  4. #96: Queer Data: Wie erfasst, bereinigt und analysiert man sensible Daten?
Pünktlich zum Pride Month widmen sich Mira und Liel der Frage,
was bei der Arbeit mit sensiblen personenbezogenen Daten am
Beispiel queerer Daten zu beachten ist. Sie gehen die drei Phasen
Datenerfassung, -bereinigung und -analyse durch und zeigen, wie
schon die Wahl von Kategorien die Realität beeinflusst und wie
sich Diskriminierung in Daten und Algorithmen fortschreibt. Ein
Schwerpunkt liegt auf dem Umgang mit sehr kleinen Gruppen, für
die sich statistisch oft wenig ableiten lässt, und auf möglichen
Lösungen wie Oversampling oder qualitativen Methoden. Die Episode
macht deutlich, dass es keine einzelne richtige Lösung gibt,
sondern bewusste Entscheidungen und Mitdenken gefragt sind. Die
besprochenen Überlegungen gelten über Queerness hinaus auch für
andere Kategorien sozialer Ungleichheit und das Thema
Intersektionalität.

 

**Zusammenfassung**

Begriffsklärung: Was "queer" bedeutet, von der ursprünglichen
Beleidigung zur positiven Selbstbezeichnung, und der Bezug zu
LGBTQIA+

Datenerfassung: Was man erfasst, hängt vom Kontext ab (Sex in
der Medizin, Gender beim Verhalten, sexuelle Orientierung im
Marketing)

Kategorien sind nicht neutral: Sie prägen, wie Menschen sich
wahrnehmen, wie Umfragen ankommen und ob man Diskriminierung
überhaupt messen kann

Repräsentativität: Wie prüft man sie, wenn die Gruppengröße
unbekannt ist – etwa über bayesianische Ansätze mit Annahmen, die
durch Daten aktualisiert werden

Datenbereinigung: Schon wenige Fehleingaben verzerren kleine
Gruppen stark, wie das Beispiel der US-Zensusdaten zeigt

Umgang mit kleinen Gruppen: Optionen sind große Datenmengen,
Oversampling, qualitative Methoden oder zumindest transparentes
Berichten

Analyse: Algorithmen reproduzieren und skalieren bestehende
Biases und sind nicht automatisch neutral; das Weglassen
einzelner Merkmale löst das Problem nicht (Proxy-Variablen)

Fazit: Es gibt keine technische Patentlösung gegen
Diskriminierung – entscheidend sind bewusste Entscheidungen,
Mitdenken und der Blick auf Intersektionalität

 

**Links**

Buch "Queer Data" von Kevin Guyan:
https://kevinguyan.com/queer-data/

Buch "Rainbow Trap" von Kevin Guyan:
https://kevinguyan.com/rainbow-trap/

Buch "Data Feminism" von Catherine D'Ignazio und Lauren F.
Klein (MIT Press, frei verfügbar):
https://data-feminism.mitpress.mit.edu/

Episode #40: Sonderfolge: Frauen in Data Science und Tech mit
Catrin & Isa von Mind the Tech
https://www.podbean.com/eas/pb-ypy32-15747e6

Episode #93: Bayesianische Statistik: Vorwissen und Daten
kombinieren https://www.podbean.com/eas/pb-crgji-1ab8218

Fragen, Feedback oder Themenwünsche? Schreibt uns gern an:
podcast@inwt-statistics.de
Episode melden

„#96: Queer Data: Wie erfasst, bereinigt und analysiert man sensible Daten?“

Worum geht es? Danach fragen wir noch nach dem Grund.

Abonnenten

Ad
Berlin, Deutschland

Teilen

Mein Archiv

Deine Privatkopie der Folgen, die du nicht verlieren willst.

Podcast-Folgen verschwinden. Feeds werden auf die letzten Episoden gekürzt, Hoster räumen alte Dateien ab, Formate wechseln den Anbieter und lassen ihr Archiv zurück. Mit „Mein Archiv“ sichert podcast.de die Folgen deiner Podcasts für dich — angefangen bei den ältesten, denn die sind zuerst weg.

  • Deine gesicherten Folgen bleiben hörbar, auch wenn das Original offline geht.
  • Auch Folgen, die im heutigen Feed gar nicht mehr stehen — podcast.de kennt sie noch.
  • Herunterladen bleibt möglich, solange die Folge beim Podcaster liegt. Der zählt seine Abrufe wie bisher.
Startet bald

Sei beim Start von Mein Archiv dabei

Mein Archiv ist fast fertig. Trag dich ein, dann bekommst du eine E-Mail, sobald es losgeht – und bist von Anfang an dabei. Wir schreiben dir nur zum Start, keine Werbung, keine Weitergabe deiner Daten.

Du bekommst zuerst eine Bestätigungsmail. Abmelden geht jederzeit. Datenschutz