Anmeldung Registrierung
Auto Hell Dunkel
Erweiterte Suche
  1. Startseite
  2. Podcasts
  3. MY DATA IS BETTER THAN YOURS Podcast
  4. Knowledge Graph statt klassischem Data Stack: die Struktur hinter Recommender und Agenten – mit Stefan Neubig, Head of Data Engineering und AI bei Outdooractive – Folge 330
Knowledge Graph statt klassischem Data Stack: die Struktur hinter Recommender und Agenten – mit Stefan Neubig, Head of Data Engineering und AI bei Outdooractive – Folge 330

Knowledge Graph statt klassischem Data Stack: die Struktur hinter Recommender und Agenten – mit Stefan Neubig, Head of Data Engineering und AI bei Outdooractive – Folge 330

MY DATA IS BETTER THAN YOURS vor 2 Monaten
Zu Sammlung hinzufügen

Du hast noch keine Sammlungen.

Herunterladen (rechte Maustaste) Teilen Fundstellen Kommentare
0:00
38:01
Ein Recommender, der auf einem Knowledge Graph läuft, betrieben auf
zwei Servern für 250 und 50 Euro im Monat: Wie baut man so etwas,
und wann bringt die Datenstruktur dahinter mehr als ein klassischer
Data Stack? Stefan Neubig ist Head of Data Engineering und AI bei
Outdooractive, einer der größten europäischen
Outdoor-Tourismus-Plattformen. Parallel schreibt er an der TU
München an einer Doktorarbeit über Empfehlungssysteme und wie man
sie erklärbar macht. Genau an diesem Schnittpunkt aus
Industrierealität und Forschung läuft das Gespräch mit Jonas
Rashedi. Outdooractive hat zwei Seiten: eine B2C-App und ein
Wanderportal für Nutzer, die Touren und Points of Interest suchen
und planen, und ein B2B-Geschäft, in dem Destinationen ihre Inhalte
einstellen und ihre Besucher lenken wollen, weg von überlaufenen
Orten. Der Recommender muss deshalb mehrere Stakeholder
gleichzeitig bedienen, und er soll seine Vorschläge auch erklären.
Dahinter liegt ein Knowledge Graph. Stefan definiert ihn als Graph,
der Daten verbindet und zusätzlich eine Semantik in Form einer
Ontologie mitbringt, also ein Graphschema. Im Fall des Recommenders
sind das rund 92 Millionen Knoten, etwa Touren, Points of Interest,
Regionen und Nutzer, und ungefähr 140 Millionen explizite Kanten
dazwischen. Auf diesem Graphen wird ein Graph Neural Network
trainiert, einmal pro Woche, das die Wahrscheinlichkeit für neue
Kanten berechnet, zum Beispiel: Wie wahrscheinlich interessiert
sich dieser Nutzer für diese Tour? Der ehrlichste Moment der Folge
ist ein Misserfolg. In einem Experiment zur Besucherlenkung hat der
Recommender zuerst nicht funktioniert. Die Warnung „hier wird es
voll" hat die Leute erst recht angezogen, Knappheit macht
attraktiver. Erst als das Team die Empfehlung anders gerahmt und
emotionale Nachteile benannt hat, kein Parkplatz, Stau, hat sich
das Verhalten gedreht. Außerdem im Gespräch: warum Stefan im
Elevator Pitch nicht finanziell argumentiert, sondern über neue
Fähigkeiten, weil die Infrastruktur virtuell auf der vorhandenen
Datenbank aufsetzt und kaum Mehrkosten erzeugt. Was mit einem
klassischen Stack aus Snowflake, dbt und Looker plus einem
Sprachmodell passiert wäre. Warum der Knowledge Graph die Basis für
Agenten und MCP ist und wo eine reine API an ihre Grenzen stößt.
Und wie Stefan zwischen akademischem Anspruch und
Plattform-Realität aus der Not eine Tugend gemacht hat. Zum Schluss
die beiden Standardfragen. Privat ist Stefan Kaffee-Liebhaber und
würde am liebsten den Stromverbrauch seines Siebträgers auswerten,
wenn die Zeit da wäre. Und als Filmtitel für sein Data-Game wählt
er „Die Karte hinter der Karte": Die geografische Karte ist der
Stolz von Outdooractive, der Knowledge Graph ist die
Informationslandschaft dahinter.
Episode melden

„Knowledge Graph statt klassischem Data Stack: die Struktur hinter Recommender und Agenten – mit Stefan Neubig, Head of Data Engineering und AI bei Outdooractive – Folge 330“

Worum geht es? Danach fragen wir noch nach dem Grund.

Abonnenten

Teilen

Mein Archiv

Deine Privatkopie der Folgen, die du nicht verlieren willst.

Podcast-Folgen verschwinden. Feeds werden auf die letzten Episoden gekürzt, Hoster räumen alte Dateien ab, Formate wechseln den Anbieter und lassen ihr Archiv zurück. Mit „Mein Archiv“ sichert podcast.de die Folgen deiner Podcasts für dich — angefangen bei den ältesten, denn die sind zuerst weg.

  • Deine gesicherten Folgen bleiben hörbar, auch wenn das Original offline geht.
  • Auch Folgen, die im heutigen Feed gar nicht mehr stehen — podcast.de kennt sie noch.
  • Herunterladen bleibt möglich, solange die Folge beim Podcaster liegt. Der zählt seine Abrufe wie bisher.
Startet bald

Sei beim Start von Mein Archiv dabei

Mein Archiv ist fast fertig. Trag dich ein, dann bekommst du eine E-Mail, sobald es losgeht – und bist von Anfang an dabei. Wir schreiben dir nur zum Start, keine Werbung, keine Weitergabe deiner Daten.

Du bekommst zuerst eine Bestätigungsmail. Abmelden geht jederzeit. Datenschutz