Anmeldung Registrierung
Auto Hell Dunkel
Erweiterte Suche
  1. Startseite
  2. Podcasts
  3. Techtiefen Podcast
  4. #31 Effiziente Datenverarbeitung
Uwe Korn ist Data Engineer und engagiert sich seit mehreren Jahren
in verschiedenen Open Source Projekten, insbesondere Apache Parquet
und Apache Arrow. Apache Parquet ist ein spaltenorientiertes
Speicherformat für tabellarische Daten, mit einer guten Schreib-
und Leseperformance für Batch-Prozesse. Parquet erfasst dazu beim
Schreiben die Datentypen und zahlreiche Metriken, um mit
eingebauter Komprimierung die Dateigröße deutlich zu komprimieren.
Dazu reden wir auch über andere Datenformate wie Avro, CSV, ORC,
Hdf5 und Feather. Apache Arrow ist ein In-Memory Speicherformat für
Daten, welches die Brücke zwischen zahlreichen den
Programmiersprachen schlägt. Dadurch wird es möglich, in C-Code,
Java, Rust oder einer der anderen implementierten Sprachen auf die
gleichen Daten zuzugreifen. Uwe erklärt uns, wie diese
Sprach-Brücke funktioniert und wie Arrow zukünftig nicht nur zur
Haltung sondern auch zur Verarbeitung von Daten eingesetzt werden
kann. Zum Abschluss befrage ich Uwe zu seinem Engagement im Open
Source Umfeld. Wie hat er den Einstieg gefunden? Wie lässt sich
Open Source mit Beruf und Privatleben vereinbaren? Und worauf
sollte man achten, wenn man selbst ein Open Source Projekt
unterstützen möchte? Weiter Links: ChanZuckerberg-Stiftung
unterstützen Arrow

Weitere Episoden

45 Developer Advocacy

45 Developer Advocacy

1 Stunde 38 Minuten
vor 2 Jahren
44 Big Data auf K8s mit Stackable

44 Big Data auf K8s mit Stackable

1 Stunde 14 Minuten
vor 2 Jahren
43 Frauen in der IT

43 Frauen in der IT

50 Minuten
vor 2 Jahren
42 AI Chatbots & Open-Assistant

42 AI Chatbots & Open-Assistant

2 Stunden 32 Minuten
vor 3 Jahren
#41 WebAssembly

#41 WebAssembly

1 Stunde 8 Minuten
vor 3 Jahren

Teilen

Mein Archiv

Deine Privatkopie der Folgen, die du nicht verlieren willst.

Podcast-Folgen verschwinden. Feeds werden auf die letzten Episoden gekürzt, Hoster räumen alte Dateien ab, Formate wechseln den Anbieter und lassen ihr Archiv zurück. Mit „Mein Archiv“ sichert podcast.de die Folgen deiner Podcasts für dich — angefangen bei den ältesten, denn die sind zuerst weg.

  • Deine gesicherten Folgen bleiben hörbar, auch wenn das Original offline geht.
  • Auch Folgen, die im heutigen Feed gar nicht mehr stehen — podcast.de kennt sie noch.
  • Herunterladen bleibt möglich, solange die Folge beim Podcaster liegt. Der zählt seine Abrufe wie bisher.
Startet bald

Sei beim Start von Mein Archiv dabei

Mein Archiv ist fast fertig. Trag dich ein, dann bekommst du eine E-Mail, sobald es losgeht – und bist von Anfang an dabei. Wir schreiben dir nur zum Start, keine Werbung, keine Weitergabe deiner Daten.

Du bekommst zuerst eine Bestätigungsmail. Abmelden geht jederzeit. Datenschutz