Anmeldung Registrierung
Auto Hell Dunkel
Erweiterte Suche
Suchmaschinen (click here to comment)

25. Februar 2020, Jochen

Heute ging es um Volltextsuchmaschinen.

Wir sprechen darüber, was die so grundsätzlich tun und wie man
sie von Python aus verwenden kann, oder auch selbst eine
implementieren könnte. Weitere Themen waren die Relevanz von
Suchergebnissen, SEO und alles Mögliche drumherum. Zudem haben
wir unsere Androhung aus früheren Episoden wahr gemacht und
sprechen ein wenig über das pathlib Modul aus der
Standardbibliothek.

Shownotes

Unsere E-Mail für Fragen, Anregungen & Kommentare:
hallo@python-podcast.de

News aus der Szene

Bald startet der Kartenverkauf für die europython
2020

Python 3.8.2

Modul aus der Standardbibliothek

Pathlib

Metathema

WDR 5 Das philosophische Radio

Volltextsuchmaschinen

Lucene - inzwischen die Standardbibliothek für
Volltextsuche

Solr - Ein auf Lucene aufsetzender Suchserver

Elasticsearch - Ein ebenfalls auf Lucene aufsetzender
Suchserver

xapian

Sphinx

whoosh Volltextsuche in Python

FTS5 Volltextsucherweiterung für sqlite

Postgresql Volltextfeature

MariaDB Volltextfeature

zombodb

Variable byte encoding

TREC Conference series

BM25 / Okapi

PageRank

RediSearch Volltexterweiterung für redis

Learning to rank

NDCG, MAP, ERR

Django Postgres full text search

Picks

The Algorithms python

read json directly in python: Armin Ronacher's tweet

Python Entwicklungsumgebung Windows

Tutorial: pyenv installation mit powershell
Episode melden

„Suchmaschinen“

Worum geht es? Danach fragen wir noch nach dem Grund.

Teilen

Mein Archiv

Deine Privatkopie der Folgen, die du nicht verlieren willst.

Podcast-Folgen verschwinden. Feeds werden auf die letzten Episoden gekürzt, Hoster räumen alte Dateien ab, Formate wechseln den Anbieter und lassen ihr Archiv zurück. Mit „Mein Archiv“ sichert podcast.de die Folgen deiner Podcasts für dich — angefangen bei den ältesten, denn die sind zuerst weg.

  • Deine gesicherten Folgen bleiben hörbar, auch wenn das Original offline geht.
  • Auch Folgen, die im heutigen Feed gar nicht mehr stehen — podcast.de kennt sie noch.
  • Herunterladen bleibt möglich, solange die Folge beim Podcaster liegt. Der zählt seine Abrufe wie bisher.
Startet bald

Sei beim Start von Mein Archiv dabei

Mein Archiv ist fast fertig. Trag dich ein, dann bekommst du eine E-Mail, sobald es losgeht – und bist von Anfang an dabei. Wir schreiben dir nur zum Start, keine Werbung, keine Weitergabe deiner Daten.

Du bekommst zuerst eine Bestätigungsmail. Abmelden geht jederzeit. Datenschutz