Podcast
Podcaster
KI - kurz und informativ, Klartext "to Go" in unter 5 Minuten
Du folgst jetzt diesem Podcast.
Beschreibung
vor 1 Monat
Large Language Models (LLMs) wie GPT auf dem eigenen PC oder
Smartphone laufen lassen? Ja, das geht!
Quantisierung ist eine Schlüsseltechnik, mit der das
funktioniert. Damit können riesige KI-Modelle drastisch
verkleinern lassen, ohne dabei komplett auf Qualität zu
verzichten.
Du erfährst in der Folge:
Warum LLMs so viel Speicherplatz brauchen (und was FP32, FP16
und INT8 damit zu tun haben).
Wie Quantisierung den Speicherbedarf eines Modells
reduziert.
Was die Vor- und Nachteile sind und wie du dank
Quantisierung, ein LLM theoretisch lokal auf deinem PC, Mac oder
Home-Server betreiben könntest.
Weitere Episoden
6 Minuten
vor 6 Tagen
7 Minuten
vor 2 Wochen
6 Minuten
vor 3 Wochen
8 Minuten
vor 1 Monat
Abonnenten
Ehingen
Kommentare (0)
Melde Dich an, um einen Kommentar zu schreiben.