Beschreibung
vor 2 Wochen
Large Language Models (LLMs) wie GPT auf dem eigenen PC oder
Smartphone laufen lassen? Ja, das geht!
Quantisierung ist eine Schlüsseltechnik, mit der das
funktioniert. Damit können riesige KI-Modelle drastisch
verkleinern lassen, ohne dabei komplett auf Qualität zu
verzichten.
Du erfährst in der Folge:
Warum LLMs so viel Speicherplatz brauchen (und was FP32, FP16
und INT8 damit zu tun haben).
Wie Quantisierung den Speicherbedarf eines Modells
reduziert.
Was die Vor- und Nachteile sind und wie du dank
Quantisierung, ein LLM theoretisch lokal auf deinem PC, Mac oder
Home-Server betreiben könntest.
Weitere Episoden
6 Minuten
vor 2 Tagen
8 Minuten
vor 1 Woche
11 Minuten
vor 3 Wochen
18 Minuten
vor 1 Monat
7 Minuten
vor 1 Monat
Abonnenten
Ehingen
Kommentare (0)
Melde Dich an, um einen Kommentar zu schreiben.