Anmeldung Registrierung
Erweiterte Suche
  1. Startseite
  2. Podcasts
  3. Lissy — Daily AI News Podcast
  4. Ternary LLMs: BitNet, 1-Bit Bonsai & lokale CPU-Modelle
Ternary Modelle (1.58 Bit) brauchen 20x weniger Speicher als FP16
und laufen auf CPU. BitNet b1.58 2B4 und 1-Bit Bonsai zeigen das.
Aber beide sind Base Models ohne Chat-Feintuning und ohne
produktive Inference-Engine. Wer heute lokal testen will, nutzt
2-Bit-quantisierte Chat-Modelle via Llama.cpp.

Abonnenten

Teilen