

Unknown · 3× · zuletzt 20. Sept. 2026
38
Momentum
Bonsai 1.7B ist ein natives 1-Bit-Sprachmodell von PrismML (einem aus Caltech-Forschung hervorgegangenen Startup), das auf der Qwen3-Architektur basiert. Die Gewichte sind auf ein einzelnes Vorzeichenbit pro Parameter reduziert (effektiv 1,125 Bit/Gewicht inkl. Skalierungsfaktoren), wodurch das Modell als GGUF-Datei nur rund 248-290 MB groß ist. Es ist Teil der breiteren Bonsai-Modellfamilie (1.7B, 4B, 8B, 27B) und läuft dank extrem geringem Speicherbedarf lokal auf Laptops, Smartphones und sogar im Browser via WebGPU. Das Modell wird unter der Apache-2.0-Lizenz kostenlos bereitgestellt.
Momentum-Verlauf
22.06.20.09.
Features
| Key-Benchmark (%) | GSM8K-Auswertung auf offiziellem Hugging-Face-Leaderboard verlinkt (konkreter Score dort einsehbar, nicht in Textform auf der Modellkarte beziffert) |
| Kontextfenster (Token) | Basiert auf Qwen3-Architektur (Kontextlänge für 1.7B-Variante offiziell nicht separat beziffert; größere Bonsai-Modelle nutzen 262.144 Token) |
| Lizenz | Apache 2.0 (freie Nutzung inkl. kommerziell) |
| Multimodalität | Rein textbasiert (kein Bild-Input); Vision-Fähigkeiten sind erst ab den 27B-Modellen der Bonsai-Familie verfügbar |
| Plattform | Lokal via llama.cpp (GGUF, Q1_0) auf CPU/GPU (CUDA, Metal), MLX für Apple Silicon/iPhone, sowie WebGPU im Browser |
| Release-Datum | 31. März 2026 |