

Unknown · 2× · zuletzt 24. Sept. 2026
Guanaco ist eine Familie offener Sprachmodelle (7B, 13B, 33B und 65B Parameter), die von Forschern der University of Washington mittels der QLoRA-Methode auf Basis von Metas LLaMA-Modellen feinabgestimmt wurde. QLoRA ermöglicht das Finetuning eines 65B-Parameter-Modells auf einer einzelnen 48-GB-GPU durch 4-Bit-Quantisierung bei Beibehaltung der Leistung von 16-Bit-Finetuning. Laut den Autoren erreichte das beste Guanaco-Modell auf dem Vicuna-Benchmark 99,3% der Leistung von ChatGPT und übertraf damit alle zuvor veröffentlichten offenen Modelle. Guanaco ist als Forschungsprojekt konzipiert; Code und Modellgewichte wurden über GitHub und Hugging Face veröffentlicht.
Features
| Key-Benchmark (%) | 99,3% der ChatGPT-Leistung auf dem Vicuna-Benchmark (GPT-4-Bewertung) |
| Lizenz | QLoRA-Code: MIT-Lizenz; Guanaco-Adaptergewichte: Apache 2.0; Nutzung erfordert Zugang zu LLaMA-Basismodell gemäß LLaMA-Lizenz |
| Multimodalität | Nein – reines Text-Sprachmodell (Chatbot), keine multimodalen Fähigkeiten dokumentiert |
| Plattform | Verfügbar auf GitHub (artidoro/qlora) und Hugging Face; Demo via Gradio/Colab |
| Release-Datum | 23. Mai 2023 (arXiv-Paper), GitHub-Repo laufend aktualisiert (letztes Update 18. Juli 2023) |