

Ollama · seit Juli 2023 (erste öffentliche Veröffentlichung via GitHub) · 121× · zuletzt 13. Aug. 2026
83
Momentum
Ollama ist eine quelloffene Laufzeitumgebung (MIT-Lizenz) zum lokalen Ausführen großer Sprachmodelle auf eigener Hardware unter macOS, Linux und Windows. Es bietet eine native REST-API sowie eine OpenAI- und Anthropic-kompatible Schnittstelle und wird über eine große Modellbibliothek (Llama, Qwen, Gemma, DeepSeek u.v.m.) per einfachem CLI-Befehl betrieben. Zusätzlich zum kostenlosen lokalen Betrieb bietet der Anbieter mit "Ollama Cloud" einen kostenpflichtigen gehosteten Dienst für größere Modelle an, der dieselbe API-Oberfläche nutzt.
Momentum-Verlauf
19.05.17.08.
Features
| Deployment (Self-host/Cloud) | Self-Hosting auf eigener Hardware (unlimitiert) oder gehostet über Ollama Cloud (Free/Pro/Max) |
| Lizenz | MIT-Lizenz (Open Source, CLI/Kern-Repository) |
| Plattform | macOS, Linux, Windows; zusätzlich Docker-Image verfügbar |
| Preis | Lokale Software kostenlos (MIT-Lizenz); Ollama Cloud: Free $0, Pro $20/Monat (oder $200/Jahr), Max $100/Monat |
| Protokoll-Kompatibilität | Native REST-API (JSON/NDJSON-Streaming) sowie OpenAI-kompatible Endpunkte (/v1/chat/completions, /v1/embeddings, /v1/models, /v1/responses) und Anthropic Messages API-Kompatibilität |
| Unterstützte Modelle/Provider | Große Modellbibliothek: Llama, Qwen, Gemma, DeepSeek, Mistral, Phi u.a., verwaltet über ollama.com/library |