

H Company · v3.1 · seit 2. Juni 2026 · 6× · zuletzt 29. Juni 2026
Holo3.1 ist eine von H Company (Paris) im Juni 2026 veröffentlichte Familie von Vision-Language-Modellen für Computer-Use-Agenten, die auf der Qwen-Architektur basiert. Die Modelle sind in vier Größen (0,8B, 4B, 9B, 35B-A3B) verfügbar und decken Web-, Desktop- und Mobile-Umgebungen ab. Neu sind quantisierte Checkpoints (FP8, Q4 GGUF, NVFP4), die erstmals eine vollständig lokale Ausführung auf Windows-, Mac- oder DGX-Spark-Hardware ermöglichen, sowie native Unterstützung für Function-Calling-Protokolle zur Integration in Agenten-Frameworks. Die offenen Gewichte werden unter Apache-2.0-Lizenz auf Hugging Face bereitgestellt, während der Zugriff per Cloud-API über die Holo Models API nutzungsbasiert abgerechnet wird.
Features
| Autonomie-Grad | Autonomer Computer-Use-Agent: analysiert Screenshots und führt eigenständig Aktionen wie Klicks, Tastatureingaben und Scrollen aus |
| Kanäle | Web-, Desktop- und Mobile-Umgebungen (Browser-Automatisierung, Business-Software, Android-Geräte) |
| Lizenz | Apache 2.0 (offene Gewichte auf Hugging Face) |
| Modalitäten | Multimodal: Text- und Bildeingabe (Screenshots) zur visuellen UI-Interpretation und Aktionsplanung |
| Orchestrierte KI-Modelle | Qwen 3.5 family (Basismodelle); Fine-tuned VLMs: Holo3.1-0.8B, Holo3.1-4B, Holo3.1-9B, Holo3.1-35B-A3B (35B total / 3B active, MoE); Quantisierungen: BF16, FP8, NVFP4 (W4A16), Q4 GGUF |
| Plattform | Läuft lokal auf Windows- oder Mac-Rechnern, optional Modellausführung auf Apple Silicon oder DGX Spark im selben Netzwerk; zusätzlich Cloud-API verfügbar |
| Preis | Open-Weight-Modelle kostenlos (Apache-2.0, selbst hostbar); Cloud-API mit kostenlosem Rate-Limited-Tier, danach nutzungsbasierte Abrechnung pro Mio. Token |
| Release-Datum | 2. Juni 2026 |
| Tool-/MCP-Integrationen | Native Function-Calling-Unterstützung zusätzlich zu strukturierten JSON-Outputs; OpenAI-kompatible Models API für Drittanbieter-Agenten-Frameworks |