

Unknown · v2 · seit 30. Juli 2026 · 3× · zuletzt 01. Aug. 2026
58
Momentum
Gemini Robotics ER 2 ist das aktuelle "embodied reasoning"-Modell von Google DeepMind, das als hochrangige Reasoning-Schicht für Roboter fungiert. Es basiert auf Gemini 3.5 Flash, versteht visuelle, Video-, Audio- und Textinformationen, plant mehrstufige Aufgaben, orchestriert Vision-Language-Action-Modelle (VLAs) sowie externe Tools und ermöglicht Multi-Roboter-Kollaboration. Das Modell wurde am 30. Juli 2026 vorgestellt und ist als "gemini-robotics-er-2-preview" bzw. als Streaming-Variante über die Gemini API, Google AI Studio und (private Preview) die Gemini Enterprise Agent Platform verfügbar.
Momentum-Verlauf
03.05.01.08.
Features
| Compliance/Zertifizierung | Laut Google sicherstes Robotik-Modell bisher; hohe Compliance bei Sicherheitsbeschränkungen und Personennähe (ASIMOV-Agentic-Benchmark) |
| Deployment-Modell | Cloud-API-Zugriff (kein erforderliches spezielles Hardware/Software-Setup); Streaming-Variante für latenzsensitive Live-Robotik-Anwendungen |
| Einsatzbereich | Robotik: räumliches Reasoning, Videoverständnis (Fortschritt/Erfolgserkennung), Instrumentenablesung, Multi-Roboter-Orchestrierung, mehrstufige Aufgabenplanung |
| Integrationen | Gemini Live API (bidirektionales Streaming), Google Search, Funktionsaufrufe, Code-Ausführung, VLA-Modelle und Roboter-APIs (u.a. Boston Dynamics Spot) |
| Lizenz | Proprietäres Modell, Nutzung via API unter Gemini API Additional Terms of Service bzw. Google Cloud Platform Terms of Service |
| Plattform | Gemini API, Google AI Studio; private Preview auf der Gemini Enterprise Agent Platform |
| Preis | 2,00 $ pro 1 Mio. Token (Text/Standard), Bildinput ca. 0,0011 $/Bild; keine offizielle Preisangabe für Enterprise-Zugang |
| Release-Datum | 30. Juli 2026 (öffentliche Preview) |