Gemini Robotics 1.5
Google DeepMind
An agentic robotics model combining advanced multimodal reasoning with vision-language-action control for multi-step physical tasks.
Multi-step reasoning
Keep availability distinct from Gemini Robotics On-Device and ER releases.
A model hub link is a declaration. Files, loadability, evaluation, and deployment are scored separately.
Model decision scorecard
Use-case scores and evidence confidence are separate; Unknown is not treated as failure.
Code, weights, and checkpoints
UnknownArtifact availability is unknown.
Loading and training reproducibility
UnknownNo verified loading configuration is available.
Training data requirements
UsefulRequired signal categories are declared; exact tensor and action interfaces still need verification.
Evaluation evidence
UsefulEvaluation focus is declared, but metrics are not independently verified.
Deployment readiness
UnknownHardware, latency, dependencies, and runtime loading are not yet verified.
Artifact facts and provenance
No metadata-verified artifact facts yet. Source links remain declarations only.
Loop signal demand
Signals this model family needs for training, evaluation, or failure mining.
Observation / ego video
observation · Visual observations
Language intent / task phase
language intent · task phase · Multi-step instructions
Action / robot state
actions · Action traces
Future state / dynamics
Needs future-state supervision or rollout structure to validate predictive dynamics.
Feedback / correction / failure
feedback/failure
Sim-real / embodiment metadata
Embodiment-specific adaptation data · Cross-embodiment adaptation
Evaluation focus
- Multi-step reasoning
- Physical tool use
- Cross-embodiment adaptation
Missing critical loop signals
Core signal demands are represented. Check quality, alignment, and access constraints.
Related catalog datasets
Ego-Exo4D
Synchronized first-person and third-person skilled activity
Exact action dimensions, control frequency, normalization, and camera mapping require interface verification.
Open X-Embodiment
Cross-embodiment robot learning in a unified format
Exact action dimensions, control frequency, normalization, and camera mapping require interface verification.
DROID
In-the-wild real-world robot manipulation
Exact action dimensions, control frequency, normalization, and camera mapping require interface verification.
OpenBot notes
- Keep availability distinct from Gemini Robotics On-Device and ER releases.
