Gemini Robotics (2025)

Robotik / VLAInte tillgÀnglig
av Google DeepMindModell-ID: gemini-robotics-2025

Google DeepMind's vision-language-action model based on Gemini 2.0. Generalist robot policy with strong dexterity.

Status
Inte tillgÀnglig
Inmatning → utmatning
Text + Bild → Roboteraktioner
Utvecklare
Google DeepMind
Uppdaterad
23 september 2026

Gemini Robotics (2025) Àr för nÀrvarande otillgÀnglig

Du kan fortfarande lÀsa detaljerna pÄ denna sida. VÀlj ett av de tillgÀngliga alternativen nedan för att köra en jÀmförbar modell direkt.

01

Playground

Gemini Robotics (2025)

Forskningsmodell

Inte tillgÀnglig för nÀrvarande

Gemini Robotics (2025) Àr en robotikmodell (vision-language-action) och kan inte köras via railwail API.

02

Om Gemini Robotics (2025)

Kort sagtFrÄn och med 23 september 2026

Gemini Robotics (2025) Àr en modell av Google DeepMind i kategorin Robotik / VLA. Gemini Robotics (2025) Àr för nÀrvarande inte tillgÀnglig pÄ Railwail.

Bakgrund

Om Google DeepMind

Grundat 2010 · London, UK / Mountain View, USA

Google DeepMind is the merged research organisation of DeepMind (London, 2010) and Google Brain, responsible for the Gemini frontier-model family. The DeepMind robotics group has a long lineage of generalist-robot work, from SayCan and RT-1 through RT-2 and the Open-X-Embodiment collaboration. In March 2025 the team announced Gemini Robotics, an advanced Vision-Language-Action (VLA) model built on top of Gemini 2.0 that brings multimodal reasoning, web knowledge and code into low-level robot control. Gemini Robotics is positioned as a generalist foundation model for dexterous bimanual manipulation, and is being trialled with hardware partners including Apptronik (Apollo humanoid), Agility (Digit) and Boston Dynamics. The model is research-only and not publicly available, but accompanies a public tech report and demo gallery.

Besök Google DeepMind

Arkitektur

Vision-Language-Action (VLA) transformer on top of Gemini 2.0 multimodal foundation

Gemini Robotics is a Vision-Language-Action model built from Gemini 2.0 by adding an action decoder that converts multimodal context (camera images, language instructions, optional robot state) into continuous low-level control commands. The backbone retains Gemini's web-scale multimodal pretraining (text, image, video, code), so the policy inherits broad world knowledge and language understanding. On top of that, the model is fine-tuned on a large multi-embodiment robot demonstration corpus including Aloha 2 bimanual setups, third-party humanoids (Apptronik Apollo, Agility Digit) and Google's own manipulation platforms. It outputs continuous action chunks at high frequency and is trained to produce smooth, reactive behaviour rather than discrete action tokens. A companion 'ER' (Embodied Reasoning) variant exposes intermediate reasoning, point/box predictions, and 3D grounding to drive planners.

Parameter
Undisclosed (Gemini 2.0-class backbone with action head)

Funktioner

  • Generalist VLA built on Gemini 2.0 multimodal backbone
  • Bimanual dexterous manipulation (Aloha 2, humanoids)
  • Zero-shot generalisation to new objects and instructions
  • Reactive closed-loop control with low latency
  • Natural-language instruction following with chain-of-thought
  • Multi-embodiment: arms, humanoids, mobile bases
  • Tight integration with Gemini Robotics-ER for planning and grounding
  • Public demos: folding origami, packing lunch boxes, slam-dunking miniature balls
  • Best for: research collaborations on dexterous manipulation.

TrÀning & licens

Multi-embodiment robot demonstration corpus combining Google's internal datasets (RT-1/RT-2 lineage, Aloha 2 bimanual), partner humanoid data (Apptronik Apollo, Agility Digit) and Open-X-Embodiment style cross-embodiment teleoperation. Inherits Gemini 2.0's multimodal pretraining (text, image, video, code) at web scale.

Licens: Research-only - not publicly released; access via Google DeepMind research collaborations with selected hardware partners.

SĂ€kerhetstestning: Google DeepMind applies its standard Responsible AI / Frontier Safety Framework to Gemini Robotics, including pre-release safety evaluations, restricted access, and red-team probing for physical-harm and misuse scenarios. The Gemini Robotics technical report discusses safety guardrails and embodied red-teaming.

KÀnda begrÀnsningar

  • Not publicly available - partner research access only
  • No public weights or API
  • Performance numbers limited to lab demonstrations
  • Generalisation across very different embodiments still bounded
  • Compute requirements undisclosed but high
  • Real-time deployment requires on-board acceleration
03

Priser

Inte tillgÀnglig för nÀrvarande. Det finns ingen pris för denna modell för nÀrvarande, sÄ den kan inte köras.

04

API

Anropa Gemini Robotics (2025) med din Railwail API-nyckel. AnvÀnd detta modell-ID i begÀran:

Inte tillgÀnglig via API:et

Robotikmodeller körs pÄ robotmaskinvara, inte via railwail-API:et.

05

Specifikationer

Modell-ID
gemini-robotics-2025
Utvecklare
Google DeepMind
Inmatning
Text, Bild
Utmatning
Roboteraktioner
Livscykel
Inte tillgÀnglig
Modellstorlek
Undisclosed (Gemini 2.0-class backbone with action head)
Licens
Research-only - not publicly released; access via Google DeepMind research collaborations with selected hardware partners.
KataloginlÀgg uppdaterat
23 september 2026

Taggar

  • google
  • deepmind
  • gemini
  • vla
  • robotics
  • research-only
  • weights-closed
06

AnvÀndningsfall

Vad det anvÀnds till

  • Research collaborations on generalist robot policies
  • Humanoid dexterous manipulation studies
  • Benchmarking VLA scaling from frontier LLMs
  • Embodied reasoning + manipulation pipelines
  • Partner-only hardware integration projects
  • Academic citation as state-of-the-art VLA baseline
07

Vanliga frÄgor

Vad Àr Gemini Robotics (2025)?

Gemini Robotics (2025) Àr en modell av Google DeepMind i kategorin Robotik / VLA. Den finns i Railwail-katalogen men kan inte köras för nÀrvarande.

Vad kostar Gemini Robotics (2025) pÄ Railwail?

Gemini Robotics (2025) kan inte köras pÄ Railwail för nÀrvarande, sÄ det finns inget aktuellt pris. TillgÀngliga alternativ med priser visas lÀngre ned pÄ denna sida.

Hur snabb Àr Gemini Robotics (2025)?

Det finns Ànnu inte tillrÀckligt mÄnga uppmÀtta körningar av Gemini Robotics (2025) pÄ Railwail för att ange en körningstid. Det beror pÄ inmatningen, instÀllningarna och belastningen hos leverantören.

NÀr ska jag anvÀnda Gemini Robotics (2025)?

Gemini Robotics (2025) tillhör kategorin Robotik / VLA. Kategorisidan listar de andra modellerna av denna typ med deras priser.

Alla modeller: Robotik / VLA

Kan Gemini Robotics (2025) bearbeta bilder?

Ja. Gemini Robotics (2025) accepterar bilder som inmatning utöver text.

Kan jag anvÀnda Gemini Robotics (2025) just nu?

Inte tillgÀnglig för nÀrvarande. Sidan förblir online; tillgÀngliga alternativ frÄn samma kategori visas lÀngre ned.

Alla modeller via ett API

En API-nyckel för alla modeller pÄ Railwail. AnvÀndningen debiteras frÄn förbetald kredit, 1 kredit = 0,01 US$.