Gemini Robotics-ER

Robotiikka / VLAEi saatavilla
kehittäjä: Google DeepMindMallin tunnus: gemini-robotics-er

Embodied-reasoning variant of Gemini Robotics. Enhanced 3D spatial reasoning and trajectory planning.

Tila
Ei saatavilla
Syöte → tulos
Teksti + Kuva → Robottitoiminnot
Kehittäjä
Google DeepMind
Päivitetty
23. syyskuuta 2026

Gemini Robotics-ER ei ole tällä hetkellä saatavilla

Voit silti lukea tiedot tältä sivulta. Valitse yksi alla olevista saatavilla olevista vaihtoehdoista suorittaaksesi vertailukelpoisen mallin heti.

01

Leikkikenttä

Gemini Robotics-ER

Tutkimusmalli

Ei tällä hetkellä saatavilla

Gemini Robotics-ER on robotiikkamalli (vision-language-action) eikä sitä voi suorittaa railwail-ohjelmointirajapinnan kautta.

02

Tietoja: Gemini Robotics-ER

Lyhyesti23. syyskuuta 2026 alkaen

Gemini Robotics-ER on Google DeepMind-kehittäjän malli kategoriasta Robotiikka / VLA. Gemini Robotics-ER ei ole tällä hetkellä saatavilla Railwailissa.

Tausta

Tietoja: Google DeepMind

Perustettu 2010 · London, UK / Mountain View, USA

Google DeepMind announced Gemini Robotics-ER (Embodied Reasoning) alongside Gemini Robotics in March 2025. While Gemini Robotics is the action-producing VLA, Gemini Robotics-ER is the reasoning-focused sibling: a Vision-Language Model variant of Gemini 2.0 specialised for spatial understanding, 3D grounding, point/box prediction, trajectory planning and code generation for robotics. It is designed to be combined with classical motion planners, low-level controllers or with the Gemini Robotics VLA itself. DeepMind positions Gemini Robotics-ER as a 'reasoning brain' that a robot stack can call with multimodal prompts to decompose tasks, locate objects in 2D / 3D, and emit waypoints or Python control code. As with Gemini Robotics, access is limited to research and partner programs.

Vieraile sivustolla Google DeepMind

Arkkitehtuuri

Vision-Language Model for Embodied Reasoning (no end-to-end action head)

Gemini Robotics-ER is a fine-tuned variant of Gemini 2.0 specialised for embodied perception and planning rather than direct control. The architecture preserves the multimodal Transformer backbone of Gemini 2.0 (image, video, text, code) but is post-trained on a curated corpus of embodied tasks: object detection in 2D and 3D, point and bounding-box prediction, grasp prediction, motion-trajectory generation, and code-as-policy outputs that call robot APIs. It can accept egocentric robot camera streams and a natural-language task description, then produce structured outputs such as pixel-space points to grasp, 3D coordinates relative to the camera, planning steps, or Python snippets that drive a downstream controller. In combination with the Gemini Robotics VLA, Robotics-ER provides high-level reasoning while the VLA handles closed-loop low-level actions.

Parametrit
Undisclosed (Gemini 2.0-class)

Ominaisuudet

  • Spatial reasoning over 2D / 3D scenes
  • Point and bounding-box prediction for objects and grasps
  • Trajectory waypoint generation
  • Code-as-policy generation (Python that calls robot APIs)
  • Compositional task planning from natural language
  • Pair with motion planners or with Gemini Robotics VLA
  • Multimodal context: images, video, text, robot state
  • Improved zero-shot performance on embodied QA benchmarks
  • Best for: planning and grounding modules in research robotics stacks.

Koulutus ja lisenssi

Gemini 2.0 multimodal pretraining plus embodied post-training on object-detection, 3D grounding, grasp prediction, trajectory planning, and code-generation tasks for robotic control. Draws on Google's internal robot datasets and curated public embodied datasets.

Lisenssi: Research-only / partner access through Google DeepMind. Not publicly downloadable.

Turvallisuustestit: Covered under Google DeepMind's Frontier Safety Framework and Responsible AI evaluations, with specific embodied-AI red-teaming for physical-harm and unsafe-action scenarios.

Tunnetut rajoitukset

  • No direct low-level action output
  • Requires downstream controller or planner
  • Closed model - no public weights or API
  • Spatial reasoning still imperfect on cluttered scenes
  • Latency too high for tight inner control loops
  • Generalisation depends on prompt and tool stack
03

Hinnat

Ei tällä hetkellä saatavilla. Tällä hetkellä tälle mallille ei ole hintaa, joten sitä ei voi suorittaa.

04

API

Kutsu Gemini Robotics-ER Railwail-API-avaimellasi. Käytä tätä mallin tunnusta pyynnössä:

Ei saatavilla API:n kautta

Robotiikan mallit suoritetaan robottilaitteistolla, ei railwail-API:n kautta.

05

Tekniset tiedot

Mallin tunnus
gemini-robotics-er
Kehittäjä
Google DeepMind
Syöte
Teksti, Kuva
Tuloste
Robottitoiminnot
Elinkaari
Nykyinen versio
Mallin koko
Undisclosed (Gemini 2.0-class)
Lisenssi
Research-only / partner access through Google DeepMind. Not publicly downloadable.
Luettelokirjaus päivitetty
23. syyskuuta 2026

Tunnisteet

  • google
  • deepmind
  • gemini
  • vla
  • robotics
  • research-only
  • weights-closed
  • embodied-reasoning
06

Käyttötapaukset

Mihin sitä käytetään

  • High-level planner in hierarchical robot stacks
  • Grounding language to 2D / 3D scene primitives
  • Code-as-policy generation for manipulation
  • Embodied QA and instruction parsing
  • Companion to motion planners or VLA controllers
  • Academic embodied-reasoning research
07

Usein kysytyt kysymykset

Mikä on Gemini Robotics-ER?

Gemini Robotics-ER on Google DeepMindn kehittämä malli Robotiikka / VLA-kategoriassa. Se on listattu Railwailissa, mutta sitä ei voi tällä hetkellä suorittaa.

Paljonko Gemini Robotics-ER maksaa Railwailissa?

Gemini Robotics-ERta ei voi tällä hetkellä suorittaa Railwailissa, joten nykyistä hintaa ei ole. Saatavilla olevat vaihtoehdot hintojen kanssa on lueteltu tämän sivun alempana.

Kuinka nopea Gemini Robotics-ER on?

Gemini Robotics-ERlla ei ole vielä tarpeeksi mitattuja suorituksia Railwailissa suoritusajan ilmoittamiseksi. Se riippuu syötteestä, asetuksista ja palveluntarjoajan kuormituksesta.

Milloin Gemini Robotics-ER on oikea valinta?

Gemini Robotics-ER kuuluu Robotiikka / VLA-kategoriaan. Kategorian sivulla on lueteltu muut tämän tyyppisen mallit hintojen kanssa.

Kaikki mallit: Robotiikka / VLA

Voiko Gemini Robotics-ER käsitellä kuvia?

Kyllä. Gemini Robotics-ER hyväksyy kuvia syötteenä tekstin lisäksi.

Voiko Gemini Robotics-ERa käyttää juuri nyt?

Ei tällä hetkellä saatavilla. Sivu pysyy verkossa; saatavilla olevat vaihtoehdot samasta kategoriasta on lueteltu alempana.

Kaikki mallit yhden API:n kautta

Yksi API-avain kaikille Railwailin malleille. Käyttö laskutetaan prepaid-krediiteistä, 1 krediitti = 0,01 $.