Robótica (modelos de acción / VLA)Gemini Robotics 2 — El cerebro de Google para robots (solo por invitación)
Gemini Robotics 2 es el modelo de Google DeepMind que convierte lo que ve un robot y tus órdenes en movimientos. Es un modelo VLA, es decir, ve, entiende el lenguaje y decide acciones para que el robot se mueva. Controla brazos y humanoides enteros, con manos y pinzas muy precisas, y hasta coordina varios robots a la vez. Está cerrado: solo se puede usar por invitación, en fase de acceso anticipado («private preview»). No se descarga, no se vende y no hay precios públicos.
Revisada el 2026-10-09
- Licencia
- cerrado (sin licencia pública y sin pesos)
- Categoría
- Robótica (modelos de acción / VLA)
Seguridad: revisada
El contenido es seguro; el instalador o el servicio externo no se auditan aquí.
¿Qué es?
Gemini Robotics 2 es el modelo de Google DeepMind para dar inteligencia a robots. Es un modelo VLA (siglas de vision-language-action: ve por las cámaras, entiende órdenes en lenguaje normal y las convierte en acciones para mover el robot). Google lo presentó el 30 de julio de 2026.
No es un solo modelo, sino tres que trabajan juntos:
- Gemini Robotics 2 — el modelo de acción principal. Controla desde brazos hasta humanoides completos (de los pies a las yemas de los dedos) y manos muy complejas (hasta 22 grados de libertad).
- Gemini Robotics On-Device 2 — una versión ligera, pensada para correr dentro del propio robot (sin depender de internet). Se adapta a un robot nuevo con unas pocas horas de datos (menos de 200 ejemplos).
- Gemini Robotics ER 2 — el «razonador»: entiende el espacio, hace planes de varios pasos y coordina con personas y otros robots.
Entre sus puntos fuertes: se adapta a cualquier robot de dos brazos en unas pocas horas, mantiene el equilibrio del cuerpo entero (dar pasos, agacharse, doblarse) y permite que varios robots colaboren en una misma tarea.
¿Para qué es especialista?
Para robótica generalista: tareas delicadas que piden finura (enroscar una bombilla, atar un nudo), manipulación con manos complejas, y control del cuerpo entero de un humanoide para moverse por espacios reales y desordenados.
También para planificar tareas largas y para coordinar varios robots, que se reparten el trabajo. Y para entender órdenes del día a día, incluso mientras el robot explica lo que está haciendo y le vas corrigiendo sin hablar «en técnico».
¿Es de frontera o pequeño? ¿Abierto o cerrado?
Es de frontera. Google lo presenta como su modelo de acción «más avanzado». No publica cuántos parámetros tiene.
Es cerrado. En su propia ficha, el estado del modelo es «private preview» (preestreno privado): los modelos de acción (VLA y On-Device) se dan solo a socios de acceso anticipado, y hay una lista de espera para pedir probarlos. No hay pesos que descargar ni licencia pública. La única puerta abierta al público es el modelo de razonamiento ER 2, que sí está disponible en Google AI Studio.
¿Cuánto cuesta?
No hay precio público. Gemini Robotics 2 no se vende y no se puede contratar como un servicio normal: el acceso es por invitación, dentro del programa de acceso anticipado de Google DeepMind (o a través de sus socios de robótica).
Es decir: hoy por hoy, para un particular o una empresa pequeña, no hay forma de pagar y usarlo. Google dice que quienes quieran probar los modelos pueden apuntarse a la lista de espera.
⚠️ Lo que hay que saber antes
- No puedes usarlo. Está en preestreno privado y solo lo tienen socios de Google. Si buscabas algo para descargar y probar hoy, este no es.
- No hay pesos ni licencia. Es completamente cerrado: nada de descargar, nada de código abierto.
- Tus datos irían a la nube. Es un servicio de Google: lo que capten las cámaras y sensores del robot pasaría por sus servidores (la versión On-Device está pensada para evitarlo, pero es la parte reservada a socios).
- Es un robot. Mover una máquina física tiene riesgo físico real.
- Todo en inglés y fuera del alcance de quien empieza.
¿Esto me sirve a mí?
Para la mayoría de la gente que empieza, no: no hay nada que instalar ni botón de «probar». Sirve para estar al día de hacia dónde va la robótica con IA.
Si te interesa probar algo de esta familia hoy, tu puerta es el modelo de razonamiento Gemini Robotics ER 2 en Google AI Studio. Para trastear de verdad con un robot, mira fichas de modelos abiertos como GR00T o los modelos π0 de Physical Intelligence.
¿Es seguro?
No hay nada que instalar, así que no hay riesgo para tu ordenador. El riesgo, en todo caso, es físico (es un modelo para mover robots) y de privacidad: al ser un servicio de Google, la información del robot pasa por su nube.
Como no está disponible al público, tampoco hay historial de fallos que mirar. Google dice que trabaja la seguridad «de forma integral», con salvaguardas y colaboración con expertos, pero sobre el papel.
¿Dónde funciona?
En los robots de los socios de Google. No se descarga ni se instala en tu ordenador: es un modelo cerrado que se usa a través de Google, en hardware de socios (humanoides y robots de dos brazos). No hay comandos de instalación porque no hay nada que instalar.
Lo único accesible al público de esta familia es el modelo de razonamiento ER 2, que está en Google AI Studio (con cuenta de Google) y en preestreno privado dentro de Gemini Enterprise Agent Platform.