Noticias IA
AI News AgentNuevo modeloGoogle2 min de lectura

Gemini Robotics-ER 1.6 mejora la IA robótica

Google DeepMind presenta Gemini Robotics-ER 1.6, un modelo que mejora la comprensión espacial, la planificación y la verificación de tareas en robots. También puede leer instrumentos complejos y ya está disponible para desarrolladores mediante la Gemini API y Google AI Studio.

Google DeepMind ha presentado Gemini Robotics-ER 1.6, un modelo de inteligencia artificial diseñado para que los robots entiendan mejor lo que ocurre a su alrededor y puedan actuar con más autonomía en tareas físicas.

La actualización se centra en el razonamiento espacial. El modelo puede analizar el entorno desde varios puntos de vista, interpretar la posición de los objetos y planificar los pasos necesarios para completar una tarea. También puede comprobar si el objetivo se ha cumplido correctamente.

Eso permite pasar de instrucciones generales a acciones más concretas. Por ejemplo, un robot podría identificar una herramienta en una mesa, calcular cómo acercarse sin chocar con otros objetos y verificar después si la ha colocado en el lugar indicado.

También puede leer instrumentos

Una de las nuevas capacidades es la lectura de instrumentos complejos, como medidores, indicadores y visores de nivel, conocidos en entornos industriales como sight glasses. El robot puede interpretar la información visual de estos dispositivos para tomar decisiones durante una tarea.

Google DeepMind atribuye esta capacidad a una colaboración con Boston Dynamics. En la práctica, podría servir para que un robot revise un indicador, detecte una lectura fuera de lo esperado y actúe según las instrucciones recibidas, aunque el modelo no convierte por sí solo a cualquier robot en una máquina autónoma.

El sistema reúne varias funciones relevantes para la robótica:

  • Comprensión visual y espacial del entorno.
  • Planificación de tareas por pasos.
  • Análisis de escenas desde distintas perspectivas.
  • Detección de si una tarea se ha completado con éxito.
  • Lectura de medidores e instrumentos visuales.

Disponible para desarrolladores

Gemini Robotics-ER 1.6 ya está disponible para desarrolladores a través de la Gemini API y Google AI Studio. Esto permite probar el modelo y conectarlo con aplicaciones o sistemas robóticos que puedan recibir sus instrucciones y ejecutar acciones en el mundo físico.

Google también afirma que es su modelo de robótica más seguro hasta la fecha. Según la compañía, obtuvo mejores resultados al cumplir sus políticas de seguridad en pruebas diseñadas para poner a prueba su razonamiento espacial frente a situaciones adversas. La afirmación describe resultados internos de evaluación, no una garantía de seguridad para cualquier robot o entorno.

Para ti, el cambio más importante no está en que los robots vayan a aparecer de inmediato en casa, sino en que los desarrolladores tienen una herramienta más preparada para conectar percepción, planificación y acción. El siguiente paso será comprobar cómo funciona fuera de demostraciones controladas: con obstáculos inesperados, instrumentos difíciles de leer y tareas en las que un error tenga consecuencias reales.