Ciencia Y Tecnología

Google crea un cerebro para que robots entiendan el mundo y trabajen con humanos

La compañía lanzó el modelo de inteligencia artificial Gemini ER 2, el cual funciona como una mente para estos dispositivos

Google creó un cerebro para que los robots entiendan el mundo y trabajen con humanos. Se trata del modelo de inteligencia artificial Gemini Robotics ER 2, pensado para funcionar como la mente de un robot. 

Esta IA se encarga de mantener una conversación con una persona, entender qué está pasando alrededor y decidir, paso a paso, qué tiene que hacer. Este modelo ya está disponible para desarrolladores a través de la API de Gemini y Google AI Studio.

Gemini Robotics ER 2 ve en tiempo real lo que está haciendo y sabe en qué punto de la tarea se encuentra. Si algo sale mal, por ejemplo un objeto se cae o ocurre un movimiento fallido, lo detecta y corrige sin empezar de cero. 

Además, puede coordinar varios robots a la vez: uno se mueve por superficies planas, otro maneja terrenos complicados, y los dos se comunican para terminar juntos lo que ninguno podría hacer solo.

Google lo mostró en acción con Spot, el robot de Boston Dynamics, al que le bastó una instrucción en lenguaje natural para ir a buscar y entregar un objeto.

Gemini Robotics ER 2 ya está disponible para desarrolladores a través de la API de Gemini, Google AI Studio y en versión preliminar privada en Gemini Enterprise Agent Platform.

Esto significa que si eres un desarrollador en robótica, tienes la posibilidad de acceder a este nuevo modelo de inteligencia artificial de forma libre si tienes acceso a las plataformas recién mencionadas.

Por qué esta IA cambia las reglas en robótica

Hasta ahora, los robots tenían un problema básico: no sabían cuándo una tarea estaba realmente terminada. 

Gemini Robotics ER 2 ataca ese problema de dos formas. Por un lado, divide cada tarea en cinco niveles de avance y monitorea en cuál está el robot en cada momento, con un 57% de precisión en las pruebas. 

Por otro, puede identificar el instante exacto en que ocurre algo clave, como el momento justo para dejar de verter café en una taza, con un 91% de precisión y en menos de un segundo.

A eso se suma una capa de seguridad: cuando el robot detecta que una persona se acerca, se detiene solo. Retoma el trabajo únicamente cuando el área queda despejada. 

En las pruebas de seguridad, el modelo superó tanto a su versión anterior como a otros sistemas del mercado.

Qué hace Gemini Robotics ER 2 en un robot

Gemini Robotics ER 2 actúa como el cerebro de alto nivel del robot. Lo que hace, en concreto:

Piensa y planifica

  • Recibe una instrucción en lenguaje natural (“búscame el control remoto”) y la descompone en pasos concretos.
  • Decide qué hacer a continuación mientras el robot ya está ejecutando la acción anterior, sin pausas.

Ve y entiende lo que pasa

  • Analiza el video en tiempo real de la cámara del robot.
  • Sabe en qué punto de la tarea está (dividido en cinco niveles de progreso).
  • Detecta errores en el momento en que ocurren: un objeto que cae, un derrame, un movimiento fallido.

Corrige sin reiniciar

  • Si algo sale mal, ajusta el rumbo sobre la marcha. No necesita empezar la tarea desde cero.

Habla con personas

  • Puede mantener una conversación con un humano y responder preguntas mientras trabaja.
  • También puede consultar Google Search si necesita información externa.

Coordina varios robots a la vez

  • Le dice a cada robot qué parte de la tarea le corresponde según sus capacidades.
  • Los robots se comunican entre sí para completar tareas que uno solo no podría terminar.

Para la seguridad

  • Detecta cuándo una persona se acerca y detiene al robot automáticamente.
  • Lo reanuda solo cuando el área está despejada.

Con información de Infobae