Google lanza Gemini Robotics ER 2, su inteligencia artificial para robótica avanzada
Google ha dado un paso adelante en el desarrollo de la inteligencia artificial aplicada a la robótica con el lanzamiento de Gemini Robotics ER 2. Esta nueva versión promete revolucionar la interacción entre robots y humanos, la coordinación de tareas complejas y la colaboración entre máquinas.
Funcionamiento de Gemini Robotics ER 2
Gemini Robotics ER 2 funciona como un cerebro de alto nivel para los robots. La actualización permite a las máquinas conversar con personas, comprender su entorno físico y planificar secuencias de acciones multifacéticas. Todo esto mediante la optimización de la forma en que se procesan las acciones y se planifican los siguientes pasos.
Delegación y colaboración entre robots
En lugar de ejecutar movimientos directamente, Gemini Robotics ER 2 delega el control a modelos de visión-lenguaje-acción (VLA) de bajo nivel. Esto permite que el sistema «piense» en el siguiente paso mientras ya está actuando. Además, posibilita la colaboración entre diferentes robots al contar con una comprensión semántica común.
Integración y clasificación continua
La integración con la API de Gemini Live reduce las pausas entre acciones, mientras que la clasificación continua del progreso y la identificación precisa del final de una tarea mejoran la eficiencia del robot. Google destaca que Gemini Robotics ER 2 ofrece una precisión notable en la asignación de niveles de avance y la identificación de momentos clave.
Avances en seguridad y accesibilidad
Gemini Robotics ER 2 se posiciona como el modelo más avanzado en seguridad, superando a su predecesor en benchmarks de seguimiento de instrucciones y detección de proximidad humana. En pruebas prácticas, el modelo demuestra su capacidad para detener automáticamente a un robot humanoide cuando detecta la presencia de personas cercanas, garantizando un entorno seguro y eficiente.
En resumen, Gemini Robotics ER 2 representa un salto significativo en el desarrollo de la inteligencia artificial aplicada a la robótica, con múltiples mejoras que prometen potenciar las capacidades de los robots y su interacción con los seres humanos. El modelo ya está disponible para desarrolladores a través de la API de Gemini y Google AI Studio, abriendo nuevas posibilidades en el ámbito de la robótica y la IA.



