Gemini Robotics-ER 1.6 embodied reasoning: razonamiento IA para robots
Google DeepMind ha presentado Gemini Robotics-ER 1.6, una actualización profunda del embodied reasoning que busca transformar los entornos industriales. A diferencia de los enfoques tradicionales basados únicamente en el procesamiento secuencial de comandos, este modelo integra capacidades avanzadas de lógica espacial y razonamiento multivista. Esto permite a los sistemas robóticos sintetizar de forma nativa los flujos de múltiples cámaras, logrando una percepción coherente de su espacio físico incluso frente a cambios dinámicos en el entorno o condiciones de iluminación desfavorables, etc.
El núcleo técnico del modelo destaca por optimizar tareas críticas de precisión como la capacidad de señalamiento (pointing) para el mapeo de trayectorias, la identificación de puntos de agarre (grasp points) idóneos y el filtrado de falsos positivos en la detección de componentes. Además, Gemini Robotics-ER 1.6 introduce el concepto de "visión agéntica" (agentic vision), el cual combina el análisis visual con la ejecución automatizada de código para interactuar con herramientas externas e interpretar instrumentación analógica y digital compleja, actuando como ¨una calculadora geométrica de precisión.
Ya se encuentra disponible para integradores y desarrolladores a través de la API de Gemini y Google AI Studio, abriendo nuevas posibilidades en el desarrollo de soluciones de automatización y diseño OEM de próxima generación.
Para más información: https://deepmind.google/blog/gemini-robotics-er-1-6/
Fuente imagen: Logo.dev