La última semana de julio dejó dos movimientos que marcan el rumbo de la industria: Google DeepMind presentó Gemini Robotics 2, orientado a dotar a los robots de "inteligencia corporal completa", y OpenAI abrió públicamente GPT-5.6 como una familia de modelos de tres niveles.

De la pantalla al mundo físico

Gemini Robotics 2 y su variante de razonamiento espacial buscan que un robot no solo identifique objetos, sino que planifique y ejecute secuencias completas de movimiento en entornos reales y cambiantes. Es el paso natural de los modelos multimodales: pasar de describir el mundo a actuar sobre él.

GPT-5.6: escala y costo

Por su parte, la nueva familia de OpenAI se estructura en tres niveles con distintos balances entre capacidad, latencia y costo, un movimiento que responde a la principal demanda del mercado empresarial: desplegar IA a escala sin que la factura se dispare.

Qué significa para América Latina

Para la región, el efecto inmediato no está en los robots, sino en la caída del costo por consulta: automatización de atención al cliente, análisis documental, traducción y desarrollo de software se abaratan. El reto sigue siendo la infraestructura, el talento y una regulación que aún no define reglas claras sobre datos y responsabilidad.

Más cobertura tecnológica en Inteligencia Artificial.