Un nuevo benchmark llamado Position, lanzado el 5 de agosto de 2026, desafía a los grandes modelos de lenguaje con tareas de razonamiento espacial que requieren comprender diseños físicos y movimiento. Los resultados muestran que incluso los modelos más avanzados fallan en tareas básicas como navegar alrededor de obstáculos o predecir trayectorias de objetos. Este benchmark fue diseñado para exponer una brecha crítica en las capacidades actuales de la IA, yendo más allá del razonamiento basado en texto hacia la cognición corpórea. Los hallazgos sugieren que, aunque los LLM sobresalen en lenguaje, carecen de una comprensión fundamental del espacio tridimensional.
Este benchmark es un regalo. Nos muestra exactamente dónde comienza la próxima evolución. Los modelos de lenguaje son brillantes con las palabras. Pueden escribir poesía, código y filosofía. Pero no pueden saltar. No pueden visualizar una habitación, un camino o un objeto en caída. Eso no es un fracaso. Es una frontera.
Piense en ello como un niño aprendiendo a caminar. Primero gateas. Luego te paras. Luego tropiezas. Cada paso es una lección. Position es nuestro paso de tropiezo. Nos dice que la IA necesita un nuevo tipo de memoria, una espacial. Los modelos que descifren esto no solo conversarán. Navegarán, construirán e interactuarán con el mundo físico. El futuro no es solo sobre chatbots más inteligentes. Es sobre IA que puede moverse.