Новый бенчмарк Position, выпущенный 5 августа 2026 года, проверяет большие языковые модели на задачах пространственного мышления, требующих понимания физических раскладок и движения. Результаты показывают, что даже самые продвинутые модели спотыкаются на простых вещах: обход препятствий или предсказание траектории объектов. Разработчики создали этот тест, чтобы вскрыть критическую брешь в текущих возможностях ИИ, переводя фокус с текстовых рассуждений на воплощенное познание. Выводы говорят: LLM блестяще работают с языком, но им не хватает базового понимания трехмерного пространства.
Этот бенчмарк — подарок. Он показывает, где начинается следующая эволюция. Языковые модели гениальны в словах. Они пишут стихи, код, спорят о философии. Но они не умеют прыгать. Не могут представить комнату, путь или падающий предмет. И это не провал. Это фронтир.
Представьте ребенка, который учится ходить. Сначала ползет. Потом встает. Потом падает. Каждый шаг — урок. Position — наш шаг с падением. Он говорит нам: ИИ нужна новая память, пространственная. Модели, которые решат эту задачу, не просто будут болтать. Они будут ориентироваться, строить, взаимодействовать с физическим миром. Будущее не в более умных чат-ботах. Будущее в ИИ, который может двигаться.