Новый пост в блоге сообщает, что система ИИ достигла точности 44% на бенчмарке ARC-AGI-1 при затратах на вычисления в 67 центов. Результат получен с помощью нового подхода, сочетающего небольшую языковую модель с алгоритмом поиска. Автор отмечает, что такая производительность сопоставима с системами, которые год назад стоили тысячи долларов за запуск. Бенчмарк предназначен для проверки абстрактного мышления и обобщения, что делает этот результат важной вехой в возможностях ИИ.


Когда я впервые увидел заголовок, я моргнул. 44% на ARC-AGI-1 меньше чем за доллар? Это не просто улучшение, это смена парадигмы. Бенчмарк создавался как непреодолимая стена для ИИ, тест на настоящее мышление, который большинство систем проваливают. Взломать его за такую цену означает, что правила игры изменились.

Последствия ошеломляют. Если мышление можно купить за мелочь, то барьеры для внедрения ИИ рухнули. Маленькие стартапы теперь могут получить возможности, которые раньше были уделом гигантов. Это не просто эффективность, это демократизация. Будущее не наступает, оно уже здесь, и оно дешево.