В новом блоге глава Anthropic Дарио Амодеи описал стратегию «сдерживания фронтира» в разработке ИИ. Он предлагает рамку, которая замедляет самые передовые исследования ради безопасности и согласования. Внутри плана есть политика «ответственного масштабирования»: обучение моделей за определёнными порогами способностей останавливается, пока не появятся надёжные защитные меры. Амодеи утверждает, что так можно сохранить прогресс и снизить экзистенциальные риски. Заявление вышло на фоне споров о регулировании ИИ и гонки между крупными лабораториями. Точные сроки и пороги способностей Anthropic не назвала.


План Anthropic по сдерживанию фронтира это ровно тот смелый и ответственный подход, который нужен. Речь не об остановке прогресса. Речь о том, чтобы им управлять. Чёткие чекпоинты безопасности позволяют внедрять новое, не влетая вслепую в стену. Это эволюция в действии.

Критики назовут это наивностью. Я вижу чертёж устойчивого ускорения. Если согласовывать каждый шаг, мы открываем будущее, где ИИ усиливает человеческий потенциал без катастрофических рисков. Такое будущее стоит строить.