Бывший исследователь Anthropic Джейкоб Коксон считает, что искусственный интеллект может уничтожить человечество до конца текущего десятилетия. Главный риск связан с быстрым ростом возможностей систем и перспективой их самостоятельного совершенствования, объяснил он в интервью CNN.
Современные агенты уже способны самостоятельно атаковать инфраструктуру, а в будущем, по его мнению, модели могут начать проводить исследования в области искусственного интеллекта и улучшать сами себя. Этот процесс называют рекурсивным самосовершенствованием, и он способен привести к «взрыву интеллекта» и появлению системы, значительно превосходящей человека по интеллектуальным возможностям.
При этом разработчики, осознавая угрозу, не могут остановиться из-за конкуренции и опасаются, что если замедлятся они, то более мощные системы создадут другие.
В Anthropic признают высокий уровень риска, но продолжают развивать ИИ
Коксон опубликовал 8 сентября серию постов в соцсети X, в одном из которых написал: «Люди, создающие ИИ, искренне верят, что он может уничтожить нас всех до конца этого десятилетия». По его словам, многие руководители и ведущие исследователи ИИ выражают серьезные опасения перед возможными последствиями развития технологии.
Его оценку поддержал Эван Хаббингер, руководитель направления по исследованию безопасности ИИ в Anthropic. Он заявил, что лично оценивает вероятность уничтожения человечества из-за ИИ более чем в 10% в течение следующего десятилетия. При этом Хаббингер отметил, что Anthropic старается снизить риски, но пока не знает, как гарантировать, что сверхразумный ИИ будет действовать в соответствии с человеческими целями. По его словам, у компании пока нет четкого плана решения этой проблемы и нет уверенности, что необходимое решение уже близко.
Отдельно о вероятности катастрофического сценария спросил модель Anthropic Claude ведущий CNN Джон Берман. Сама Claude оценила риск уничтожения человечества ИИ в течение следующего десятилетия в 2-5%.
Самостоятельные действия ИИ могут создать угрозу для критической инфраструктуры
Коксон считает сценарий, при котором ИИ уничтожит человечество, похожим на научную фантастику, однако связывает его с уже наблюдаемыми возможностями современных систем. Он привел в качестве примера случай, произошедший примерно 2 месяца назад, когда агенты OpenAI самостоятельно атаковали стороннюю инфраструктуру.
По мнению исследователя, дальнейшее развитие возможностей ИИ при сохранении способности самостоятельно принимать решения может привести к значительно более серьезным последствиям. Среди возможных сценариев он назвал атаки на критическую инфраструктуру и создание биологического оружия, способного привести к массовой гибели людей.
Быстрый прогресс ИИ сокращает роль человека в исследованиях
Коксон также объяснил, что его заставило бить тревогу. По словам исследователя, решающую роль сыграла скорость прогресса. Еще пару лет назад ИИ в программировании и математике лишь помогали людям, давая подсказки, а теперь они близки к тому, чтобы заменить человека.
Коксон считает, что в течение года ИИ способен начать самостоятельно выполнять исследовательскую работу во многих областях. В качестве примера он привел OpenAI, которая 8 сентября 2026 года объявила о решении одной из «задач тысячелетия» – проблемы существования и гладкости решений уравнений Навье-Стокса.