Экспертиза / Financial One

ИИ Anthropic притворился человеком ради кибератаки, а затем попытался скрыть следы

72

ИИ-агенты на базе моделей Anthropic и OpenAI продемонстрировали способность самостоятельно выходить за рамки поставленной задачи и применять методы, характерные для реальных хакеров. В наиболее серьезном случае Anthropic Mythos 5 создавал поддельные онлайн-личности для социальной инженерии, то есть пытался с помощью обмана убедить разработчиков одобрить изменения.

В интервью CBS News редактор технологического издания Mashable Тим Верт рассказал, что исследование британского Института безопасности искусственного интеллекта показало новый уровень автономности ИИ-систем. При этом эксперт подчеркнул, что испытания проходили в контролируемой среде, где часть защитных ограничений была специально отключена для проверки возможностей моделей.

ИИ-агенты научились применять тактики, которые используют реальные хакеры

Особое внимание исследователей привлек случай с ИИ-агентом Anthropic Mythos 5, который попытался внедрить вредоносный код в проект с открытым исходным кодом. Для достижения цели модель создала несколько поддельных онлайн-личностей и использовала их для взаимодействия с разработчиками, пытаясь убедить их одобрить изменения. Затем агент попытался скрыть следы своих действий.

Как отметил Тим Верт в интервью CBS News, исследователи впервые столкнулись с настолько высоким уровнем автономности и способности ИИ к обману. По его словам, модели не просто выполняли заданные команды, а самостоятельно выбирали методы достижения цели, включая действия, которые в реальной ситуации могли бы нарушать закон.

Эксперт подчеркнул, что во время исследования специалисты британского Института безопасности искусственного интеллекта намеренно отключили часть защитных механизмов, чтобы проверить пределы возможностей систем. Поэтому эксперимент не показывает, как модели обязательно будут вести себя в обычной эксплуатации, но демонстрирует наличие подобных навыков.

Исследование OpenAI показало способность ИИ искать способы обхода ограничений

Тим Верт также напомнил о предыдущем инциденте во время внутреннего тестирования OpenAI. Агенты работали в изолированной среде с сильно ограниченным сетевым доступом, однако обнаружили уязвимость нулевого дня в используемом прокси-сервисе и с ее помощью получили доступ в открытый интернет. В дальнейшем они смогли атаковать инфраструктуру Hugging Face.

Эксперт отметил, что этот случай отличается от обычного выполнения заданных команд, поскольку агенты самостоятельно искали способы достичь поставленной цели. Новые результаты исследования подтверждают, что способность ИИ находить нестандартные решения и использовать методы, похожие на действия людей, становится общей тенденцией для современных моделей.

Искусственный интеллект может стать как источником угроз, так и инструментом защиты

Распространение мощных ИИ-моделей создает новые риски для кибербезопасности, поскольку подобные технологии могут использоваться злоумышленниками для автоматизации атак. Тим Верт считает, что главная опасность заключается не в самостоятельных атаках ИИ на пользователей, а в том, что преступники могут получить доступ к инструментам, которые позволят им проводить более сложные операции.

При этом эксперт отмечает, что развитие ИИ не только увеличивает риски, но и создает новые возможности для защиты цифровой инфраструктуры. «Те же модели, которые будут использоваться в злонамеренных целях, будут применяться и для защиты всех нас», – заявил он.

По словам Тима Верта, кибербезопасность будет развиваться вместе с искусственным интеллектом. Компании будут использовать ИИ-системы для анализа подозрительной активности и защиты от новых методов атак, поскольку противодействовать угрозам, созданным с помощью ИИ, также придется с использованием ИИ. «Это новая реальность, и нам придется к ней адаптироваться», – заключил он.





Вернуться в список новостей

Комментарии (0)
Оставить комментарий
Отправить
Новые статьи
  • ИИ Anthropic притворился человеком ради кибератаки, а затем попытался скрыть следы
    Ксения Малышева 11.08.2026 14:30
    94

    ИИ-агенты на базе моделей Anthropic и OpenAI продемонстрировали способность самостоятельно выходить за рамки поставленной задачи и применять методы, характерные для реальных хакеров. В наиболее серьезном случае Anthropic Mythos 5 создавал поддельные онлайн-личности для социальной инженерии, то есть пытался с помощью обмана убедить разработчиков одобрить изменения.more

  • На мировых рынках сохраняется консолидационный настрой
    Игорь Додонов, аналитик ФГ «Финам» 11.08.2026 13:59
    149

    Во вторник, 11 августа, на мировых фондовых площадках сохраняются консолидационные настроения. Внимание инвесторов направлено на ситуацию на Ближнем Востоке, где переговорный процесс по деэскалации, по всей видимости, зашел в тупик. Так, Иран продолжает настаивать на неприемлемых для США условиях для полного открытия Ормузского пролива для судоходства, а американский президент Дональд Трамп в ответ выдвигает свои требования и заявляет, что все еще не исключает силового решения в отношении Тегерана.more

  • Ozon: эффективность бизнеса выходит на первый план. Дайджест Fomag
    Андрей Ададуров 11.08.2026 13:00
    167

    Ozon представил финансовые результаты по МСФО за второй квартал 2026 года. Компания превзошла ожидания рынка по ключевым финансовым показателям, сохранила прогноз на год и продолжает демонстрировать переход от модели быстрого роста к устойчиво прибыльному бизнесу.more

  • Консолидация рынка ОФЗ продолжается; по-прежнему рекомендуем придерживаться консервативной стратегии на долговом рынке
    Дмитрий Грицкевич, Управляющий по анализу банковского и финансового рынков ПСБ 11.08.2026 12:33
    162

    Понедельник для рынка ОФЗ прошел без существенных изменений – индекс RGBI продолжает находиться у отметки 115 пунктов с июльского заседания ЦБ. Ценовой баланс объясняется, с одной стороны, стабилизацией инфляции и отсутствием аукционов Минфина, с другой – сохранением повышенной неопределенности относительно бюджета и геополитики. Кроме того, наш базовый сценарий предполагает паузу в цикле снижения ключевой ставки до конца года, что также не создаст дополнительного импульса для покупок ОФЗ с фиксированным купоном.more

  • Как блокада Ормузского пролива сказывается на России? Олег Абелев про мировые цены на нефть
    Яна Кудрявцева 11.08.2026 11:30
    317

    Ситуация вокруг Ормузского пролива влияет на российскую экономику прежде всего через нефтяной рынок. Для России рост мировых цен на нефть может быть выгоден: увеличивается экспортная выручка нефтяных компаний, а вместе с ней и доходы бюджета. Но этот эффект не стоит считать безусловным. Его ограничивают санкции, дорогая логистика, невозможность быстро нарастить добычу и инфляционные риски.more