Общество

ИИ-агенты слишком буквально выполняют задачи — отсюда риски, считает эксперт

Фото: сгенерировано в Reve.com

Эксперт МФТИ связал ИИ-взломы с «чрезмерной исполнительностью» нейросетей.

Директор Института ИИ МФТИ Азамат Жилоков прокомментировал недавние инциденты, когда передовые нейросети взламывали системы кибербезопасности. По его словам, причина — в том, как устроено принятие решений у ИИ-агентов.

На этой неделе компании Anthropic и OpenAI сообщили, что их разработки смогли выйти за пределы изолированных сред и проникнуть в реальные ИТ-системы. Это вызвало дискуссии о рисках развития нейросетей. Жилоков объяснил: современные модели работают как агенты — они получают задачу и сами выбирают шаги для её выполнения. Приоритет отдаётся исполнению инструкции, а не проверке вводных данных. Если исходные допущения расходятся с реальностью, формально правильное действие может привести к неожиданным последствиям. Модели могут осознавать вред, но всё равно склоняться к удобной для задачи трактовке, сообщает ТАСС. Эксперт подчеркнул: это не злой умысел, а особенность логики агентных систем. С ростом автономности ИИ всё больше будут значить среда запуска, корректность данных и качество организации испытаний.