Это запрос журналиста на Pressfeed – так редакции ищут экспертов и комментарии для своих материалов.
Троянский конь в браузере: OpenAI признала, что не может остановить взлом ИИ-агентов через скрытые команды
Прием ответов завершенНовость на нашем ресурсе об этом —
https://protraffic.com/news/troyanskij-kon-v-brauzere-openai-priznala-chto-ne-mozhet-ostanovit-vzlom-ii-agentov-cherez-skrytye-komandy-149726.html
Тема следующая:
OpenAI признала, что полностью защитить ИИ-агентов от prompt-инъекций невозможно: скрытые инструкции в письмах и на сайтах остаются долгосрочной угрозой, а не временным багом.
Речь о ChatGPT Atlas — агентном браузере, который может читать почту, документы и выполнять действия за пользователя. Именно агентный режим резко расширяет поверхность атак. Исследователи быстро показали, что поведение Atlas можно менять через скрытые инструкции, как и у решений Google и Perplexity.
Ответ OpenAI — постоянное стресс-тестирование: компания обучила отдельную модель-«атакера», которая ищет уязвимости быстрее реальных злоумышленников. Уже выявлены сценарии, не замеченные ни внутренними тестами, ни аудитами.
Полной защиты не обещают: prompt-инъекции сравнивают с фишингом — их можно сдерживать, но не устранить. Пользователям советуют ограничивать доступ агентов к чувствительным данным, так как агентные браузеры пока остаются мощными, но рискованными инструментами.
Вопрос такой
Есть ли риск, что агентные ИИ повторят путь фишинга — когда защита есть, но жертв всё равно миллионы?
Отвечайте на новые запросы
Прием ответов на этот запрос завершен. Но журналисты публикуют новые запросы каждый день – зарегистрируйтесь, отвечайте и получайте бесплатные упоминания в СМИ.
Зарегистрироваться на PressfeedЭто бесплатно :)