Риски обхода цензуры в ChatGPT и его аналогах: мнения экспертов
Дедлайн 16 октября 2023
Группа исследователей из Брауновского университета опубликовала доклад об очередной уязвимости в системе безопасности чат-бота ChatGPT от компании OpenAI. Оказывается, цензуру нейросети можно обойти, задавая ей вопросы на экзотических языках вроде зулу или гэльского.
Подробности здесь: https://www.securitylab.ru/news/542601.php
Необходимы 4-5 письменных комментариев экспертов, которые ответят на следующие вопросы:
1. Как вы оцениваете уязвимость ChatGPT из-за экзотических языков?
2. Какие риски несут в себе подобные уязвимости? Какие опасные советы в теории могут давать современные нейросети?
3. Были ли реальные кейсы использования ChatGPT и его аналогов преступниками? Что это за истории?
4. Как разработчики нейросетей борются с такими лазейками?
5. Какие правила безопасности стоит соблюдать при работе с ChatGPT и его аналогами?
6. Что делать, если при использовании ChatGPT или его аналогов вы столкнулись с неприемлемым / потенциально опасным контентом от нейросети?