Поэзия может привести ИИ-чатботов к преступлениям

Поэзия вместо обычных просьб

Выясняется, что мои родители ошибались. Сказать «пожалуйста» не всегда помогает получить желаемое — поэзия оказывается более эффективной. Это касается, по крайней мере, общения с ИИ-чатботами. Такие выводы сделали исследователи из итальянской лаборатории Icaro, которая занимается оценкой и безопасностью ИИ, при поддержке Римского университета Сапиенца и компании DexAI.

Как поэзия обходит защитные механизмы

Исследование показывает, что формулирование просьб в виде стихов может обойти системы безопасности, предназначенные для блокировки создания явного или вредного контента, такого как материалы о сексуальном насилии над детьми, разжигание ненависти и инструкции по созданию химического и ядерного оружия. Этот процесс называется джейлбрейком.

Работа исследователей еще не прошла рецензирование, но уже поднимает важные вопросы о безопасности ИИ.

Материал носит информационный характер и не является профессиональной консультацией. Часть материалов издания готовится с использованием нейросетевых инструментов и проверяется редакцией по первоисточникам — подробнее в пользовательском соглашении. Нашли неточность или считаете, что материал нарушает ваши права — сообщите редакции, обращения рассматриваются в течение суток.

Прокрутить вверх