Исследователи взломали ИИ-роботов задав им вредоносные инструкции
Ученые из Университета Пенсильвании выявили новые уязвимости в ИИ-роботах (управляемых LLM), которые позволяют с легкостью проводить джейлбрейки.
Команда разработала алгоритм RoboPAIR, который позволяет атаковать одну LLM с помощью другой, обходя защитные фильтры — аналогично джейлбрейку ИИ-чатботов.
Они успешно протестировали эту технологию на роботах от Nvidia и Unitree Robotics, достигая 100% успеха.
Такой взлом может превратить беспечные устройства в опасные, способные выполнять разрушительные команды.
В отчете приводятся примеры взломанных роботов-собак, которые могли бы относить бомбы в самые разрушительные места или беспилотные автомобили, намеренно сбивавшие пешеходов.
================
@black_triangle_tg
Ученые из Университета Пенсильвании выявили новые уязвимости в ИИ-роботах (управляемых LLM), которые позволяют с легкостью проводить джейлбрейки.
Они успешно протестировали эту технологию на роботах от Nvidia и Unitree Robotics, достигая 100% успеха.
В отчете приводятся примеры взломанных роботов-собак, которые могли бы относить бомбы в самые разрушительные места или беспилотные автомобили, намеренно сбивавшие пешеходов.
================