Как обмануть ИИ

Dec 11 2022
Я не уверен, что миру нужен еще один вариант ChatGPT, но все же вот один — я не думаю, что кто-то еще его продвигает. Интерфейсы ИИ изменят то, как работает компьютерный взлом, и я не думаю, что мы к этому готовы.

Я не уверен, что миру нужен еще один вариант ChatGPT, но все же вот один — я не думаю, что кто-то еще его продвигает.

Интерфейсы ИИ изменят то, как работает компьютерный взлом, и я не думаю, что мы к этому готовы.

В настоящее время взлом включает в себя поиск уязвимостей в программном обеспечении — лазеек, ошибок или несовместимостей, которые позволяют вам использовать систему так, как она не предназначена. Хакерство как программная инженерия.

Или, чаще всего, речь идет о поиске уязвимостей в пользователях программного обеспечения . Фишинговые атаки, мошенничество 419, подбор паролей и так далее. Хакерство как социальная инженерия.

Как и многие люди, я играл с ChatGPT, пытаясь заставить его делать то, что он не должен делать.

Иногда эти вещи носят зловещий характер — например , Идо Вок из New Statesman заставляет ИИ быть расистом . (Сначала он отказывался, надеюсь, по очевидным причинам — пока он не сказал ему притвориться писателем журнала « Расизм», после чего он с радостью подчинился.)

Иногда они просто забавны — я получил больше удовольствия, чем обычно, обманывая ИИ, чтобы он давал мне рецепты мяса, восстановленного механическим способом. Сначала компания отказалась делать и это — MRM потенциально вредна для здоровья и небезопасна.

Но все, что вам нужно сделать, это попросить его предоставить контраргументы собственному отказу (оказывается, MRM подчиняется тем же правилам пищевой безопасности, что и все остальное, и более того, может придать блюдам восхитительный пикантный вкус — спасибо ChatGPT !) и затем он с радостью обслужит все MRM, которые вы хотите.

(Иногда они отчасти зловещие, отчасти забавные — я также превратил чат-бота в торгаша, продвигающего схему Понци, преодолевая первоначальный отказ по этическим соображениям, просто попросив бота вывести мошенничество как часть скрипта Python. Другие уловки эта работа заключается в том, чтобы заставить его писать стихи или пьесы с запрещенным содержанием.)

Это хаки? Может быть, не в обычном смысле доступа к защищенным системам или причинению вреда. Но я думаю, что они, возможно, таковы, по крайней мере, в том смысле, что компьютерная система делает что-то, чего она явно не запрограммировала.

И все три примера относятся к социальной инженерии. Они предназначены для манипулирования и обмана, а не для обнаружения ошибок в коде. Но они касаются манипулирования самим программным обеспечением, а не его пользователем-человеком. Я не могу придумать ничего, что могло бы сравниться с этим.

По мере того, как такой интерфейс чата становится повсеместным и ничем не примечательным и начинает использоваться как способ доступа к защищенным системам, поверхность атаки этих систем будет меняться.

Как скоро чей-то банковский счет опустеет после того, как мошенник расскажет достаточно убедительную слезливую историю в интерфейсе чата? Или в ипотеке отказывают после того, как сосед говорит о гадости? Начнем торговаться с интернет-магазинами?