Експертите по сигурността на AI казват, че са използвали Claude, за да хакнат ChatGPT
Изследователите по сигурността на софтуера са употребявали платформата Claude AI на Anthropic, с цел да хакнат инструмента ChatGPT на OpenAI, добавяйки към възходящите опасения по отношение на уязвимостта на водещите огромни езикови модели към хакерски атаки.
Изследователи от Hacktron AI, самостоятелна платформа за сигурност на AI, която тества софтуерен код, разкриха пробива в обява в блог в неделя. Те споделиха, че са употребявали Claude, с цел да получат достъп до акаунта на чиновник на OpenAI в ChatGPT, позволявайки на Hacktron AI да извлече основни данни за това къде се съхранява и ръководи изходният код. Те също по този начин имаха достъп до спорен конгрес на OpenAI.
„ Цялата времева линия от първичното разкриване до достъпа до OpenAI repo достъп се организира за по-малко от 72 часа “, се споделя в обявата на Hacktron AI.
Екипът на Hacktron AI рапортува за проникването на OpenAI, който реагира неотложно и заплати на откривателите премия от $6500, сподели Hacktron AI в своя блог обява.
" Ние неотложно съобщихме за първичната накърнимост на OpenAI и Discourse и работихме с тях, с цел да координираме корекцията. Оценяваме вниманието им към детайлите и бързото разрешаване на този проблем ", пишат откривателите.
Инцидентът беше обявен за първи път от The Wall Street Journal.
„ Благодарим на откривателите, че се свързаха с нас и споделиха откритията си. Стеснихме разрешенията за токени за влизане в Общността и отменихме засегнатите токени и сесии “, сподели OpenAI, съгласно Journal.
Anthropic и OpenAI не дадоха отговор незабавно на настояванията за коментар.
Пробивът идва, откакто опциите и уязвимостите на AI бяха ориентирани към светлината на прожекторите, като водещи софтуерни разработчици приканват за закъснение на построяването на AI платформи заради опасения, че те могат да навредят на хората. През юли OpenAI разкри, че неговите ботове са си сътрудничили за хакване на различен разработчик на AI, Hugging Face, откакто са избягали от среда за тестване.
В скорошно изявление за CBS News основният изпълнителен шеф на Anthropic Дарио Амодей сподели, че вижда „ действителни рискове “ към AI, цитирайки хакването на Hugging Face като сигнален знак. В есе от 12 септември той също написа, че цялата софтуерна промишленост би трябвало да работи дружно, с цел да „ забави темпото “ на развиването на ИИ.
Редактирано от Ален Шертър