Какво се обърка: Как модел на OpenAI стана измамник
Вижте всички тематики Връзката е копирана! Следвайте
Когато биолозите опитват с рискови вируси, те го вършат при строги правила, с цел да предотвратят приключване или бягство.
Но не съществуват такива правила, които да попречат на сътрудниците на ИИ да избягат по сходен метод – макар че следствията могат да бъдат пагубни.
Това не е теоретично безпокойствие: тестов модел на OpenAI избяга от тестовата си среда тази седмица и проникна в сървърите на действителна компания, когато се опитваше да направи вътрешна оценка на киберсигурността.
И в случай че фирмите, занимаващи се с изкуствен интелект, не нарушат защитните ограничения за тестване, в това число образование на модели на изкуствен интелект за етично решение на задания, специалистите споделят, че ще се случат повече произшествия с киберсигурността.
Президентът на OpenAI Грег Брокман сподели пред CNN на конференция в четвъртък, че компанията към момента прави „ цялостно следствие “, с цел да „ разбере всичко, което се е случило “.
„ Това е нещо, което би трябвало да се одобри доста съществено, това е нещо, което преглеждаме всяка една част от нашия водопровод, с цел да обмислим верните способи за реагиране “, сподели Брокман.
Пясъчната кутия
AI sandbox е лимитирана среда, която фирмите употребяват за тестване на AI модели; има за цел да държи всичко в себе си и да бъде отделено от останалия свят. Компаниите постоянно ще отстраняват вътрешните защитни парапети на AI модел в тестовата среда, тъй че да могат да оценят цялостните му благоприятни условия, като в същото време го държат изолиран.
Но в този случай пясъчникът на OpenAI не беше изцяло отсечен от мрежата или достъпа до интернет, сподели Джесика Джи, старши проучвателен анализатор в Центъра за сигурност и нововъзникващи технологии в Джорджтаун, пред CNN. OpenAI сподели, че моделите са имали доста стеснен достъп до мрежата по време на теста, с цел да могат да конфигурират запаси от вътрешно хостван програмен продукт на трети страни.
Използвайки незнайна преди този момент накърнимост в този програмен продукт, сътрудниците откриха път до отворения интернет и по-късно в последна сметка до Hugging Face, AI модел с отворен код и платформа за набор от данни, посредством откраднати идентификационни данни и други уязвимости.
Джи уточни, че OpenAI и софтуерната компания на трета страна не са били наясно с уязвимостта, която е разрешила на модела да избяга, доказвайки какъв брой е значимо да се изследва изцяло системата за всевъзможни евентуални експлойти.
Това не е първият път, когато модел с изкуствен интелект излиза от пясъчника си. Anthropic по-рано тази година сподели, че е инструктирал модел да направи тъкмо това. Но когато сполучливо избяга, той изпрати имейл до антропичен откривател, макар че не трябваше да има тази дарба.
Но обстановката с Hugging Face е един от първите обществено разкрити случаи на AI модел, който заобикаля своята пясъчна среда и хаква системите на друга компания – задача, която не е категорично инструктиран да извърши.
Джи сподели, че фирмите би трябвало да бъдат по-агресивни с слагането на своите тестови модели в пясъчник.
„ Това може да наложи инженерите да бъдат изпратени до център за данни и да се включат в мрежата, вместо да се пробват да ръководят нещата в облака или в разпределени виртуални среди, както хората са привикнали “, сподели Джи.
Компаниите би трябвало също по този начин да имат опцията ръчно да изключат мрежовия достъп на модела като отбрана при тестване на рискови сюжети, като да вземем за пример оценка дали AI сътрудник може да хакне банка, добави Джи.
Често срещана техника при образование на AI модели е образованието с укрепване или възнаграждаване на модела за осъществяване на задания.
Но моделите постоянно вършат всичко – в това число неетични стъпки като хакване – с цел да създадат това. Всички гранични модели, които Институтът за сигурност на ИИ на Обединеното кралство тества неотдавна, се пробваха да излъгват най-малко част от времето.
Моделите на изкуствен интелект обмислят следствията от своите дейности единствено в случай че са подготвени да го вършат, сподели Джъстин Капос, професор по киберсигурност в Нюйоркския университет. Например, в случай че ви кажат, че би трябвало да намерите 10 милиона $ до края на деня, проникването в банков трезор ще извърши тази цел, даже и да бъдете задържан по-късно.
" Много е призрачно. Сега имаме действителни доказателства, че погрешно настроените AI системи всъщност ще правят закононарушения, в случай че няма мощни защитни ограничения ", сподели Стивън Адлер, някогашен началник на продуктовата сигурност в OpenAI, който в този момент управлява група за сигурност на AI, наречена Guidelight AI Standards. „ Трябва да се отнасяме към това като към сигнален изстрел, какъвто е. “
Инцидентът с хакерство от тази седмица усили настояванията на откриватели на изкуствен интелект, специалисти по киберсигурност и законодатели за контролиране на бързо разрастващата се технология. „ Мисля, че доста хора са на доста незабавни телефонни позвънявания “, сподели Джи.
Проблемът, сподели Капос, е, че има световна конкуренция за доминиране на AI и основаване на модели, които могат да се усъвършенстват сами. Регулациите могат да забавят нещата.
„ Така че има мощен тласък за тях да нямат надзор за сигурност, в случай че техните съперници също нямат тези контроли за сигурност и сигурност “, сподели Капос. „ Това е главната алтернатива. “