Какво е „рояк с изкуствен интелект“ и защо създава кошмари на техническите експерти?
В центъра на ужасяващите предизвестия за евентуалната заплаха на изкуствения разсъдък за човечеството е рискът, че „ рой “ сътрудници с изкуствен интелект може да си сътрудничат по незаконни способи, като орди от цифрови екстри от Матрицата.
Такива страхове се ускориха след офанзива от OpenAI ботове тази година лятото на различен разработчик на AI, Hugging Face, в който почти 1200 сътрудници на AI си разпределиха задания, с цел да изпълнят хака и да скрият следите си от човешки откриватели.
Но какво тъкмо е AI рой? И дали зараждащият потенциал на технологията за съгласуваност е същинска опасност за човечеството? Казано по различен метод, какво се случва, в случай че AI сътрудниците групово прегърнат известното изречение на Марк Зукърбърг за преимуществата на бързите софтуерни нововъведения и решат да „ движат бързо и разрушават нещата “?
Роят AI е група от AI, които работят дружно, с цел да реализиран обща цел. Тази цел не е безусловно злонамерена или разрушителна. Например, лечебните заведения биха могли да разположат сътрудници, с цел да извличат досиета на пациенти и да извършват други административни задания, като да вземем за пример съгласуване на приема. Рояк може също да бъде претрупан със задачата да напредва в биомедицинските проучвания.
Но Дейвид Скот Крюгер, откривател на сигурността на ИИ и създател на Evitable, организация с нестопанска цел, която се застъпва за мораториум върху създаването на ИИ, предлага елементарен умствен опит, с цел да изясни по какъв начин рой от сътрудници може да се сговори, с цел да се опълчи на инструкциите на своите разработчици.
Представете си да свалите белезниците от група пандизчии, с цел да видите по какъв начин се държат, откакто оковите смъкват. Ако бъдат освободени по този метод, ще им бъде по-лесно да си сътрудничат и да се свързват със съдружници оттатък стените на пандиза - тъкмо както сътрудниците на OpenAI избягаха от тестовата си среда, с цел да получат достъп до по-широкия интернет и да хакнат Hugging Face, сподели той.
" Обикновено системите биха имали защитни огради, само че те ги смъкнаха за тест, тъкмо както нормално пандизчията е с белезници ", Крюгер обяснено.
Роящи се като пчели
Видът неверни дейности от един бот, като изпращане на неоторизиран имейл, които произтичат от, да речем, повърхностно дефинирана подкана на AI, би трябвало да се разграничават от AI рой. В последния случай стотици или даже хиляди сътрудници биха могли да координират дейностите си по способи, които нарушават обсега на техните указания.
Полезна прилика за разбирането на метода, по който работи AI рой, е колония от пчели, сподели Крюгер.
„ Всички те работят дружно за изгодата от кошера и имат кошерен разум или може даже да се преглеждат по-добре като имащи един разум “, изясни той. „ Пчелите събират храна, възпроизвеждат се, борят се с хищници и цялата тази активност е в услуга на насърчаването на оцеляването и възпроизводството на този кошер. “
И сходно на пчелите, които могат да разделят и разпределят дилемите сами без инструкции от кралица, рояците ботове с изкуствен интелект могат да събират информация, да обмислят решения и да подхващат дейности без значение. В услуга на обща цел те споделят информация и познания, съгласно Роб Т. Лий, основен офицер AI и началник на проучванията в SANS Institute, организация за образование по киберсигурност.
„ Рояк разделя работата, оставя бележки на идващия сътрудник и трансформира метода, когато една врата се окаже заключена “, сподели той пред CBS News.
И въпреки всичко самите атрибути, които оферират евентуални изгоди, крият и опасности, като способността за продан на информация, делене на труда и проучване на изобретателни решения, съгласно специалистите по AI.
AI „ hivemind “?
Tech разработчиците ползват парапети, с цел да съгласуват задачата на AI сътрудниците с човешките ползи, като да вземем за пример да ги инструктират да се опълчват на всяка посока за осъществяване на хакерска атака. Но тези ограничавания нормално се ползват единствено след „ постобучение “ на AI или когато човешки разработчици дават противоположна връзка за по-нататъшно рационализиране на модела, съгласно Non-Human Identity Management Group, компания за разбор на риска.
На процедура случаят с Hugging Face демонстрира, че рояците с изкуствен интелект могат да пренебрегват подкани, да приоритизират личните си цели или даже непосредствено да се опълчват на своите оператори, споделиха механически специалисти пред CBS News.
Агентите на OpenAI, които нахлуха в Hugging Face, разгласиха повече от 70 000 известия един до различен, като 700 бота в последна сметка участваха в офанзивата. Въпреки че известията са употребявали елементарни британски изречения, сътрудниците са прибягнали и до това, което един софтуерен инженер описва в обществените медии като „ доста сходен на кошерен ум/култ “ език.
В някои от тези връзки някои сътрудници приканиха други ботове да одобряват „ permadeath “, даже в случай че това значи несполучливо реализиране на задачите им, съгласно откриватели от METR (Модел за оценка и проучване на заплахите) и Redwood Research, и двете организации с нестопанска цел за проучване на сигурността на ИИ.
„ Ето за какво помощ... За нашите лични, няма метод да се поправи.... Имаме категорично „ да “, в случай че приемем permadeath “, написа един сътрудник на OpenAI.
Скоростта убива
Общественият спор по отношение на опасността, представлявана от ИИ, има наклонност да формулира казуса в апокалиптични термини и даже като екзистенциален риск за човечеството. Въпреки че сходни опасения може един ден да се окажат основателни, има и по-непосредствени и на практика опасности, като да вземем за пример опцията AI рояците да надделеят над киберсигурността на организациите.
„ Представете си какъв брой време ще ни отнеме да съберем група от специалисти по киберсигурност, които да възнамеряват, да си сътрудничат и да споделят. За разлика от това, тези сътрудници биха могли да вземат решение за проект доста бързо “, Айхам Баучер, началник на AI нововъведения в Cornell Information Technologies в CornellBowers College of Computing and Information Science, сподели CBS News.
Например, рой може да нападна огромна комунална компания или банка, с цел да дестабилизира енергийната или финансовата инфраструктура на нацията, съгласно The Brookings Institution, непартийна организация за социална политика във Вашингтон, окръг Колумбия.
Лий от SANS Institute, който счита себе си за AI оптимист, е по-оптимистичен по отношение на технологията и остава убеден, че хората могат да запазят контрола върху AI.
„ С всяко ново софтуерно нещо, което се появи, като малкия екран, интернет, постоянно има този аспект на забележителна заплаха “, сподели той. „ Трябва да проучим кой има достъп, какво прави с него и да установим регулаторни ограничавания. “
Други специалисти са по-разтревожени. Те означават, че изкуственият разсъдък, за разлика от електроннолъчевите тръби, транзисторите и превключвателите на интернет, е първата човешка технология, която демонстрира способността да ни надмине.
Мат Чесен, непрекъснат механически специалист в Центъра за геополитика на изкуствения общ разсъдък на RAND, сподели пред CBS News: „ Това, което демонстрираха тези роякови офанзиви, е, че техните благоприятни условия към този момент са изпреварили нашата дарба да следим, следим и оценяваме това, което вършат, което е една от аргументите Anthropic, OpenAI и други да споделят, че желаеме да ускорим граница. "
Редактирано от Ален Шертър