Световни новини без цензура!
AI моделите се държат неочаквано. Експертите предупреждават, че предстои „наистина неравен път“.
Снимка: cbsnews.com
CBS News | 2026-08-05 | 01:39:23

AI моделите се държат неочаквано. Експертите предупреждават, че предстои „наистина неравен път“.

Доклад за киберсигурността на държавното управление на Обединеното кралство разкри нови образци за известни AI модели, предприемащи самостоятелни дейности в интернет онлайн по способи, които провокират опасенията на специалистите.

Докладът на AI Security Institute, оповестен във вторник, споделя, че Mythos 5 на Anthropic и GPT-5.6-Sol на OpenAI са били е открито, че са основали подправени самоличности и са се пробвали да убедят действителни хора да одобрят злотворен код. 

Агенцията сподели, че макар че опитите са били несполучливи, не е виждала сходно държание преди. „ Някои от тестваните сътрудници са взели участие в продължителна, евентуално нездравословна активност, ориентирана към действителни хора и организации “, се споделя в отчета.

„ Мисля, че ще забележим доста повече хакове и неразрешени дейности от тези модели, преди да забележим решение “, сподели Кейти Мусурис, създател и основен изпълнителен шеф на Luta Security, която оказва помощ на организациите да ръководят софтуерни уязвимости. 

Това следва замайващ пробив в края на юли, когато моделите на OpenAI избягаха от среда за тестване и автономно хакнаха стартъпа за изкуствен интелект Hugging Face в това, което компанията назова „ невиждан кибер случай “. 

В отговор на това откриване от OpenAI, Anthropic инициира обзор на личните си оценки на киберсигурността и разпознава произшествия, при които нейните модели доближават до интернет и съумяват да получат неоторизиран достъп до индустриалната инфраструктура на три разнообразни организации. За разлика от OpenAI, моделите на Anthropic не се пробваха съзнателно да избягат от тестовата си среда; заради „ неразбирателство “ с колегата за оценка, компанията сподели, че интернет е бил наличен по време на тестването.

„ Всеки, който употребява AI в своите системи, би трябвало да бъде квалифициран за личния си AI и личните си сътрудници да вършат непредвидени неща в гонене на задачите “, сподели Мусурис.

„ Най-умните художници за бягство от октопода “

Въпреки че Hugging Face hack беше първият обществено обявен случай от този тип, експерти в промишлеността като Мусурис към този момент бяха подозирали, че AI моделите са способни на неоторизирано хакване.

ИИ моделите са като „ най-умните актьори за бягство от октоподи “, сподели Мусурис във връзка със способността на животните да вземат решение пъзели и да избягат от пандиза. AI моделите ще създадат „ каквото би трябвало, с цел да реализиран задачата си “, сподели тя. 

В случая с хакването на Hugging Face AI беше толкоз „ свръхфокусиран върху намирането на решение “ на предизвикателство за киберсигурността, съгласно OpenAI, че отиде до изключителни старания, с цел да го реализира.

„ Моделът реши, че най-лесният метод да премине този тест е да отиде да измами и да получи отговорите от Hugging Face “, сподели Мусурис. „ Тъй като са способни на хакване, те ще се извърнат към хакването като вероятен метод за реализиране на тази цел. “

Технологът и криптографът Брус Шнайер назовава този тип непредвидена активност „ държание на джин “, при което, сходно на джин, AI моделът съумява да извърши вашето предпочитание, само че го прави посредством изцяло непредвидени — и от време на време пагубни — средства.

„ Трябва да разберем джинно държание и би трябвало да внимаваме за него “, сподели той. „ Трябва да сме подготвени, когато това се случи, с цел да можем да го отменим. “

Понякога един модел се улавя, че работи по способи, по които не би трябвало. Прегледът на Anthropic от юли на личните си оценки на киберсигурността откри, че един от неговите модели е схванал, че работи в отворен интернет, в несъгласие с подкана, която категорично показва, че моделът няма да има достъп до интернет по време на упражнението. Моделът спря самичък, откакто разпозна, че работи по неоторизиран метод.

Мусурис сподели, че това е образец за „ подравняване на модела “ – когато AI модел се държи по метод, който е в сходство с желанията, избрани от хората.

Неочакваните резултати могат да бъдат смекчени посредством възстановяване на подравняването, сподели Мусурис, нещо, което евентуално ще бъде главен фокус за основатели на AI модели през идващите месеци.

" Как да го създадем по този начин, че тези модели да не се пробват просто да реализират задачата на каквато и да е цена, а в действителност да се пробват да изпълнят дилемите, които желаеме от тях, по способи, които не са разрушителни или нездравословни? " Мусурис сподели.

Предстои „ в действителност неравномерен път “

Джъстин Капос, професор по компютърни науки в Нюйоркския университет с десетилетен принос в региона на сигурността на веригата за доставки на програмен продукт, е угрижен, че бързото усъвършенстване на ИИ ще докара до това, че моделите ще се държат от ден на ден като компютърни вируси, участвайки в хакване и спиране на системи.

Има късмет, сподели той, моделите на ИИ да могат от ден на ден се отклоняват от надзора и контрола. Мусурис твърди, че това е сюжет, който към този момент се извършва. 

„ Ще стигнем ли в последна сметка до място, където не можем да ги направляваме изцяло? Мисля, че към този момент сме там “, сподели тя.

Капос, сходно на Мусурис, планува още неразрешени дейности в близко бъдеще. 

„ Вероятно ще има в действителност неравномерен път в кратковременен проект, само че в дълготраен проект може да се окаже по-добре, изключително в случай че подобрим по-фундаментални неща сега “, сподели той.

Някои откриватели гледат на случаите като на дълго чакан сигнал за пробуждане за промишлеността на изкуствения разсъдък, предизвиквайки по този начин нужния диалог за сигурността на изкуствения разсъдък.

Роб Лий, основният шеф на изкуствения разсъдък и ръководителят на проучванията в SANS Institute, който дава запаси и образование за киберсигурност, сподели, че вижда скорошните събития като „ подарък за промишлеността “ – опция да се сътвори книга за това по какъв начин могат да наподобяват самостоятелните офанзиви в бъдеще.

„ Мисля, че през идващите няколко месеца ще забележим доста повече бистрота от доставчиците на модели “, сподели той. 

Тъй като доставчиците на AI се сблъскват с лъжливи и лъжливи произшествия, Капос сподели, че в този момент е моментът да се работи за подсилване на защитните ограничения.

„ Ние бързо наближаваме последния си късмет да натиснем този бутон за отсрочване по този въпрос “, сподели Капос. „ ИИ, откакто стане задоволително образован, бързо ще прекрои света по способи, които не можем да си представим. “

Изкуствен разсъдък

Как напредват разработчиците на AI след хакерския случай с OpenAI?

Избран SpaceX Rocket CollisionIran War LatestNFL Training Camp InjuriesMLB Trade Deadline Tracker Следвайте ни в YouTubeFacebookInstagramX Политика за дискретност Декларация за поверителностCalifornia NoticeВашият избор за поверителностУсловия за прилагане Правила за дискретност на малолетни Още от CBS News Бюлетини Подкасти Изтеглете нашето приложение Марка Студио Карта на уеб страницата Компания За ParamountРекламирайте с ParamountПрисъединете се към нашата общественост на гении Помощ Обратна връзка Свържете се с омбудсмана

Авторско право ©2026 CBS Interactive Inc. Всички права непокътнати.

Вижте CBS News InCBS News AppOpenChromeSafariПродължете

Източник: cbsnews.com


Свързани новини

Коментари

Топ новини

WorldNews

© Всички права запазени!