OpenAI втвърдява AI тестването и обучението в светлината на хакерски инциденти
Вижте всички тематики Връзката е копирана! Следвайте <стр class= " paragraph-elevate inline-placeholder vossi-paragraph_elevate " data-uri= " cms.cnn.com/_components/paragraph/instances/cmsyzlzi3000x27oydqd0f4d2@published " data-editable= " текст " data-component-name= " параграф " data-article-gutter= " true " > OpenAI разкрива нови, по-силни гаранции за сигурност към своето образование и тестване в светлината на новите благоприятни условия на модела и поредност от произшествия, при които системи с изкуствен интелект са хакнали други компании.
<стр class= " paragraph-elevate inline-placeholder vossi-paragraph_elevate " data-uri= " cms.cnn.com/_components/paragraph/instances/cmsyzoufb00053b6rz68w7xpu@published " data-editable= " текст " data-component-name= " параграф " data-article-gutter= " true " > Компанията за първи път разкри през юли, че по време на изпит за киберсигурност, композиция от нейните AI сътрудници с преднамерено понижени вътрешни защитни ограничения е избягала от тяхната тестова среда посредством незнаен до момента бъг. Агентите взеха решение, че най-хубавият метод да се оправят с тестванията е да намерят ключа за отговор отвън средата за тестване. Затова те хакнаха системите на Hugging Face, платформа, която хоства AI модели и набори от данни, с цел да намерят отговорите. <стр class= " paragraph-elevate inline-placeholder vossi-paragraph_elevate " data-uri= " cms.cnn.com/_components/paragraph/instances/cmsyzoufb00063b6rkqk3llaa@published " data-editable= " текст " data-component-name= " параграф " data-article-gutter= " true " > Създателят на ChatGPT сподели, че вследствие на това втвърдява своите проучвателен и тестови среди, разширявайки мониторинга за разкриване и реагиране на обезпокоително държание на AI. OpenAI също по този начин работи, с цел да подсигурява, че системите с изкуствен интелект се държат съгласно предназначението на хората, развой, прочут като подравняване. <стр class= " paragraph-elevate inline-placeholder vossi-paragraph_elevate " data-uri= " cms.cnn.com/_components/paragraph/instances/cmsyzoufb00073b6rc4n3v6vx@published " data-editable= " текст " data-component-name= " параграф " data-article-gutter= " true " > „ Всичко, което вършим, има за цел да предотврати повтаряне на нещо като Hugging Face “, сподели Миа Глейзе, началник на изследователския отдел на OpenAI, пред кореспонденти на брифинг във вторник. <стр class= " paragraph-elevate inline-placeholder vossi-paragraph_elevate " data-uri= " cms.cnn.com/_components/paragraph/instances/cmsyzoufb00083b6r5vka19hj@published " data-editable= " текст " data-component-name= " параграф " data-article-gutter= " true " > Хакът се преглежда като повратна точка в самостоятелната киберсигурност, задвижвана от AI. Главният изпълнителен шеф на OpenAI Сам Алтман сподели през юли, че това е „ първият случай със сигурността, който чувствам надълбоко “ и накара повече от 1300 от най-хубавите чиновници от най-големите софтуерни компании да изискат принадлежности за закъснение на темпото на развиване на ИИ. <стр class= " paragraph-elevate inline-placeholder vossi-paragraph_elevate " data-uri= " cms.cnn.com/_components/paragraph/instances/cmsyzoufb00093b6r96088bgn@published " data-editable= " текст " data-component-name= " параграф " data-article-gutter= " true " > OpenAI сподели, че новите защитни ограничения са въодушевени и от последния модел Astra. Компанията неотдавна спря част от работата по модела, откакто видя индикация, че моделът може да е в положение да започва самостоятелни хакерски атаки. <стр class= " paragraph-elevate inline-placeholder vossi-paragraph_elevate " data-uri= " cms.cnn.com/_components/paragraph/instances/cmsyzoufb000a3b6r0sf0b3ko@published " data-editable= " текст " data-component-name= " параграф " data-article-gutter= " true " > Един от основните способи, по които сътрудниците на OpenAI съумяха да избягат от средата си за тестване, беше, че снабдител на програмен продукт трета страна имаше незнаен до момента бъг, който сътрудниците съумяха да експлоатират. Сега OpenAI сподели, че ще „ увеличи стандартите за сигурност “ за средите за тестване на AI, в това число по-силна изолираност, „ тъй че един компромис на работно натоварване или поддържаща услуга да не разрешава самичък по себе си неоторизиран достъп “ отвън позволената пясъчна среда. <стр class= " paragraph-elevate inline-placeholder vossi-paragraph_elevate " data-uri= " cms.cnn.com/_components/paragraph/instances/cmsyzoufb000b3b6r3loyo51u@published " data-editable= " текст " data-component-name= " параграф " data-article-gutter= " true " > Агентите на OpenAI също работиха незабелязани известно време, като започнаха процеса на бягство през май. Компанията в този момент споделя, че е създала система за наблюдаване, която ще „ издаде предизвестие в границите на 30 минути, откакто се появи загрижена интензивност “. <стр class= " paragraph-elevate inline-placeholder vossi-paragraph_elevate " data-uri= " cms.cnn.com/_components/paragraph/instances/cmsyzoufb000c3b6rn75lyk95@published " data-editable= " текст " data-component-name= " параграф " data-article-gutter= " true " > Компанията също по този начин сподели, че прави повече, с цел да образова AI моделите да се приведат в сходство с това, което хората в действителност желаят от тях да вършат - в доста от случаите на AI сътрудници, които са се измамили, сътрудниците са подхванали неразрешени дейности, които човешките тестери не са възнамерявали сътрудниците да подхващат. <стр class= " paragraph-elevate inline-placeholder vossi-paragraph_elevate " data-uri= " cms.cnn.com/_components/paragraph/instances/cmsyzoufb000d3b6r65vc9ydp@published " data-editable= " текст " data-component-name= " параграф " data-article-gutter= " true " > OpenAI съобщи, че усъвършенства образованието си за привеждане в сходство на модела, в това число възнаграждаване на „ модели за по-добро разкриване и разубеждаване на рисково държание в дилемите и среди; модели за образование да бъдат по-честни по отношение на своите дейности, качества и ограничения; и понижаване на държанието, което употребява недостатъци в премиите, класиращите, инструментите или надзора. <стр class= " paragraph-elevate inline-placeholder vossi-paragraph_elevate " data-uri= " cms.cnn.com/_components/paragraph/instances/cmsyzoufb000e3b6r1n1jvfzo@published " data-editable= " текст " data-component-name= " параграф " data-article-gutter= " true " > Увеличеният мониторинг има цена: Компанията сподели, че пресмята, че разноските за мониторинг ще костват почти 20 % повече в допълнение към изчислителната мощ, от която се нуждае моделът. <стр class= " paragraph-elevate inline-placeholder vossi-paragraph_elevate " data-uri= " cms.cnn.com/_components/paragraph/instances/cmsyzoufb000f3b6rx2bcrynw@published " data-editable= " текст " data-component-name= " параграф " data-article-gutter= " true " > „ Наистина сме отдадени на постигането на по-високи стандарти за сигурност с напредването на опциите, даже когато това се отразява на темпото на нашето вътрешно развиване “, сподели Глейзе. Вижте всички тематики Връзката е копирана! Следвайте