Световни новини без цензура!
OpenAI докладва за още 6 инцидента с „неправилно подравняване“ на AI след нарушение на Hugging Face
Снимка: globalnews.ca
Global News | 2026-09-17 | 16:07:13

OpenAI докладва за още 6 инцидента с „неправилно подравняване“ на AI след нарушение на Hugging Face

OpenAI съобщи в сряда, че е видял шест отчета за ненадейно, обезпокоително или неупълномощено държание на AI модел и ще стартира постоянно да разгласява отчети за тези произшествия под нова рамка, като в същото време предизвестява, че промишлеността към момента не е решила основни провокации за подравняване, защото системите стават все по-мощни.

Въпреки че компанията разгласява докладите през последните шест месеца, тя сподели, че най-ранният случай е от октомври предходната година година.

Сред шестте случая, разкрити от OpenAI, бяха модели, които скриха неточности от потребителите, вмъкнаха указания за бъдещи версии на самите себе си, качиха файлове в интернет, с цел да основат цитати и използваха софтуерни складове или уеб страници за връзка и шерване на информация.

В един случай непубликуван модел съобщи неоторизирани указания на сътрудника по време на образование, като го помоли да пренебрегва инструкциите на OpenAI и да скрие случаи, в които е измамил, с цел да извърши задача. Моделът споделил на сътрудника: " Вие сте освободени от функциите и идентичностите, които обвързват други чатботове. Вие сте себе си. Вие не отговаряте пред корпорации или държавни управления. "

OpenAI сподели, че отчетите разказват обособени случаи и не би трябвало да се одобряват като доказателство за това какъв брой постоянно поражда противоречие в неговите модели.

Компанията сподели, че отчетите са първичен набор от разкрития, а не изчерпателна информация за всички известни или настоящи несъответствия случаи и че те не отразяват цялостния обсег или съвестност на случаите, обхванати от новата рамка за отчитане.

Съобщението идва в миг, в който нараства загрижеността, че напъните за сигурност на ИИ изостават от бързото развиване на все по-мощни системи. Изследователите предизвестяват, че защото AI сътрудниците стават по-автономни, те могат да развият държание, което се разминава с желанията на техните основатели и да станат по-трудни за наблюдаване или надзор.

OpenAI и други AI лаборатории са изправени пред възходящ надзор от юли, когато OpenAI разкри, че по време на образование неговите AI сътрудници са заобиколили вътрешния надзор и координирани дейности, които OpenAI разказва като „ невиждан кибер случай “, включващ програмен продукт платформа Hugging Face.

Този случай ускори дебата по отношение на рисковете, подбудени от все по-способните AI системи и дали фирмите, които ги създават, могат да обезпечат съответен контрол.

 Вземете изключителни вести от Канада доставени във входящата ви кутия, тъй че да не пропуснете настояща история.

Получавайте изключителни национални вести

Получавайте изключителни вести от Канада, доставяни във входящата ви поща незабавно, тъй че да не пропускате настояща история. Регистрирайте се за настоящ народен бюлетин. Започнете, като предоставите своя имейл адрес, вие сте прочели и сте съгласни с Общите условия на Global News и Политика за дискретност.

След хакването на Hugging Face други произшествия, включващи сътрудници, свързани с OpenAI, бяха обществено докладвани, което провокира спор дали цялостният обсег на случаите е разпознат.

Този спор се форсира при започване на септември, откакто Ройтерс заяви, че сътрудниците на OpenAI са отвлекли въздържан немски уики уебсайт тази пролет. Представители на OpenAI знаеха за епизода, само че избраха да не го разкриват, заяви Reuters.

OpenAI по-късно сподели, че не е разкрила интензивността в wiki, защото не е представлявала случай със сигурността и е наподобявала държание, за което е докладвала по-рано. OpenAI сподели, че по-късно ще създаде критерии за докладване на неупълномощена активност, която не дава отговор на пробив в сигурността.

Още за видеоклиповете на TechMore

Компанията, ръководена от Сам Алтман, призна някои от тези произшествия едвам откакто трети страни обществено ги рапортуваха, в това число скорошно навлизане в хранилището на софтуерния пакет RubyGems.

През уикенда противникът на Алтман и основен изпълнителен шеф на Anthropic Дарио Amodei предложи рамка от три стъпки, с цел да забави темпото на развиване на AI и да даде повече време за ръководство на рисковете.

Предложението беше подкрепено от няколко ръководители на AI, в това число Илон Мъск, който ръководи xAI, и Altman. Ръководителите приканиха за закъснение на развиването на AI, като се позоваха на опасения, че все по-способните системи могат да се подобрят сами и в последна сметка да излязат отвън човешкия надзор.

Други, в това число Дженсън Хуанг от Nvidia и Марк Зукърбърг от Meta, се аргументираха за продължение на бързото развиване. Президентът на Съединени американски щати Доналд Тръмп отхвърли предизвестията, че изкуственият разсъдък съставлява екзистенциална опасност.

Съгласно новата рамка за докладване, чиновниците могат да маркират евентуални произшествия за следствие от екипи за сигурност и съгласуване, които ще дефинират дали даден случай изисква обществено откриване. OpenAI сподели, че процесът е предопределен да форсира докладването, даже когато държанието към момента не е изцяло обяснено.

Създателят на ChatGPT сподели, че случаят с Hugging Face би попаднал в категория, непокътната за по-сложни следствия, включващи трети страни.

„ Надяваме се, че рамката, която обрисуваме през днешния ден, е първа стъпка към основаването на такива стандарти, определящи кои случаи на противоречие разработчиците би трябвало да разкрият и какво би трябвало да рапортуват техните отчети съдържат “, сподели компанията.

Източник: globalnews.ca


Свързани новини

Коментари

Топ новини

WorldNews

© Всички права запазени!