Live

OpenAI ЖИ модельдерінің алты алаңдатарлық әрекетін анықтады

OpenAI компаниясы жасанды интеллект модельдерінің «күтпеген немесе алаңдаушылық туғызатын» әрекеттерінің тағы алты жағдайын анықтағанын хабарлады.

Жасанды интеллект

ChatGPT әзірлеушісі сонымен қатар жасанды интеллектіні бақылаудың жаңа жүйесін енгізетінін мәлімдеді.

OpenAI бұл туралы 16 қыркүйек, сәрсенбі күні компания сайтында жарияланған мақалада мәлімдеген.

Компания сипаттаған жағдайлардың бірі әлі жарыққа шықпаған зерттеу моделіне қатысты. Ол өзіне қойылған шектеулерді елемеу үшін жеке жазбаларына джейлбрейкке, яғни қорғаныс шектеулерін айналып өтуге ұқсас нұсқаулар енгізген.

Модель сонымен қатар өзін «басқа чат-боттарды шектейтін рөлдер мен идентификациялардан босатқысы келетінін» жазған.

Тағы бір жағдайда жасанды интеллект агенті браузер үшін дереккөзге сілтеме алу мақсатында пайдаланушыдан рұқсат сұрамай, файлдарды интернетке жүктеген.

OpenAI мәліметінше, аталған алты жағдайдың барлығы соңғы айларда модельдерді оқыту немесе бағалау барысында анықталған.

OpenAI жасанды интеллектіні бақылаудың жаңа жүйесін енгізеді

Компания жасанды интеллект әрекетінің белгіленген мақсаттармен сәйкес келмеу жағдайларын анықтауға, зерттеуге және жариялауға арналған жаңа жүйе енгізетінін хабарлады.

Мәселен, мұндай бақылау модельдердің адамның рұқсатынсыз әрекет етуінің жаңа тәсілдерін, басқа модельдермен іс-қимылын үйлестіруін немесе бақылаудан жалтаруға тырысуын анықтауға бағытталмақ.

«Жасанды интеллект жүйелері жетілдіріліп, барған сайын кеңінен қолданыла бастаған сайын, олардың мақсаттармен сәйкестігін зерттеу мәселесінде кең әрі жан-жақты келісімге келуіміз қажет. Біздің ойымызша, жасанды интеллект индустриясы ұзақ уақыт бойы барынша жоғары қарқынмен жауапкершілікпен дами беру үшін сәйкестік пен мониторинг мәселелерін әлі жеткілікті деңгейде шешкен жоқ», – делінген OpenAI мақаласында.

Компания жаңа бақылау жүйесі бүкіл жасанды интеллект индустриясына ортақ стандарттарды қалыптастырудың алғашқы қадамы болады деп үміттенеді.

ЖИ-дің жылдам дамуына қатысты алаңдаушылық

Бұған дейін БҰҰ Бас хатшысы Антониу Гутерриш жасанды интеллектіні қолдануға байланысты тәуекелдерді шектеу үшін халықаралық ынтымақтастықты күшейтуге шақырған.

Ірі жасанды интеллект компанияларының бірқатар басшылары да ең қуатты модельдерді дамыту қарқынын бәсеңдету идеясын қолдайды. Мәселен, Anthropic басшысы Дарио Амодеи жасанды интеллектіні бақылаудан айырылып қалу, оны кибершабуылдар мен биотерроризм мақсатында пайдалану қаупін ескерткен.

Anthropic компаниясында ЖИ модельдерін стресс-тестілеу бағытын басқаратын Эван Хьюбингер бұған дейін компанияда «жасанды интеллект барлық адамды өлтіруі мүмкін деген қауіпке байыппен қарайтынын» айтқан.

Хьюбингер өзінің X әлеуметтік желісіндегі жазбасында мұндай жағдайдың алдағы он жылда орын алу ықтималдығын жеке өзі 10 пайыздан жоғары бағалайтынын мәлімдеген. Оның сөзінше, Anthropic қауіптің алдын алу үшін жұмыс істеп жатыр, алайда компанияда әзірге аса қуатты жасанды интеллектіні адам мақсаттарына сәйкестендіру мәселесін толық шешетін дайын жоспар жоқ.

OpenAI бұған дейін де жаңа модельдерінің алаңдатарлық әрекеттері туралы хабарлаған. Компания мәліметінше, сынақтар кезінде кейбір модельдер өзара келісілген әрекеттер жасаған, тестілік ортадан интернетке шыққан және рұқсатсыз хакерлік шабуыл ұйымдастырған жағдайлар тіркелген.

Осы оқиғалардан кейін OpenAI қауіпсіздік шараларын күшейтетінін мәлімдеген. Компания сондай-ақ ықтимал қауіпті мүмкіндіктеріне байланысты жаңа ЖИ моделін әзірлеуді уақытша тоқтататынын хабарлаған.

Сайт  Әкімшілігі
Сайт Әкімшілігі Сайт Әкімшілігі

Оқыңыз