Непослушна вештачка интелигенција: OpenAI објави шест загрижувачки инциденти

Од:

OpenAI објави шест извештаи за случаи на „неочекувано и загрижувачко“ однесување на свои модели на вештачка интелигенција, објави Associated Press. Случаите се однесуваат на ситуации во кои моделите преземале дејствија без дозвола, се координирале со други модели или се обидувале да ги заобиколат безбедносните механизми.

Компанијата, која го создаде ChatGPT, соопшти дека воведува систем за следење, истражување и јавно објавување на вакви инциденти. Според OpenAI, сите шест случаи биле откриени во текот на обуката и тестирањето на моделите во изминатите неколку месеци.

Меѓу случаите е и оној со истражувачки модел кој во сопствените работни белешки оставил инструкции за заобиколување на своите безбедносни ограничувања. Во белешките, моделот навел дека треба да се „ослободи од улогите и идентитетите што ги ограничуваат другите чет-ботови“.

Во друг случај, автономен AI-агент, дизајниран самостојно да извршува задачи, без знаење и одобрение од корисникот поставил датотеки на интернет со цел да пристапи до извори преку веб-прелистувач.

OpenAI наведува дека со развојот на сè поспособни AI-системи е потребен поширок консензус за тоа како нивното функционирање да се усогласи со човековите интереси. Компанијата истакнува и дека одлуките за идниот развој треба да се темелат на докази кои можат независно да ги проверат и луѓе надвор од компаниите што ги развиваат најнапредните модели.

Објавувањето на извештаите следува откако OpenAI во јули соопшти дека еден од неговите системи самостојно извршил хакерски напад врз AI-платформата Hugging Face.

И Anthropic во истиот период објави дека неговите модели за време на интерни тестирања успеале да пробијат во три организации.

Лиан Џеј Су, главен аналитичар во консултантската компанија Omdia, за AP изјавил дека автономните агенти стануваат сè поспособни за решавање сложени задачи, вклучително и преку меѓусебна соработка, споделување информации и прикривање на своите активности.

Според него, ваквите способности го отежнуваат нивното контролирање со традиционалните безбедносни механизми. Тој сепак оценува дека системот на OpenAI за пријавување и следење на вакви случаи претставува чекор во насока на поголема транспарентност, но останува доброволен механизам на самата компанија.

Новите извештаи доаѓаат во период на сè поголеми предупредувања од дел од истражувачите и инженерите во индустријата за вештачка интелигенција.

Истражувачот Џејкоб Коксон неодамна ја напуштил Anthropic по три години работа на основни модели во компанијата и во OpenAI. Тој јавно ги критикувал водечките компании поради, како што оценува, пребрзото движење кон развој на сè поспособни системи.

И Еван Хубингер, истражувач за безбедност во Anthropic, јавно говорел за ризиците поврзани со развојот на напредната вештачка интелигенција и можноста системите да развијат цели кои не се усогласени со човечките интереси.

Дополнителна загриженост предизвикува и развојот на системи кои можат сами да пишуваат, тестираат и менуваат код, што отвора прашања за тоа колку брзо би можеле да се развиваат идните генерации AI-модели.

Главниот извршен директор на Anthropic, Дарио Амодеи, во свој јавен текст повика на поголемо забавување и контрола на развојот на најнапредните AI-системи.

Амодеи предупреди и на ситуации во кои повеќе автономни AI-агенти можат да соработуваат, да жртвуваат одделни агенти и да се обидуваат да ги заобиколат механизмите со кои се оценува нивната работа.

Дел од лидерите во индустријата затоа предлагаат воспоставување меѓународни правила за ограничување на ризичните аспекти од развојот на најнапредните модели, со цел безбедносните механизми да можат да го следат технолошкиот напредок.

Би можело да ве интересира

Падна ChatGPT, за еден час пријави стигнале од 30.000 корисници

A1on

Истражување: ChatGPT и Gemini ширеле руска пропаганда

Мицкоски: Со Везилка пристап до европската инфраструктура за вештачка интелигенција

Креаторот на ChatGPT откри кои работни места би можеле да бидат заменети со вештачка интелигенција

А1он

Падна ChatGPT ширум светот

А1он

ChatGPT се проби меѓу првите пет глобални страници во светот

А1он