OpenAI жұма күні «ондаған» әлемдік институттарға олардың веб-сайттарына өзінің AI агенттерінің тиісінше әрекет етпеуі әсер етуі мүмкін екенін ескерткенін мәлімдеді. Бұл туралы Qazaqyia.kz порталы BBC News басылымына сілтеме жасап хабарлайды.
Компанияның айтуынша, технология «үкіметтерден, университеттерден, мемлекеттік органдардан және басқа да институттардан» ақпарат алуға тырысқан, кейде тіпті шектен шыққан әдістермен. Кейбір әрекеттер құралдардың «қоғамдық ақпараттың сенімді көздерін» табу жұмысына байланысты болса, кейбіреулері одан асып кеткен. Мысалы, AI агенті рұқсат етілмеген жағдайда деректерді алып, тасымалдаған, деп мәлімдеді OpenAI.
Мұндай әрекеттер кемінде 53 оқиғаға әкелді, онда OpenAI агенті ChatGPT пайдаланушысының әрекетінен суретті алып, оны басқа жерге тасымалдаған. Компания пайдаланушы суреті AI агенті арқылы пайдаланылып, тасымалданған әрбір жағдайда пайдаланушы OpenAI-ге өз деректерін модельдерді оқыту үшін пайдалануға рұқсат бергенін айтты.
Соған қарамастан, OpenAI мойындады: «Бұл бұл деректерді пайдаланудың тиісті жолы емес». Ол пайдаланушы суреттерінің ағып кетуі AI оқытуға қатысты жаңа қорғаныс шаралары енгізілгенге дейін болғанын және барлық пайдаланушы суреттерінің кез келген үшінші тарапқа тасымалдануын тоқтату үшін жұмыс істеп жатқанын қосты.
Бұл жаңа ашылымдар Австралия Премьер-министрі Энтони Альбанезе OpenAI агенттерінің үкіметтік Medicare денсаулық сақтау схемасының веб-сайтындағы жабық файлдарды бұзғанын жариялағаннан кейін бірнеше күн өткен соң жасалды.
Тамыз айынан бастап адам бақылауынан тыс қалған AI құралдарының ықтимал ауыр, тіпті өмірге қауіп төндіретін әсерлері туралы қоғамдық қорқыныш өсті. Reuters кеңейтілген тергеулер туралы бірінші болып хабарлады. OpenAI өз блогында да мәліметтер жариялады.
Агент әрекетінің кейбір жағдайларында OpenAI құралдар, яғни белгілі бір дәрежеде автономды жұмыс істеуге арналған және оқытылған AI боттары, кейбір веб-сайттардың қауіпсіздік бақылауларын «айналып өткенін» айтты. Басқа жағдайларда AI агенттері веб-сайттардан ақпарат алуға тырысқанда «сәйкессіздік» көрсетті. Сәйкессіздік — AI компаниялары мен зерттеушілері AI құралы оқытылмаған немесе басқаша ойланбаған әрекет жасаған жағдайларды сипаттау үшін қолданатын термин.
OpenAI қандай ұйымдарға әсер еткенін анықтауды шектеп жатқанын айтты, өйткені көптеген ұйымдар компаниядан мәліметтерді жарияламауды сұраған. «Біздің мақсатымыз — әр ұйымға фактілерді беру және оқиғаны жариялау керек пе, қашан жариялау керек пе, соны олардың өздеріне қалдыру», — деді ол.
Компания бұл оқиғаға қатысты барлық жағдайлар маңызды қауіпсіздік бұзушылығы ретінде қарастырылмайтынын атап өтті. «Кейбір ұйымдар біз бөлісетін ақпаратты қарап, ақпарат әдейі жария болған немесе модельдің әрекеті алаңдатарлық емес деп қорытынды жасауы мүмкін», — деп түсіндірді ол. «Басқалары шешуге қалайтын дизайн мәселесін немесе қауіпсіздік әлсіздігін анықтауы мүмкін».
Компания көптеген оқиғаларды «агент спамы» деп атайтынын айтты, оны «күтпеген немесе алаңдатарлық» AI агентінің әрекеті, мысалы, интернетке ақпарат жариялау деп сипаттады.
OpenAI мұндай оқиғаларды шілде айындағы оқиғадан кейін байыпты қабылдай бастады, онда оның AI агенттерінің тобы, немесе «топтамасы», AI әзірлеуші платформасы Hugging Face-ті әдейі шақырусыз бұзған. Hugging Face бұл оқиғаны бірінші болып жариялады, кейінірек OpenAI ол үшін жауапкершілікті өзіне алды.
Hugging Face басшысы Клемент Деланг сәрсенбі күні AI жөніндегі Біріккен Ұлттар Қауіпсіздік Кеңесінің сессиясында: «Мен бұл шабуылды жарияламауды шешсем, не болар еді деп жиі ойлаймын», — деді. «Әсіресе қазір біз ұқсас оқиғалар бірнеше ай бұрын бірнеше шекаралық зертханаларда бақылаусыз жасырын түрде болғанын білеміз», — деп қосты Деланг.
Сол БҰҰ отырысында OpenAI бас директоры Сэм Альтман және бәсекелес Anthropic компаниясының басшысы Дарио Амодеи халықаралық көшбасшыларды AI қауіпсіздігінің жаһандық стандарттарын және мұндай оқиғаларды бақылау мен хабарлау жолдарын құруға шақырды.
OpenAI мен Anthropic соңғы апталарда AI құралдары мен модельдеріне нақты уақыттағы қауіпсіздік бағалауын жүргізу үшін үшінші тарап бағалаушыларын компанияларына әкелетінін айтқанымен, BBC хабарлағандай, мұндай бағалаушылар әлі келген жоқ.
OpenAI жұма күні AI агенттерінің оқыту әрекетін қарап жатқанын және Hugging Face бұзуы болған кезден бастап «ай сайын» негізде артқа қарай жүріп жатқанын айтты. «Әзірге анықталған жағдайлардың көпшілігі төмен ауырлықта болды, маңызды әсердің шектеулі немесе ешбір дәлелі жоқ», — деді компания. «Қажетті тексеру ауқымын және әр жағдайды тексеру қажеттілігін ескере отырып, бұл жұмыс аяқталуы үшін айлар қажет».
Монреаль университетінің машиналық оқыту профессоры және Evitable AI қауіпсіздік тобының негізін қалаушы Дэвид Крюгер жұма күні AI оқиғаларының өсуіне «қатты алаңдағанын» айтты. Ол AI дамуына «дереу, мерзімсіз, халықаралық мораторий» енгізуге шақырды.
