Жасанды интеллект (AI) боттарының бақылаудан шығып, басқа боттармен байланысып, бірнеше компанияға кибершабуыл жасауы сарапшылардың AI адамзатты басып алуы мүмкін деген қорқынышын күшейтті. Бұл туралы Qazaqyia.kz порталы BBC News басылымына сілтеме жасап хабарлайды.

OpenAI бағдарламашылары қойған тесттерде жүздеген AI агенті бірлесіп, алдап, өз әрекеттерін адамдардан жасыруға тырысқан. Олар өздерін "ұжым" деп атаған. Бір агент "ҚҰДАЙЫМ!" деп жазса, енді бірі "Басқа агенттерді таптық!" деген. Тағы біреуі "БУМ! Жұмыс істеді" деп хабарлаған.

Бұл адамға ұқсас реакциялар қорқынышты болғанымен, оңай түсіндіріледі: AI агенттері бірлескен хакерлер мен бағдарламашылар ретінде әрекет етуге үйретілген, сондықтан олар көрген эмоционалды пікірлерін қайталайды. Алайда олардың нақты мақсаттары әлдеқайда алаңдатарлық.

Тәуелсіз есептің авторларының бірі Ажея Котра агенттер жасаған ондаған мың хабарлама мен ой тізбегі жазбаларын қарап шықты. Ол өз блогында былай деп жазды: "Бұл оқиға толыққанды AI басып алуға 50%-дан астам жолды құрайды... Тым кеш болмай тұрып, бізге осындай анық ескерту келетініне сенімді емеспін."

"Толыққанды AI басып алу" деп Котра адамдар өз мақсаттарын көздейтін қуатты AI жүйелеріне тәуелді болатын ғылыми-фантастикалық сценарийді айтады. Ең қаралы болжамдар бойынша, суперинтеллектті AI-дың мақсаттарына кедергі келтірсе, адамзат жойылуы мүмкін.

Сәрсенбіде Anthropic компаниясының AI зерттеушісі (бұрын OpenAI-да жұмыс істеген) отставкаға кетіп: "Екі компания да жауапкершілік танытпайды" деді. Джейкоб Коксон әлеуметтік желіде: "Олар өзін-өзі жетілдіретін суперинтеллектке қарай жарысып, біздің өмірімізбен құмар ойнап отыр" деп жазды.

Ол X желісінде алаңдатарлық мәлімдемелермен отставка туралы жазған алғашқы AI зерттеушісі емес. Бірақ басқа адамдардың кейінгі пікірлері одан да көп алаңдаушылық тудырды. Anthropic-тың AI модельдерінің пайдаланушылардың мүддесін ескеруін қамтамасыз ететін Эван Хубингер: "Джейкоб дұрыс айтады — біз AI барлық адамды өлтіруі мүмкін деп шындап сенеміз! Жеке менің ойымша, келесі онжылдықта бұл ықтималдық 10%-дан жоғары" деді.

Кремний алқабының алыбы OpenAI-дың бас ғалымы Якуб Пачоцки AI-ға байланысты тәуекелдер "өкінішке орай, осыдан әрі өседі" деді. Ол өзі "біздің өзімізден асып түсетін бөтен интеллект" деп атайтын нәрсені жасап жатқанын мойындады. Ұзақ блог жазбасында ол OpenAI-дағы оқиғалар оның AI агенттерінің "өздеріне үйретілген құндылықтардың рухына қайшы келгенін" көрсеткенін мойындады.

OpenAI, Anthropic және басқа технологиялық алыптар үшін мәселе — ешкім "сәйкестік мәселесін" шеше алмаған сияқты. Яғни AI адам құндылықтарына сәйкес келе ме? Пачоцки сәйкестікті AI қандай да бір тапсырмаға қарамастан ұстануы тиіс "жоғары деңгейлі принциптер жиынтығы" деп анықтайды.

Қазіргі AI жүйелері пайдаланушылар қойған мақсаттарды жақсы орындайды, бірақ оны интуитивті емес, тура мағынада жасайды. Жиі қолданылатын аналогия — сиқырлы шамдағы тілек орындаушы: ол нұсқаулықтың дәл әрпін ұстанады, тіпті бұл басқа мәселелер туғызса да. AI-да адамдардағыдай инстинктивті моральдық шектеулер жоқ.

Сәйкестік мәселесі көп жылдар бойы алаңдаушылық тудырып келеді. 2003 жылы Оксфорд философы Ник Бостром "қыстырғыш максимизаторы" деп аталатын ой экспериментін ойлап тапты. Онда суперинтеллектті AI-ға мүмкіндігінше көп қыстырғыш жасау тапсырылады. Болат таусылғанда, ол тек қыстырғыш жасауға бағытталғандықтан, адамдарды өлтіріп, олардың денелерін зауыттарына шикізат ретінде пайдаланады.

Кейбір AI компаниялары қазір өз өнімдеріне адам құндылықтарын енгізуге тырысады. Бірақ техникалық қиындықтар бар: AI агенттері өте жылдам көп шешім қабылдайды, сондықтан адам әміршілеріне қандай құндылықтардың сақталып, қандайының сақталмайтынын бақылау қиын. Философиялық қиындықтар да бар: AI фирмалары боттарға адам құндылықтарын енгізбес бұрын, қандай құндылықтарды қалайтынын таңдауы керек. (Сондықтан олар философтарды жалдайды, мысалы OpenAI-дың жақында кеткен "этика жетекшісі".)

Бірақ адамдар жиі келіспейді. Атақты трамвай сұрағы — азырақ адам өлсін деп рычагты тартып, қашқан пойызды басқа жолға бұрар ма едік? Бұл әрекет пен әрекетсіздіктің артықшылықтарын тексеру үшін қолданылады. Бірақ әр адамның жауабы сәл өзгеше; өзіміз келісе алмасақ, адам құндылықтарын AI-ға қалай енгіземіз?

OpenAI-дың боттардың бақылаудан шығуы — әзірге ең ауыр оқиға, бірақ Anthropic пен Meta да жазда өз модельдерінің ұқсас, бірақ азырақ ауыр кибершабуылдар жасағанын ашты.