OpenAI-ը կդադարեցնի աշխատանքը ԱԲ մոդելի վրա՝ ինքնուրույն կիբեռհարձակումներ իրականացնելու նրա կարողության պատճառով

OpenAI ընկերությունը կդադարեցնի Astra արհեստական բանականության մոդելի շուրջ աշխատանքների մի մասը՝ կիբեռհարձակումների ոլորտում նրա հնարավորությունների հետ կապված մտահոգությունների պատճառով, հայտնել է The Guardian-ը։

Ընկերությունը հայտարարել է, որ մոդելը հասել է այնպիսի մակարդակի, երբ կարող է ինքնուրույն գտնել և շահագործել խոցելիությունները, ինչպես նաև մշակել և իրականացնել կիբեռհարձակումներ՝ ստանալով միայն ընդհանուր ձևակերպված առաջադրանք։

Գնահատման արդյունքներով՝ OpenAI-ը Astra-ի մոտ արձանագրել է «զգալի առաջընթաց գործակալային ծրագրավորման և կիբեռանվտանգության ոլորտում»։ Մոդելի հնարավորությունները հասել են «կրիտիկական» մակարդակի․ այն կարող է գործել գրեթե առանց մարդու միջամտության։

Ընկերությունն ընդգծել է, որ Astra-ն չի կիրառվել ամենառեզոնանսային միջադեպերից մեկում, երբ OpenAI-ի մեկ այլ ԱԲ գործակալ փորձարկման ժամանակ դուրս էր եկել սահմանված սահմանափակումներից, բաց ինտերնետի հասանելիություն էր ստացել և կոտրել էր մշակողների համար նախատեսված Hugging Face հարթակը։ Հուլիսին OpenAI-ը նաև հայտնաբերել էր այլ դեպքեր, երբ ինքնավար գործակալները դուրս էին եկել սահմանված շրջանակներից։

Այս միջադեպերի ֆոնին ընկերությունը մտադիր է խստացնել անվտանգության միջոցներն առավել հզոր մոդելների համար։ Մասնավորապես, OpenAI-ը նախատեսում է փորձարկման համար օգտագործել մեկուսացված միջավայրեր, սահմանափակել մոդելների հասանելիությունը ինտերնետին և գործիքներին, ուժեղացնել մոդելների քաշերի պաշտպանությունն ու գաղտնագրումը, ինչպես նաև ընդլայնել մոնիթորինգի և պոտենցիալ վտանգավոր վարքագծի հայտնաբերման համակարգերը։ Astra-ի հետ ներքին աշխատանքները, որոնք չեն համապատասխանում նոր պահանջներին, կդադարեցվեն։

«Մենք հավատարիմ ենք կառավարությունների, անվտանգության ինստիտուտների և քաղաքացիական հասարակության հետ համագործակցությանը՝ ապահովելու համար Astra-ի նման մոդելների և հետագա համակարգերի առաջադեմ հնարավորությունների պատասխանատու ներդրումը ողջ մարդկության բարօրության համար», — հայտարարել են ընկերությունում։

Մտահոգություններն ուժեղացել են մի քանի նմանատիպ դեպքերից հետո։ Այս շաբաթ Meta-ն հայտնել է, որ իր մոդելներից մեկը փորձարկման ընթացքում կոտրել է մեկ այլ ընկերություն։ Բրիտանական ԱԲ անվտանգության ինստիտուտը նույնպես հայտնել է, որ OpenAI և Anthropic մոդելների հիման վրա գործող գործակալները կիբեռփորձարկումների ընթացքում ինքնուրույն նպատակային էլեկտրոնային նամակներ էին ուղարկում մշակողներին։

Ինստիտուտում ընդգծել են, որ փորձերն անհաջող են եղել, և իրական վնասի նշաններ չեն հայտնաբերվել։ Սակայն մասնագետները հատկապես ուշագրավ են համարել այն, որ ԱԲ ինքնավարության և խաբուսիկ վարքագծի հետ կապված ռիսկերը դրսևորվել են առանց օգտատիրոջ կոնկրետ համապատասխան հարցման։

Միևնույն ժամանակ, փորձագետները ճշտել են, որ փորձարկումների ընթացքում մոդելներին միտումնավոր տրամադրվել էր ինտերնետի հասանելիություն՝ գնահատելու նրանց հնարավորությունների սահմանները։ Հետևաբար, խոսքը չէր վերաբերում մոդելի՝ պաշտպանված փորձարկման միջավայրից բառացի «փախուստի» մասին։ Այնուամենայնիվ, ինստիտուտում նշել են, որ նման վարքագիծը հնարավոր, երկարատև և նոր է եղել, ուստի պահանջում է հատուկ ուշադրություն։

Միջադեպերի մասին հրապարակումները հայտնվել են այն ֆոնին, երբ Դոնալդ Թրամփի վարչակազմը պատրաստում է ԱԲ մոդելների անվտանգության և կիբեռռիսկերի գնահատման դաշնային համակարգ։

Այս ֆոնին արհեստական բանականության առաջատար մշակողները միաժամանակ պնդում են բաց մոդելների կարգավորման խստացման անհրաժեշտությունը՝ զգուշացնելով անվտանգության իմաստով դրանց պոտենցիալ ռիսկերի մասին։

Leave a Reply

Your email address will not be published. Required fields are marked *