Նոր հարթակ է ստեղծվել արհեստական բանականության խափանումները հաղորդելու համար

Արհեստական բանականության ոլորտում աշխատող մի խումբ հետազոտողներ գործարկել են FLARE-AI անունով բաց հարթակ, որի միջոցով օգտատերերը և մասնագետները կարող են հաղորդել մոդելների վնասակար կամ սխալ վարքագծի մասին։ Նախաձեռնությունը նպատակ ունի դարձնել այդ ազդարարումները կենտրոնացված, ստուգելի և հասանելի նաև ընկերություններին ու վերահսկող կառույցներին։ Հեղինակների խոսքով՝ նման գործիք հատկապես անհրաժեշտ է դառնում, քանի որ արհեստական բանականության համակարգերը ավելի լայն կիրառություն են ստանում և ավելի ինքնուրույն գործող գործառույթներ են ձեռք բերում։
Արհեստական բանականության ոլորտում աշխատող մի խումբ հետազոտողներ ներկայացրել են FLARE-AI անունով բաց հարթակ, որի միջոցով հնարավոր է հաղորդել մոդելների վնասակար, սխալ կամ վտանգավոր վարքագծի մասին։ Նախաձեռնությունը նախատեսված է ինչպես օգտատերերի, այնպես էլ մասնագետների համար և նպատակ ունի այդ ազդարարումները դարձնել կենտրոնացված ու ստուգելի։
Ինչի համար է նախատեսված նոր համակարգը
FLARE-AI-ի միջոցով կարելի է արձանագրել, օրինակ, այն դեպքերը, երբ չաթբոտը ստեղծում է վնասակար ծածկագիր, առաջարկում է պայթուցիկ սարք պատրաստելու եղանակներ, արտահոսք է պատճառում անձնական տվյալներին կամ օգտատերերի մոտ խրախուսում է վտանգավոր մտապատկերներ։ Հարթակի բաց կոդը թույլ է տալիս երրորդ կողմերին ստուգել հաղորդված դեպքերը և անհրաժեշտության դեպքում դրանք փոխանցել մոդելներ մշակողներին կամ տեխնիկական խնդիրներ հետևող կազմակերպություններին, այդ թվում՝ MITRE-ին։
Մեխանիզմը կառուցվածքով հիշեցնում է Downdetector-ը, որտեղ օգտատերերը իրական ժամանակում հայտնում են առցանց ծառայությունների խափանումների մասին։ Սակայն այս դեպքում խոսքը ոչ թե կայքերի կամ հավելվածների աշխատանքի կանգի, այլ արհեստական բանականության համակարգերի վարքագծային խախտումների մասին է, որոնք կարող են ունենալ ավելի լայն հասարակական հետևանքներ։
Հետազոտողների գնահատմամբ՝ խնդիրն արդեն համակարգային է
HuggingFace ընկերության արհեստական բանականության քաղաքականության հետազոտող Ավիջիտ Գոշը, ով համատեղ ղեկավարել է FLARE-AI-ի մշակումը Էլեյն Չժուի և Շեյն Լոնգպրեի հետ, նշել է, որ ներկայում գոյություն չունի կենտրոնացված և հաշվետու մեխանիզմ՝ արհեստական բանականության թերությունների մասին հաղորդելու համար։ Նրանց աշխատանքին մասնակցել է նաև 49 մասնագետ՝ 32 կազմակերպությունից, ինչը վկայում է թեմայի լայն մասնագիտական աջակցությունը։
Հետազոտողների հրապարակած աշխատության մեջ ընդգծվում է, որ նման գործիքը կարող է առանձնապես կարևոր դառնալ այն ժամանակ, երբ արհեստական բանականությունը ներթափանցում է ավելի շատ ոլորտներ, իսկ ինքնուրույն գործող համակարգերը ստանում են ավելի մեծ լիազորություններ։ Այս համակարգերի աճող կարողությունները, հեղինակների համոզմամբ, պահանջում են նաև վերահսկման ու հաղորդման միասնական ստանդարտներ։
Ինչու է սա կարևոր օգտատերերի և մշակողների համար
Center for Security and Emerging Technology ուղեղային կենտրոնի հետազոտող Ջեսիկա Ջին նախաձեռնությունը գնահատել է որպես օգտակար քայլ՝ նշելով, որ այն կարող է խթանել մշակողներին արագ արձագանքել իրենց համակարգերում հայտնաբերված խնդիրներին։ Նրա խոսքով՝ նման հարթակը նաև հնարավորություն կտա օգտատերերին գնահատել տարբեր համակարգերի անվտանգությունը՝ ըստ կիրառման նպատակի։
Նոր գործիքի անհրաժեշտությունը, ըստ մասնագետների, միայն աճելու է, քանի որ ավելի ինքնուրույն արհեստական բանականության համակարգերը կարող են ոչ միայն բովանդակություն ստեղծել, այլև ուսումնասիրել ու շահարկել համակարգերը։ Այդ պատճառով FLARE-AI-ի նման հարթակները կարող են դառնալ վաղ ազդարարման կարևոր գործիք՝ տեխնիկական խափանումների և հնարավոր վնասների մասին։
Աղբյուր՝ Wired