ԱՄՆ-ն հանեց սահմանափակումները Anthropic-ի AI մոդելների վրա անվտանգության նոր քայլից հետո

ԱՄՆ առևտրի նախարարությունը հանել է Anthropic-ի Claude Fable 5 մոդելի նկատմամբ կիրառված արտահանման սահմանափակումները, այն բանից հետո, երբ ընկերությունը համաձայնել է ուժեղացնել անվտանգության պաշտպանությունը։ Ըստ աղբյուրների՝ նոր մեխանիզմը կկանխի օգտատերերի փորձերը՝ հասանելիություն ստանալու որոշ սահմանափակ հնարավորությունների։ Գործարքը փակել է այն բախումը, որը հանգեցրել էր մոդելի գործնականում անջատմանը։
ԱՄՆ առևտրի նախարարությունը հանել է Anthropic ընկերության Claude Fable 5 արհեստական բանականության մոդելի նկատմամբ կիրառված արտահանման սահմանափակումները՝ այն բանից հետո, երբ ընկերությունը համաձայնել է ընդլայնել անվտանգության գործող պաշտպանիչ մեխանիզմը։ Ըստ գործին ծանոթ երկու անձանց՝ նոր քայլը նպատակ ունի կանխել օգտատերերի փորձերը՝ շրջանցելու որոշ արգելված հնարավորություններ։
Ինչ է փոխվել անվտանգության համակարգում
Նոր կանոնի համաձայն՝ այն օգտատերերը, որոնք կփորձեն ստանալ սահմանափակ հնարավորությունների հասանելիություն, կստանան ծանուցում, որ իրենց հարցումը արգելափակված է, իսկ հարցումն ինքնաբերաբար կուղարկվի ավելի թույլ՝ Opus 4.8 մոդելին։ Մինչ այդ նման հարցումները, որոնք վերաբերում էին կենսաբանության և կիբերանվտանգության զգայուն գործառույթներին, արդեն ուղղվում էին նույն մոդելին։
Ըստ աղբյուրների՝ Anthropic-ը այժմ այդ պաշտպանությունը տարածել է նաև Amazon-ի հրապարակած մեկ ուսումնասիրության մեջ նկարագրված վարքագծի վրա։ Անվտանգության ոլորտի մասնագետ Քեթի Մուսուրիսը հրապարակած վերլուծության մեջ նշել էր, որ որոշ օգտատերեր կարողացել են շրջանցել սահմանափակումը՝ Fable 5-ին խնդրելով ոչ թե գտնել խոցելիությունը, այլ ուղղել կոդը։
Քաղաքական ճնշում և վերահսկողություն
Թեև կիբերանվտանգության փորձագետների մեծ մասը այդ վարքագիծը առանձնապես վտանգավոր չի համարել, աղբյուրների խոսքով՝ հենց այդ հանգամանքի մասին տեղեկանալուց հետո էլ ձևավորվել է հակասությունը Anthropic-ի և վարչակազմի միջև։ Արդյունքում կիրառվել են արտահանման վերահսկողության միջոցներ, որոնք գործնականում մոդելը դուրս էին բերել օգտագործումից։
ԱՄՆ առևտրի նախարար Հաուարդ Լատնիկի նամակը, որով հայտարարվել էր Fable 5 և Mythos 5 մոդելների սահմանափակումների վերացումը, այժմ լրացուցիչ մանրամասներով է հասկացնում որոշման հիմքերը։ Նամակում նա նշել է, որ Anthropic-ը համաձայնել է «նախապես հայտնաբերել և հասցեագրել» մոդելների ստեղծած անվտանգության ռիսկերը։
Վերադարձի հիմքում՝ նոր գնահատում
Աղբյուրների փոխանցմամբ՝ առևտրի նախարարությունը վերջնականապես թույլատրել է Fable 5-ի թողարկումը նաև այն բանից հետո, երբ արհեստական բանականության ստանդարտների և նորարարության կենտրոնի հետազոտողները եզրակացրել են, որ տվյալ փուլում պաշտպանական մեխանիզմները բավարար չափով ամուր են։ Սակայն այդ եզրակացությունը, ըստ նույն աղբյուրների, չի նշանակում, թե վերահսկողությունը ավարտված է։
Այս զարգացումը կարևոր է ոչ միայն Anthropic-ի, այլև ամբողջ ոլորտի համար, քանի որ ԱՄՆ իշխանությունները վերջին ամիսներին ավելի կոշտ են մոտենում առաջադեմ մոդելների անվտանգության հարցին։ Ընկերությունների համար սա նշանակում է, որ նոր սերնդի համակարգերը շուկա վերադարձնելու ճանապարհին անհրաժեշտ է ոչ միայն տեխնիկական հզորություն, այլև կարգավորող մարմինների վստահություն։
Աղբյուր՝ Wired