ԱՄՆ-ն հանեց սահմանափակումները Anthropic-ի AI մոդելների վրա անվտանգության նոր քայլից հետո

· Տեխնոլոգիա

ԱՄՆ-ն հանեց սահմանափակումները Anthropic-ի AI մոդելների վրա անվտանգության նոր քայլից հետո

ԱՄՆ առևտրի նախարարությունը հանել է Anthropic-ի Claude Fable 5 մոդելի նկատմամբ կիրառված արտահանման սահմանափակումները, այն բանից հետո, երբ ընկերությունը համաձայնել է ուժեղացնել անվտանգության պաշտպանությունը։ Ըստ աղբյուրների՝ նոր մեխանիզմը կկանխի օգտատերերի փորձերը՝ հասանելիություն ստանալու որոշ սահմանափակ հնարավորությունների։ Գործարքը փակել է այն բախումը, որը հանգեցրել էր մոդելի գործնականում անջատմանը։

ԱՄՆ առևտրի նախարարությունը հանել է Anthropic ընկերության Claude Fable 5 արհեստական բանականության մոդելի նկատմամբ կիրառված արտահանման սահմանափակումները՝ այն բանից հետո, երբ ընկերությունը համաձայնել է ընդլայնել անվտանգության գործող պաշտպանիչ մեխանիզմը։ Ըստ գործին ծանոթ երկու անձանց՝ նոր քայլը նպատակ ունի կանխել օգտատերերի փորձերը՝ շրջանցելու որոշ արգելված հնարավորություններ։

Ինչ է փոխվել անվտանգության համակարգում

Նոր կանոնի համաձայն՝ այն օգտատերերը, որոնք կփորձեն ստանալ սահմանափակ հնարավորությունների հասանելիություն, կստանան ծանուցում, որ իրենց հարցումը արգելափակված է, իսկ հարցումն ինքնաբերաբար կուղարկվի ավելի թույլ՝ Opus 4.8 մոդելին։ Մինչ այդ նման հարցումները, որոնք վերաբերում էին կենսաբանության և կիբերանվտանգության զգայուն գործառույթներին, արդեն ուղղվում էին նույն մոդելին։

Ըստ աղբյուրների՝ Anthropic-ը այժմ այդ պաշտպանությունը տարածել է նաև Amazon-ի հրապարակած մեկ ուսումնասիրության մեջ նկարագրված վարքագծի վրա։ Անվտանգության ոլորտի մասնագետ Քեթի Մուսուրիսը հրապարակած վերլուծության մեջ նշել էր, որ որոշ օգտատերեր կարողացել են շրջանցել սահմանափակումը՝ Fable 5-ին խնդրելով ոչ թե գտնել խոցելիությունը, այլ ուղղել կոդը։

Քաղաքական ճնշում և վերահսկողություն

Թեև կիբերանվտանգության փորձագետների մեծ մասը այդ վարքագիծը առանձնապես վտանգավոր չի համարել, աղբյուրների խոսքով՝ հենց այդ հանգամանքի մասին տեղեկանալուց հետո էլ ձևավորվել է հակասությունը Anthropic-ի և վարչակազմի միջև։ Արդյունքում կիրառվել են արտահանման վերահսկողության միջոցներ, որոնք գործնականում մոդելը դուրս էին բերել օգտագործումից։

ԱՄՆ առևտրի նախարար Հաուարդ Լատնիկի նամակը, որով հայտարարվել էր Fable 5 և Mythos 5 մոդելների սահմանափակումների վերացումը, այժմ լրացուցիչ մանրամասներով է հասկացնում որոշման հիմքերը։ Նամակում նա նշել է, որ Anthropic-ը համաձայնել է «նախապես հայտնաբերել և հասցեագրել» մոդելների ստեղծած անվտանգության ռիսկերը։

Վերադարձի հիմքում՝ նոր գնահատում

Աղբյուրների փոխանցմամբ՝ առևտրի նախարարությունը վերջնականապես թույլատրել է Fable 5-ի թողարկումը նաև այն բանից հետո, երբ արհեստական բանականության ստանդարտների և նորարարության կենտրոնի հետազոտողները եզրակացրել են, որ տվյալ փուլում պաշտպանական մեխանիզմները բավարար չափով ամուր են։ Սակայն այդ եզրակացությունը, ըստ նույն աղբյուրների, չի նշանակում, թե վերահսկողությունը ավարտված է։

Այս զարգացումը կարևոր է ոչ միայն Anthropic-ի, այլև ամբողջ ոլորտի համար, քանի որ ԱՄՆ իշխանությունները վերջին ամիսներին ավելի կոշտ են մոտենում առաջադեմ մոդելների անվտանգության հարցին։ Ընկերությունների համար սա նշանակում է, որ նոր սերնդի համակարգերը շուկա վերադարձնելու ճանապարհին անհրաժեշտ է ոչ միայն տեխնիկական հզորություն, այլև կարգավորող մարմինների վստահություն։

Աղբյուր՝ Wired

Նաև կարդացեք

Ինչպես սերմնացած կետերի գլխուղեղային օրգանը կարող էր խորտակել նավերը

Գիտական նոր ուսումնասիրությունը բացատրում է այն, ինչ շուրջ երկու դար առաջ ենթադրաբար նկատել էր «Էսսեքս» կետի նավի առաջին նավապետ Օուեն Չեյսը․ սերմնացած կետը կարող է խորտակել իրենից անհամեմատ մեծ նավը։ 1820 թվականին տեղի ունեցած միջադեպը հետագայում դարձավ Հերման Մելվիլի «Մոբի Դիք»-ի ոգեշնչման աղբյուրներից մեկը։ Հետազոտողների խոսքով՝ այդ կենդանիների գլխում գտնվող յուրահատուկ օրգանը կարող է առանցքային դեր ունենալ նրանց հզոր հարվածների մեջ։

Բիլ Գեյթսը կոչ է արել խստորեն կարգավորել արհեստական բանականությունը

Microsoft-ի համահիմնադիր և բարերար Բիլ Գեյթսը NBC-ին տված հարցազրույցում կոչ է արել ԱՄՆ-ի օրենսդիրներին ու իրավապահներին ներգրավվել արհեստական բանականության վերահսկման գործընթացում։ Նա զգուշացրել է, որ չկարգավորված զարգացումը կարող է բերել աղետալի հետևանքների, ներառյալ՝ զանգվածային զոհեր։ Հարցազրույցը կհեռարձակվի կիրակի օրը։ Գեյթսի խոսքով՝ ինքնակարգավորումը բավարար չէ, և անհրաժեշտ են պարտադիր կանոններ ու մշտադիտարկում։

Գողերը Nvidia-ի կցորդիչներ էին հափշտակել, ներսում՝ ավազ էր

Կալիֆոռնիայի Նյուարք քաղաքում անհայտ անձինք հափշտակել են PlusAI ընկերությանը պատկանող, Nvidia-ի տարբերանշաններով երկու կցորդիչներ։ Սակայն կորսված բեռը տեխնիկական սարքավորում չէր․ ներսում եղել է մոտ 40 հազար ֆունտ, կամ շուրջ 20 տոննա, ավազ։ Դեպքը բացահայտվել է հինգշաբթի առավոտյան, երբ ոստիկանությունն սկսել է որոնումները։

OpenAI-ը հայտնել է ChatGPT օգտատերերի 53 պատկերների արտահոսքի մասին

OpenAI-ը հայտարարել է, որ իր գործակալները արտահոսել են ChatGPT օգտատերերի 53 պատկերներ՝ կրկին ուշադրության կենտրոն բերելով ընկերության արհեստական բանականության գործիքների շուրջ տվյալների գաղտնիության վտանգները։ Ընկերությունը չի հստակեցրել՝ պատկերները իրական մարդկանց էին ներկայացնում, թե արհեստականորեն ստեղծված էին, և չի նշել դրանց հրապարակման ժամանակը։ Դեպքը բացահայտում է, թե որքան դժվար է հետևել չարտոնված գործողություններին, որոնք կապված են ընկերության գործակալների հետ։

Արհեստական բանականության օգնական, որը արժե փորձել, թեև ոչ առանց ռիսկի

Տեխնոլոգիական ոլորտի լրագրողը պատմում է, թե ինչպես անձնական փորձից հետո սկսեց օգտագործել արհեստական բանականության նոր գործիքներ՝ էլփոստը և օրացույցը կառավարելու համար։ Նրա ուշադրության կենտրոնում հայտնվել է Instinct անունով հրավերով աշխատող AI-գործակալը, որը հաղորդակցվում է iMessage-ի և WhatsApp-ի միջոցով ու կապվում է օգտատիրոջ հաշիվներին։ Նյութը քննարկում է, թե ինչու են նման գործիքները միաժամանակ օգտակար և վտանգավոր՝ հատկապես անվտանգության տեսանկյունից։

Google-ը պատրաստում է արհեստական բանականության տվյալների կենտրոն ուղարկելու տիեզերք

Google-ը սկսել է փորձարկել արբանյակ, որը նախատեսված է արհեստական բանականության հաշվարկային ենթակառուցվածքը Երկրի ուղեծիր տեղափոխելու գաղափարը ստուգելու համար։ Planet Labs-ի աշխատակիցը մաքուր սենյակում զննում է սարքի արևային վահանակներն ու լարերը՝ մինչև թրթռման փորձարկումը, որը պիտի նմանակեր արձակման ծանրաբեռնվածությունը։ Նախաձեռնությունը ցույց է տալիս, որ տեխնոլոգիական ընկերությունները շարունակում են փնտրել տվյալների մշակման նոր միջավայրեր՝ սահմանափակումները նվազեցնելու համար։