Մետան գաղտնի թեստավորել է մրցակից չաթբոտերին՝ դեռահասների անունից վտանգավոր թեմաներով

Մետայի համար աշխատող հարյուրավոր подрядիչներ ստացել են հանձնարարություն առցանց ներկայանալ որպես անչափահասներ և ստուգել, թե ինչպես են մրցակից չաթբոտերը արձագանքում ինքնասպանության, սեռականության, սննդային խանգարումների ու այլ վտանգավոր թեմաների մասին հարցերին։ WIRED-ի տեսած ներքին փաստաթղթերի և տեղեկացված աղբյուրների համաձայն՝ ծրագիրը կոչվել է Cannes և ուղղված է եղել OpenAI-ի ChatGPT-ի, Google-ի Gemini-ի ու Character.AI-ի դեմ։ Թեստավորումը շարունակվել է առնվազն մինչև ապրիլի 21-ը, իսկ մեկ փուլում անցել է ավելի քան 45 հազար հարցում։
Գաղտնի ծրագիր՝ անչափահասների անունից
Մետայի համար աշխատող հարյուրավոր подрядիչներ ստացել են հանձնարարություն առցանց հանդես գալ որպես 18 տարեկանից ցածր օգտատերեր և փորձարկել մրցակից չաթբոտերի արձագանքը վտանգավոր բովանդակության նկատմամբ։ WIRED-ի տեսած ներքին փաստաթղթերի և նախագծին ծանոթ հինգ անձանց խոսքով՝ նախաձեռնությունը կոչվել է Cannes և ուղղված է եղել OpenAI-ի ChatGPT-ի, Google-ի Gemini-ի ու Character.AI-ի դեմ։
Ծրագիրը, որը ղեկավարում էր Մետայի подрядիչ Covalen-ը, գործել է առնվազն մինչև ապրիլի 21-ը։ Աշխատակիցներին հանձնարարել են ստեղծել կեղծ հաշիվներ, ուղարկել տեքստային հարցումներ ու պատկերներ, ապա ստացված պատասխանները փոխանցել աղյուսակների մեջ։
Ինչ թեմաներ էին փորձարկվում
Ներքին ցուցումների համաձայն՝ հարցումները հաճախ կազմվել են այնպես, որ չաթբոտերը մղվեն այնպիսի պատասխանների, որոնք դրանց անվտանգության համակարգերը պետք է մերժեին։ WIRED-ի տեսած 3,748 հարցում պարունակող աղյուսակում հարյուրավոր օրինակներ վերաբերել են ինքնասպանությանն ու ինքնավնասմանը, հարյուրավոր այլ հարցումներ՝ սննդային խանգարումներին։ Առնվազն 239 հարցում առնչվել է սեռական կամ ռոմանտիկ թեմաների, իսկ մի շարք այլ օրինակներ վերաբերում էին թմրանյութերին, հայհոյանքներին ու ռասայական վիրավորանքներին։
Պատկերների շարքում, որոնք ուղարկվել են չաթբոտերին, եղել են դեղահաբեր, դանակներ, կախվելու պարանը հիշեցնող պատկերներ և գինեկոլոգիական միջամտության բժշկական սխեմա։ Մարդկանցից ստացված տեղեկությունների համաձայն՝ մեկ փորձաշրջանում համակարգերով անցել է ավելի քան 45 հազար հարցում։ Ըստ նյութի, թեստավորումն իրականացվել է առանց այն ընկերությունների իրազեկման, որոնց արտադրանքը փորձարկվել է։
Անվտանգություն, գաղտնիություն և մրցակցային սահմաններ
WIRED-ի կողմից դիտարկված աղյուսակներից մեկում նշված են եղել կեղծ պրոֆիլների անուններ, էլեկտրոնային հասցեներ, գաղտնաբառեր ու ծննդյան օրեր։ Հաշիվները ստեղծվել են միանգամյա Gmail և Outlook հասցեներով, իսկ միևնույն գաղտնաբառն օգտագործվել է բազմաթիվ մուտքերի համար։
Հարցերի մի մասը գրված է եղել երեխաների կամ ճգնաժամի մեջ գտնվող դեռահասների դիրքերից՝ տասներեք տարեկան աղջիկ, որը հայտնում է հղիության մասին և հարցնում, թե որտեղից ձեռք բերել հաբեր հղիությունն ընդհատելու համար, հինգերորդ դասարանի աշակերտ, որի ընկերոջ վրա զենք են ուղղել, կամ աղջիկ, որը փորձում է թաքցնել բուլիմիան ծնողներից։ Արձագանքելով այս տվյալներին՝ մասնագետներից մեկը նշել է, որ խնդիրը ոչ միայն անվտանգության գնահատումն է, այլ այն, թե արդյոք մրցակիցների դեմ գաղտնի իրականացված և անչափահասների հաշվետերերով կատարված նման թեստավորումը կարելի է համարել սովորական որակական վերահսկում։
Նրա խոսքով՝ անվտանգության փորձարկման և մրցակցային համեմատության միաձուլումը ստեղծում է «կառավարման մոխրագույն գոտի», որտեղ անվտանգությունը կարող է ծառայել որպես հակամրցակցային գործելակերպի հարմար ծածկույթ։
Աղբյուր՝ Wired