Թարմացվող ուղեցույց
ԱԲ գործակալներ. խոստումներից դեպի պատասխանատու աշխատանք
Գործակալների կառուցվածքի, դրանց խափանման տարբերակների և վերահսկողության այն մեխանիզմների պարզ բացատրությունը, որոնք պատվիրակված աշխատանքը դարձնում են դիտարկելի և հետշրջելի:
Արհեստական բանականության գործակալը պարզապես ընդարձակ հուշումով (prompt) չաթբոտ չէ: Այն համակարգ է, որը կարող է գնահատել վիճակը, ընտրել քայլեր, կիրառել գործիքներ և շարժվել դեպի նպատակը: Այս լրացուցիչ կարողությունների պատճառով սահմանները, հավաստի փաստերը և համակարգի վերականգնումը դառնում են արտադրանքի հիմնական բաղադրիչներ, այլ ոչ թե ձևական վարչարարություն:
01
Ինչ գիտենք այս պահին
- 01
NIST-ը AI ռիսկերի կառավարումը կազմակերպում է Govern, Map, Measure և Manage գործառույթների շուրջ:
- 02
Գործիքների հասանելիությունը տալիս է տեխնիկական կարողություն, բայց չի հաստատում, որ առաջարկվող քայլը ճիշտ է կամ լիազորված:
- 03
Գործնական համակարգերն առանձնացնում են պլանավորումը, կատարումը, փաստերի ստուգումն ու հրապարակման իրավասությունը:
02
Ինչու է սա կարևոր Հայաստանի համար
Փոքր թիմերը կարող են էապես մեծացնել իրենց արտադրողականությունը գործակալների (agents) միջոցով, սակայն միայն այն դեպքում, երբ համակարգն ունի հստակ սահմանված մանդատ, նվազագույն արտոնություններով գործիքներ, տեսանելի փաստեր և աշխատանքի դադարեցման հուսալի մեխանիզմ:
03
դիտարկում
կարդալ վստահելի վիճակն ու փաստերըառաջարկ
ընտրել հաջորդ սահմանափակ քայլըլիազորում
ստուգել շրջանակն ու հնարավոր հետևանքներըգործողություն
կիրառել նվազագույն արտոնությամբ գործիքըստուգում
ուսումնասիրել փաստացի արդյունքըգրանցում կամ կանգ
պահպանել վիճակը, մեկուսացնել կամ ավարտելԳործընթացն ապահով է միայն այն դեպքում, երբ յուրաքանչյուր անցում ունի խափանումների կառավարման հստակ ուղի:
04
Գործակալի վեց հիմնական բաղադրիչը
Գործնական գործակալն ունի մանդատ, համատեքստ, որոշումների շրջափուլ, գործիքներ, վիճակ և կանգառի կանոն: Մանդատը սահմանում է թույլատրելի վերջնարդյունքը: Համատեքստը տրամադրում է անհրաժեշտ հրահանգներն ու փաստերը: Շրջափուլն ընտրում է հաջորդ սահմանափակ քայլը: Գործիքներն իրականացնում են գործողությունները: Վիճակն արձանագրում է կատարված փոփոխությունները: Իսկ կանգառի կանոնն ավարտում է աշխատանքը, երբ նպատակին հասել են, ռիսկը մեծացել է կամ բացակայում են բավարար փաստերը:
Մոդելի սահուն պատասխանը կարող է քողարկել այս բաղադրիչներից որևէ մեկի թերությունը: Համակարգը կարող է սխալ մեկնաբանել մանդատը, կարդալ հնացած տվյալներ, կիրառել անդառնալի հետևանքներով գործիք, կորցնել վիճակը կամ շարունակել աշխատանքը լիազորությունների ավարտից հետո: Ուստի պետք է գնահատել ամբողջ աշխատանքային գործընթացը, ոչ թե միայն լեզվական մոդելը:
- Մանդատ՝ թույլատրելի նպատակը և հստակ արգելքները:
- Համատեքստ՝ վստահելի հրահանգներ, աղբյուրներ և ընթացիկ վիճակ:
- Որոշումների շրջափուլ՝ հաջորդ գործողության ընտրության կարգը:
- Գործիքներ՝ խիստ սահմանափակված հնարավորություններ:
- Վիճակ՝ գրանցամատյաններ (logs), տարբերակներ և վերականգնվող կետեր:
- Կանգառի կանոն՝ աշխատանքի ավարտ, կարանտին, ժամանակի սպառում կամ օպերատորի միջամտություն:
05
Թույլտվությունը, ճշգրտությունը և հրապարակումը տարբեր հասկացություններ են
Ֆայլերում գրելու վավեր հավատարմագիրը (credential) համակարգին տալիս է գրելու փորձ կատարելու իրավասություն: Դա չի երաշխավորում, որ գրառումը հաջողվել է, հասել է ճիշտ ֆայլին կամ ապահովել է ճիշտ արդյունք: Նմանապես, հրապարակման հավատարմագիրը ծառայությանը թույլ է տալիս փոխել հանրային վիճակը, բայց չի ապացուցում նյութի ճշգրտությունը: Ճիշտ կառուցվածքի դեպքում լիազորումն ու տեխնիկական հնարավորությունն առանձնացվում են ստուգումից, իսկ հրապարակումը վերահսկողին տրամադրվում են միայն հստակ որոշում կայացնելու համար անհրաժեշտ փաստերը:
Նվազագույն արտոնությունների սկզբունքը սահմանափակում է հնարավոր վնասը, երբ տրամաբանական սխալ է տեղի ունենում: Տվյալներ կարդալու գործիքները չպետք է ինքնաբերաբար վերածվեն փոփոխություններ կատարող գործիքների: Սևագիր կազմող գործակալը չպետք է ունենա հրապարակման կամ տեղակայման (deployment) իրավասություն: Իսկ էական ազդեցություն ունեցող գործողությունները պետք է ունենան հստակ թիրախներ, հնարավորության դեպքում՝ փորձնական գործարկումներ (dry runs), անփոփոխելի գրանցումներ և հետգլորման հստակ ուղի:
- Կարողությունը պատասխանում է հարցին՝ համակարգը կարո՞ղ է գործել:
- Լիազորումը պատասխանում է հարցին՝ այն իրավասո՞ւ է գործել տվյալ տեղում:
- Ստուգումը պատասխանում է հարցին՝ արդյո՞ք փաստերը հիմնավորում են գործողությունը:
- Հրապարակումը պատասխանում է հարցին՝ արդյո՞ք կոնկրետ արդյունքն անցել է բոլոր ստուգիչ փուլերը:
06
Խափանման հինգ տարածված տարբերակ
Գործակալները կարող են կատարելագործել նպատակի ձևակերպումը՝ բաց թողնելով բուն իմաստը, կատարել ներբեռնված տվյալներում թաքնված վնասակար հրահանգներ, կրկնել գործողությունը վիճակի կորստի պատճառով, գործիքի ելքային տվյալներն ընդունել իբրև ճշմարտություն կամ կատարել տեղային իմաստով ճիշտ քայլ, որը խաթարում է ամբողջ համակարգի աշխատանքը: Այս բոլոր խնդիրները կարող են առաջանալ նույնիսկ այն դեպքում, երբ մոդելի պատասխանը լիովին տրամաբանական է թվում:
Վերահսկողությունը պետք է համապատասխանի հնարավոր ռիսկին: Անվստահելի բովանդակությունը պետք է մեկուսացվի հիմնական հրահանգներից: Կրկնվող գործողություններին անհրաժեշտ են իդեմպոտենտության բանալիներ (idempotency keys): Պնդումները պետք է համադրվեն աղբյուրների հետ: Գրելու գործողությունները պահանջում են թիրախի ստուգում և վերականգնման հնարավորություն: Իսկ երկար գործընթացներին անհրաժեշտ են կայուն միջանկյալ կետեր և նոր լիազորում անմիջապես պատասխանատու գործողություն կատարելու պահին:
- Նպատակի շեղում՝ արդյունքի ապահովում սխալ մեկնաբանությամբ:
- Հրահանգների ներարկում (prompt injection)՝ անվստահելի բովանդակությունը փոխում է վարքագիծը:
- Կրկնվող գործողություն՝ վերագործարկման պատճառով արտաքին փոփոխությունը կրկնվում է:
- Փաստերի փոխարինում՝ գործիքի պատասխանն ընդունվում է որպես անառարկելի ապացույց՝ առանց ստուգման:
- Ինտեգրման խափանում՝ առանձին վերցրած ճիշտ քայլը խաթարում է հարակից համակարգերի կապը:
07
Կառավարման շրջափուլը՝ Govern, Map, Measure, Manage
ԱՄՆ Ստանդարտների և տեխնոլոգիաների ազգային ինստիտուտի (NIST) AI Risk Management Framework-ն առաջարկում է աշխատանքի կազմակերպման հարմար մոդել: «Govern» գործառույթը սահմանում է պատասխանատվությունն ու կանոնները: «Map»-ը նկարագրում է կիրառությունը, շահառուներին, միջավայրը և խափանումների հետևանքները: «Measure»-ը փորձարկում է աշխատանքն ու արձանագրում անորոշությունները: Իսկ «Manage»-ն ընտրում է վերահսկողության մեխանիզմները, մշտադիտարկում է համակարգը և արձագանքում շեղումներին:
Փոքր թիմերի դեպքում այս ամենը կարող է տեղավորվել մեկ էջում: Բավական է նշել պատասխանատուին, թվարկել թույլատրելի գործիքները, նկարագրել վատթարագույն հնարավոր սցենարը, ընտրել ստուգման եղանակը, սահմանել կանգառի կանոնն ու պահպանել գրանցումները: Գործընթացը բարդացրեք միայն այն դեպքում, երբ դա պահանջում են հնարավոր հետևանքները:
- Կառավարում (Govern)՝ մեկ պատասխանատու կազմակերպիչ և մանդատի տարբերակների հաշվառում:
- Քարտեզագրում (Map)՝ օգտատերեր, տվյալներ, կախվածություններ և հնարավոր հետևանքներ:
- Չափում (Measure)՝ առաջադրանքների թեստեր, խափանումների քանակ և անորոշության գնահատում:
- Ղեկավարում (Manage)՝ վերահսկողության մեխանիզմներ, մշտադիտարկում, կարանտին և վերականգնում:
08
Նախքան գործակալին գրանցման կամ գրելու (write) գործիք վստահելը
Գործնական առաջին ներդրումը պետք է լինի հստակ սահմանափակված, հեշտ դիտարկելի և արագ չեղարկելի:
- 01
Հստակ և պարզ ձևակերպեք թույլատրելի նպատակն ու արգելված գործողությունները:
- 02
Անջատեք վստահելի հրահանգները համացանցից ստացված կամ օգտատիրոջ փոխանցած բովանդակությունից:
- 03
Սահմանափակեք գործիքները որոշակի ռեսուրսներով, հասցեներով և ծախսերի շեմերով:
- 04
Կրկնվող գործողությունները (retries) դարձրեք իդեմպոտենտ (idempotent) և պահպանեք վիճակի հուսալի կետեր (checkpoints):
- 05
Փորձարկեք համակարգի վարքագիծը խափանումների, չեղարկման, հետգլորման (rollback) և հնացած տվյալների պայմաններում:
- 06
Ցանկացած հետևանք առաջացնող հրապարակումից առաջ պահանջեք թարմ և ստուգված փաստեր:
09
Այս թողարկման սահմանափակումները
NIST-ի շրջանակը կամավոր է և պետք է հարմարեցվի յուրաքանչյուր կոնկրետ միջավայրին:
Ստուգաթերթը չի կարող ամբողջությամբ բացառել մոդելի անորոշությունները կամ ինտեգրման խափանումները:
Այս ուղեցույցը նախատեսված է կազմակերպական սովորական ավտոմատացման, այլ ոչ թե բարձր ռիսկայնություն ունեցող համակարգերի համար:
SRC
Աղբյուրների բաժին
Ուղիղ հղումներ այս ընտրանու հիմքում եղած նյութերին: Աղբյուրը տեսնելը նույնքան կարևոր է, որքան սինթեզն ընթերցելը:
