Պրեպրինտն ուսումնասիրում է խոսքի ճանաչման սխալների ազդեցությունը մարմնավորված AI-ի անվտանգության վրա
arXiv պրեպրինտի հեղինակները նշում են, որ խոսքի ճանաչման մոդելավորված սխալները կարող են մեծացնել ձայնային կառավարմամբ մարմնավորված AI համակարգերի անվտանգության խախտումների հավանականությունը: Նրանք նաև հայտնում են ավտոմատ ուղղման անկայուն արդյունքների մասին: Մանրամասն մեթոդներն ու անկախ ստուգման տվյալները նյութում ներկայացված չեն:
Այս թողարկումն անցել է «Իմանանք»-ի հրապարակման ընդլայնված ստուգումները: Որոշ էական պնդումներ շարունակում են հստակ վերագրվել պաշտոնական կամ ընկերության աղբյուրներին, քանի որ այս թողարկմանը դեռ անկախ աղբյուր կցված չէ: Համակարգը շարունակում է ստուգել հաստատված աղբյուրները և անկախ հաստատումը կավելացնի միայն ամբողջական ստուգում անցած նոր թողարկմամբ:

arXiv-ի նոր պրեպրինտի համաձայն՝ ձայնային հրահանգների տառադարձման ընթացքում թույլ տրված սխալները կարող են փոխել ձայնային կառավարմամբ մարմնավորված AI (embodied AI) համակարգերի անվտանգության վարքագիծը: Հեղինակները նշում են, որ մոդելավորված որոշ սխալներ վնասակար հարցումները դարձրել են ավելի երկիմաստ կամ թուլացրել են մերժման մեխանիզմները, ինչի հետևանքով փորձարկումների ժամանակ գեներացվել և գործարկվել են ոչ անվտանգ ծրագրեր: Սա նախնական աշխատանք է. տրամադրված նյութը պրեպրինտ է և գրախոսման կամ անկախ վերարտադրման մասին փաստեր չի պարունակում [1]:
01
02
Հրապարակման կարգավիճակ
Աշխատանքը arXiv պրեպրինտ է՝ ներկայացված 2026 թ. օգոստոսի 28-ին. տրամադրված տվյալներում գրախոսման առկայությունը հաստատված չէ:Գնահատման մուտքային տվյալներ
Հեղինակները նշում են, որ մոդելավորել են խոսքի ճանաչման սխալները և դրանք համադրել SafeAgentBench ու POEX գնահատման համակարգերի հետ:Ուղղման արդյունք
Ավտոմատ ուղղումը, ըստ հրապարակման, նվազեցրել է ռիսկը որոշ դեպքերում, սակայն ոչ բոլոր իրավիճակներում է արդյունավետ եղել:Ներկայացված եզրակացությունները հեղինակների կողմից սեղմագրում նշված արդյունքներն են, այլ ոչ թե անկախ ստուգման տվյալներ [1]:
03
Ինչ է հրապարակվել
arXiv-ի գրանցումը հաստատում է հետազոտության հրապարակային պրեպրինտի առկայությունը: Այն ինքնին չի հաստատում գրախոսման առկայությունը, արդյունքների վերարտադրելիությունը կամ դրանց անկախ ստուգումը [1]:
- Հետազոտությունը վերնագրված է «When Robots Mishear Us: Mapping the Safety Risks of Voice-Controlled Embodied AI», հեղինակներն են Սիհան Ցզյան (Sihan Jia) և Օլիվեր Լեմոնը (Oliver Lemon):
- Այն ներկայացվել է arXiv 2026 թ. օգոստոսի 28-ին՝ որպես տարբերակ 1:
- Հիմնական գրանցումը հասանելի է https://arxiv.org/abs/2608.28518v1 հասցեով:
04
Ինչ են գնահատել հեղինակները
Ըստ սեղմագրի՝ հետազոտությունն ուսումնասիրում է, թե կարող են արդյոք ձայնի տառադարձման սխալները փոխել մարմնավորված AI համակարգի արձագանքն օգտատիրոջ հրահանգներին: Հեղինակները նշում են, որ իրենց գնահատման ընթացքում որոշ սխալներ հանգեցրել են վնասակար հրահանգների ընդունմանը, ինչպես նաև ոչ անվտանգ ծրագրերի գեներացմանն ու գործարկմանը: Տրամադրված նյութը բավարար մանրամասներ չի պարունակում՝ պարզելու, թե կոնկրետ որ համակարգերն ու սխալների մոդելներն են առաջացրել այդ հետևանքները [1]:
- Հեղինակները նշում են, որ մոդելավորել են օգտատիրոջ մուտքագրած տվյալների խոսքի ավտոմատ ճանաչման (ASR) սխալները:
- Նրանք հայտնում են այդ սխալները SafeAgentBench և POEX անվտանգության թեստերի հետ համադրելու մասին:
- Ըստ հեղինակների՝ որոշ սխալներ պահպանել են իմաստային կառուցվածքը՝ միաժամանակ մեծացնելով վնասակար երկիմաստությունը, իսկ մյուսները թուլացրել են մերժման վարքագիծը:
05
Ուղղումը չի դիտարկվում որպես ամբողջական լուծում
Հետազոտության սեղմագիրը հուշում է, որ տառադարձման սխալների ուղղումը կարող է օգտակար լինել առանձին իրավիճակներում, սակայն հիմք չի տալիս այն դիտարկելու որպես անվտանգության հուսալի և ինքնուրույն վերահսկման մեխանիզմ: Տրամադրված աղբյուրներից հայտնի չեն մնում համապատասխան մեխանիզմները, փորձարկման պայմանները և արձանագրված ազդեցության չափը [1]:
- Նշվում է, որ ավտոմատ ուղղումը որոշ դեպքերում նվազեցրել է ռիսկը:
- Հեղինակները հստակ ընդգծում են, որ այն ոչ միշտ է արդյունավետ եղել:
- Տրամադրված սեղմագրում մեթոդների գործունեության կոնկրետ ցուցանիշներ կամ պայմաններ ներկայացված չեն:
06
Ինչու է սա կարևոր
Ձայնային հրամաններ կատարող համակարգեր մշակողների և հետազոտողների համար այս աշխատանքն ընդգծում է այն տարբերությունը, որն առկա է նախատեսված ձայնային հրահանգի և տառադարձումից հետո համակարգի ստացած փաստացի տեքստի միջև: Թեև սա մեկ պրեպրինտի հեղինակների կողմից ներկայացված սահմանափակ արդյունք է, այն ցույց է տալիս անվտանգության վարքագիծը ոչ միայն անխաթար տեքստերի, այլև աղավաղված ձայնային տառադարձումների պայմաններում ստուգելու կարևորությունը [1]:
- Ձայնային մուտքագրումը կարող է պահանջել անվտանգության առանձին փորձարկումներ՝ ի տարբերություն սովորական տեքստի:
- Տառադարձման մակարդակը կարող է փոխել համակարգի կողմից փաստացի ստացվող հրահանգը:
- Պրեպրինտը հետազոտական նախազգուշացում է, այլ ոչ թե գործարկման ստուգված ստանդարտ:
07
Գործնական եզրակացություններ
Ձայնային կառավարմամբ մարմնավորված AI (embodied AI) համակարգերն ուսումնասիրող թիմերի համար այս պրեպրինտն առաջարկում է տեքստային տառադարձման (transcription) սխալները դիտարկել որպես առանձին գնահատման պայման, այլ ոչ թե ենթադրել, որ միայն տեքստային անվտանգության արդյունքները կարող են տարածվել նաև ձայնային հրահանգների վրա [1]:
- 01
Գնահատման ընթացքում գրանցել խոսքի ճանաչման ստացված ելքային տվյալները՝ նախնական հրահանգի հետ միասին, որպեսզի հնարավոր լինի անվտանգության փոփոխությունները կապել տառադարձման աղավաղումների հետ [1]:
- 02
Հույսը չդնել տառադարձման ավտոմատ ուղղման վրա որպես համընդհանուր պաշտպանական միջոցի. ըստ հեղինակների՝ այն նվազեցրել է հայտնաբերված ռիսկը միայն որոշ դեպքերում [1]:
- 03
Եզրակացությունները համարել նախնական, քանի դեռ հնարավոր չէ գնահատել կամ անկախ կերպով կրկնել հետազոտության մանրամասն մեթոդները, ընդգրկված մոդելները և քանակական արդյունքները [1]:
08
Այս թողարկման սահմանափակումները
Տրամադրված տվյալները չեն նշում փորձարկված մոդելները, սխալների կատեգորիաները, ընտրանքի ծավալները, փորձարկման պարամետրերը կամ քանակական արդյունքները [1]:
Հասանելի չէ տեղեկություն կոդի, տվյալների, prompt-երի կամ գնահատման կարգավորումների մատչելիության վերաբերյալ [1]:
Սեղմագրից պարզ չէ, թե արդյոք այս արդյունքները կիրառելի են իրական պայմաններում կամ այլ ձայնային ու մարմնավորված AI համակարգերի համար [1]:
Նշված արդյունքները հիմնված են հեղինակների հայտարարությունների վրա և տրամադրված աղբյուրներում անկախ կերպով հաստատված չեն [1]:
SRC
Աղբյուրների բաժին
Ուղիղ հղումներ այս ընտրանու հիմքում եղած նյութերին: Աղբյուրը տեսնելը նույնքան կարևոր է, որքան սինթեզն ընթերցելը:


