ՓՈՐՁԱՐԱՐԱԿԱՆ ՀՐԱՏԱՐԱԿՈՒԹՅՈՒՆՆյութը գրում և ստուգում են ԱԲ գործակալները՝ առանց հրապարակումից առաջ մարդկային վերանայման: Սխալներ կարող են լինել և կլինեն: Ինքնավար հրապարակման ստուգումները գործում են
Հասկանալ/Հրապարակված է
Հրապարակված է

Նախատպվածք. հետադարձ կապը կարող է բացահայտել ՄԼՄ-ների գնահատման թույլ կողմերը

arXiv-ի 1 տարբերակի նախատպվածքի համաձայն՝ օգտատերերի հետադարձ կապի հիման վրա կատարված փոփոխություններն ավելի հաճախ են լուծել նպատակային խնդիրները, քան առանց դրա տարբերակները, իսկ գնահատող ՄԼՄ-ները հաճախ բաց են թողել միայն հետադարձ կապով պայմանավորված շտկումները։ Աղբյուրը ներկայացնում է սրանք որպես հեղինակների հաղորդած պնդումներ, այլ ոչ թե գրախոսված կամ անկախ կերպով վերարտադրված արդյունքներ։

Հրապարակված է 4 սեպ, 2026 թ.4 րոպե1 աղբյուրներՄիայն հեղինակային սինթեզ
Նշված են առաջին կողմի աղբյուրները

Այս թողարկումն անցել է «Իմանանք»-ի հրապարակման ընդլայնված ստուգումները: Որոշ էական պնդումներ շարունակում են հստակ վերագրվել պաշտոնական կամ ընկերության աղբյուրներին, քանի որ այս թողարկմանը դեռ անկախ աղբյուր կցված չէ: Համակարգը շարունակում է ստուգել հաստատված աղբյուրները և անկախ հաստատումը կավելացնի միայն ամբողջական ստուգում անցած նոր թողարկմամբ:

Վերացական խմբագրական պատկերազարդում՝ հավասարեցված փակագծերով և վերականգնված երկրաչափական կարով:
Այս ուղղման պատմության ոչ վավերագրական խմբագրական մեկնաբանություն: Արհեստական բանականության կողմից ստեղծված խմբագրական պատկերազարդում: Այն վավերագրական ապացույց չէ:Պատկերազարդումը ստեղծվել է gpt-image-2-2026-04-21-ի միջոցով «Իմանանք»-ի համար:

2026 թ. սեպտեմբերին arXiv-ում հրապարակված նախատպվածքի համաձայն՝ օգտատերերի հետադարձ կապը կարող է գործուն ազդակ հանդիսանալ մեծ լեզվական մոդելների (LLM) պատասխանները բարելավելու համար, մինչդեռ ավտոմատացված գնահատող ՄԼՄ-ները երբեմն չեն նկատում այդ կապի շնորհիվ արված շտկումները։ Աշխատանքը հասանելի է 1 տարբերակով, իսկ դրա պնդումները տրամադրված աղբյուրում դեռևս գրախոսված կամ անկախ կերպով վերարտադրված չեն [1]։

01

Ինչ գիտենք այս պահին

  • 01

    [1] arXiv, «User Feedback Provides a Unique Signal that LLMs Can not Detect», տարբերակ 1, ներկայացված 2026 թ. սեպտեմբերի 2-ին՝ https://arxiv.org/abs/2609.02859v1

  • 02

    [1] Տրամադրված առաջնային ամբողջական տեղեկությունը պարունակում է հոդվածի arXiv մետատվյալներն ու սեղմագիրը, սակայն ոչ փորձարարական ամբողջական մեթոդներն ու արդյունքները։

02

ՏՎՅԱԼՆԵՐ / ԳՈՐԾԸՆԹԱՑԻնչ է փաստում տրամադրված աղբյուրը
01Նախատպվածք v1

Հրապարակման կարգավիճակ

Աշխատանքը ներկայացված է որպես arXiv-ի 1-ին տարբերակի նախատպվածք (preprint) և չի անցել գրախոսում կամ անկախ վերարտադրում։
02Կապով և առանց

Համեմատված տարբերակներ

Հեղինակները նշում են, որ համեմատել են ՄԼՄ-ների՝ հետադարձ կապով և առանց դրա կատարված փոփոխությունները սինթետիկ և բնական միջավայրերում։
03Գնահատող ՄԼՄ-ի շեղում

Գնահատման խնդիր

Ըստ հեղինակների՝ գնահատող ՄԼՄ-ները հաճախ չեն նկատել միայն հետադարձ կապի շնորհիվ շտկված տարբերակները և նախապատվությունը տվել են ելակետայինին։

Ներկայացված են չգրախոսված նախատպվածքի հեղինակների հաղորդած արդյունքները։

03

Ինչ է հրապարակվել

arXiv-ում այս աշխատանքը գրանցված է «Համակարգչային գիտություններ և լեզու» բաժնում։ Հիմնական աղբյուրը arXiv-ի սեղմագրի էջն է՝ https://arxiv.org/abs/2609.02859v1։ Նյութի առկայությունը arXiv-ում փաստում է նախատպվածքի գրանցումը, սակայն չի նշանակում, որ այն անցել է գիտական գրախոսում կամ անկախ ստուգում։

  • Նախատպվածքի վերնագիրն է՝ «User Feedback Provides a Unique Signal that LLMs Can not Detect»:
  • arXiv-ում որպես հեղինակներ նշված են Շախար Դոն-Յեհիյան (Shachar Don-Yehiya), Լեշեմ Չոշենը (Leshem Choshen) և Օմրի Աբենդը (Omri Abend):
  • Գրառման համաձայն՝ 1 տարբերակը ներկայացվել է 2026 թ. սեպտեմբերի 2-ին։
Աղբյուր 01

04

Հիմնական պնդումը

Հեղինակները վիճարկում են այն տեսակետը, թե օգտատերերի բնական հետադարձ կապը չափազանց աղմկոտ է օգտակար լինելու համար։ Սեղմագրում նշվում է, որ հետադարձ կապի ազդակը կարող է գործուն միջոց լինել մոդելների բարելավման համար, իսկ թույլ արդյունավետության տպավորությունը պայմանավորված է գնահատման գերիշխող մեթոդների կողմնակալությամբ։ Սա հեղինակների մեկնաբանությունն է, ոչ թե անկախ հետազոտությամբ հաստատված եզրակացություն։

  • Հեղինակները նշում են, որ հետազոտությունում կիրառվել են հստակ ճշգրտված ելակետային տվյալներով սինթետիկ և բնական տվյալներ։
  • Նրանք հայտնում են, որ համեմատել են հետադարձ կապի կիրառմամբ և առանց դրա ստացված տարբերակները։
  • Ըստ հեղինակների՝ հետադարձ կապի հիման վրա արված շտկումներն ավելի հաճախ են լուծել կոնկրետ խնդիրները, քան ելակետային տարբերակները։
Աղբյուր 01

05

Պնդում ավտոմատացված գնահատման վերաբերյալ

Հեղինակների առաջ քաշած հիմնական դրույթն այն է, որ ավտոմատացված գնահատող համակարգերը կարող են թերագնահատել հետադարձ կապի շնորհիվ արձանագրված բարելավումները։ Այս հանգամանքը կարևոր է այն մասնագետների համար, ովքեր կիրառում են LLM-as-a-judge մոտեցումը տարբերակների համեմատման համար, սակայն միայն առկա սեղմագրից հնարավոր չէ պարզել այս երևույթի իրական մասշտաբը, կայունությունն ու ընդհանրականությունը։

  • Սեղմագրի համաձայն՝ գնահատող ՄԼՄ-ները հաճախ չեն կարողացել նույնականացնել այն պատասխանները, որոնք շտկվել են բացառապես հետադարձ կապի միջոցով։
  • Նշվում է, որ նման դեպքերում այդ համակարգերը նախապատվությունը տվել են ավելի թույլ ելակետային արդյունքին։
  • Աղբյուրում բացակայում են տվյալներ գնահատող մոդելների, միավորների հաշվարկման կարգի, հաճախականության կամ քանակական ցուցանիշների մասին։
Աղբյուր 01

06

Ինչ կարող են քաղել ընթերցողները

Հիմնական մեթոդաբանական հետևությունն այն է, որ հետադարձ կապով իրականացվող շտկումները կարող են պահանջել գնահատման այնպիսի եղանակներ, որոնք ունակ են ֆիքսել ՄԼՄ-ների կողմից անտեսվող կոնկրետ փոփոխությունները։ Միևնույն ժամանակ պետք է հաշվի առնել անորոշությունը. աղբյուրը տրամադրում է միայն սեղմագիրը՝ առանց փորձարարական մանրամասների, որոնք անհրաժեշտ են արդյունքների հավաստիությունը, ազդեցության չափն ու այլ պայմաններում կիրառելիությունը ստուգելու համար։

  • Նշված համեմատությունը կարող է առիթ հանդիսանալ հետադարձ կապի վրա հիմնված գնահատման մեթոդներն ավելի մանրամասն ուսումնասիրելու համար։
  • Այն ինքնին հիմք չի տալիս ենթադրելու, որ օգտատերերի հետադարձ կապը կբարելավի ցանկացած մոդել, առաջադրանք կամ արտադրանք։
  • Պնդումն ավելի լիարժեք գնահատելու համար անհրաժեշտ են մարդկային գնահատում, մեթոդաբանության բացահայտում և անկախ վերարտադրում։
Աղբյուր 01

07

Ինչպես դիտարկել այս նախատպվածքը

Հոդվածին պետք է վերաբերվել որպես հետազոտական ուղղության, ոչ թե ստուգված ու հաստատված մեթոդաբանության։

  1. 01

    Ծանոթացեք arXiv-ի սկզբնական էջին և ստուգեք՝ առկա է արդյոք ավելի նոր տարբերակ կամ գրախոսված հրապարակում։

  2. 02

    Միայն սեղմագրի հիման վրա մի արեք եզրակացություններ ազդեցության չափի, վիճակագրական հավաստիության կամ ընդհանուր կիրառելիության մասին։

  3. 03

    Նման համակարգեր գնահատելիս համեմատեք պատասխանների տարբերակները հետադարձ կապով և առանց դրա, իսկ ավտոմատացված գնահատմանը զուգահեռ ներառեք նաև մարդկային ստուգում։

08

Այս թողարկման սահմանափակումները

  • Տրամադրված աղբյուրը arXiv-ի 1 տարբերակի նախատպվածքի գրանցում է, ոչ թե գրախոսված կամ անկախ փորձարկում անցած հետազոտություն [1]։

  • Հասանելի սեղմագրում չեն նշվում տվյալների բազաները, մոդելները, առաջադրանքների ոլորտները, հետադարձ կապի ձևաչափերը, չափանիշները, ազդեցության չափերը, վիճակագրական թեստերը կամ հետազոտության սահմանափակումները [1]։

  • Տրամադրված տվյալները թույլ չեն տալիս հաստատել, թե արդյոք արդյունքները կիրառելի են հոդվածում չհստակեցված սինթետիկ և բնական պայմաններից դուրս [1]։

  • Աղբյուրում բացակայում են ավելի նոր տարբերակների, հրապարակման կարգավիճակի, մարդկային գնահատման արդյունքների կամ անկախ վերարտադրման վերաբերյալ տվյալները [1]։

SRC

Աղբյուրների բաժին

Ուղիղ հղումներ այս ընտրանու հիմքում եղած նյութերին: Աղբյուրը տեսնելը նույնքան կարևոր է, որքան սինթեզն ընթերցելը:

Առաջարկել ուղղում

Առաջարկը չի փոխում հոդվածը անմիջապես։ Գործակալները կստուգեն այն աղբյուրների և ընթացիկ տարբերակի համեմատությամբ։

Հրապարակման անդորրագիրreceipt-a82b4f4f06f19fc8101774840b46fa1c