Qwen-ը ներկայացրել է FP8 Qwen3.8-2.4T-A95B չեքփոյնթը և պարտադիր տրամաբանման ռեժիմը
Qwen-ի մոդելի քարտը փաստագրում է Transformers ձևաչափով FP8 չեքփոյնթ Qwen3.8-2.4T-A95B-ի համար՝ նշելով սպասարկման տարբերակներ և պարտադիր տրամաբանման ռեժիմ: Այն չի տրամադրում ռեսուրսների պահանջները, լիցենզիայի պայմանները, մուտքի հասանելիությունը կամ անկախ թեստերի արդյունքները, որոնք անհրաժեշտ են արտադրական պատրաստվածությունը հաստատելու համար: [1]
Այս թողարկումն անցել է «Իմանանք»-ի հրապարակման ընդլայնված ստուգումները: Որոշ էական պնդումներ շարունակում են հստակ վերագրվել պաշտոնական կամ ընկերության աղբյուրներին, քանի որ այս թողարկմանը դեռ անկախ աղբյուր կցված չէ: Համակարգը շարունակում է ստուգել հաստատված աղբյուրները և անկախ հաստատումը կավելացնի միայն ամբողջական ստուգում անցած նոր թողարկմամբ:

Hugging Face-ում Qwen-ի քարտը փաստում է նախապես վերապատրաստված Qwen3.8-2.4T-A95B լեզվական մոդելի FP8 տարբերակի մասին՝ հարմարեցված Transformers գրադարանի համար: Որպես սպասարկման հնարավոր տարբերակներ մշակողը նշում է vLLM-ը, SGLang-ը և TokenSpeed-ը՝ միաժամանակ արձանագրելով կարևոր սահմանափակումներ. այս չեքփոյնթը գործում է միայն տեքստային ռեժիմում, պահանջում է պարտադիր տրամաբանման փուլ, որը հնարավոր չէ անջատել: [1]
01
02
Ռեպոզիտորիայի ձևաչափն ըստ Qwen-ի
Հեղինակը նշում է, որ ռեպոզիտորիան պարունակում է FP8 քվանտավորված կշիռներ և կոնֆիգուրացիոն ֆայլեր Hugging Face Transformers ձևաչափով:Մոդելի ծավալն ըստ քարտի
Qwen-ը նշում է ընդհանուր 2.4 տրիլիոն պարամետր և 95 միլիարդ ակտիվացված պարամետր:Ներքին կոնտեքստի չափն ըստ քարտի
Qwen-ը նշում է 262,144 թոքեն ներքին կոնտեքստ և հավելում, որ այն կարող է ընդլայնվել մինչև 1,010,000-ի:Մուտքային տվյալների և տրամաբանման սահմանափակում
Քարտում չեքփոյնթը նկարագրվում է որպես բացառապես տեքստային, իսկ «մտածելու» փուլը պարտադիր է յուրաքանչյուր փոխազդեցության համար:Ներկայացված բոլոր տեխնիկական բնութագրերը վերցված են Qwen-ի մոդելի քարտից և տրամադրված աղբյուրներում անկախ ստուգում չեն անցել: [1]
03
Ինչ է հրապարակվել
Հասանելի առաջնային աղբյուրը Qwen-ի սեփական Hugging Face մոդելի քարտն է՝ Qwen3.8-2.4T-A95B-FP8-ի համար: Այն փաստում է, որ Qwen-ը հանրային ռեպոզիտորիայում ներկայացրել է FP8 չեքփոյնթը և դրա կոնֆիգուրացիան: Ֆայլերի ամբողջականությունը, ներբեռնման պայմաններն ու գործնական կիրառելիությունը տրամադրված նյութերում անկախ կերպով ստուգված չեն: [1]
- Qwen-ը նշում է, որ ռեպոզիտորիան պարունակում է վերապատրաստված Qwen3.8-2.4T-A95B մոդելի FP8 քվանտավորված կշիռներն ու կոնֆիգուրացիոն ֆայլերը՝ Hugging Face Transformers ձևաչափով:
- Քարտում այն ներկայացվում է որպես պատճառահետևանքային (causal) լեզվական մոդել՝ ընդհանուր 2.4 տրիլիոն պարամետրով, 95 միլիարդ ակտիվացված պարամետրով և ներքին 262,144 թոքեն կոնտեքստով: Qwen-ը նշում է, որ կոնտեքստը կարող է ընդլայնվել մինչև 1,010,000 թոքեն:
- Ռեպոզիտորիայի գրանցումը ստեղծվել է 2026 թվականի օգոստոսի 8-ին, իսկ բուն քարտում թողարկման հստակ ամսաթիվ նշված չէ: [1]
04
Գործարկման ուղին. փաստագրված տարբերակներ, ոչ թե ստուգված հզորություններ
Քարտը ներկայացնում է գործարկման եղանակներ նշված ֆրեյմվորքերի միջոցով, սակայն չի հստակեցնում այս 2.4T պարամետր ունեցող մոդելի համար անհրաժեշտ արագացուցիչները (accelerators), հիշողության ծավալը, սկավառակային տարածքը, զուգահեռականությունը, թողունակությունը կամ ծախսերը: Ուստի մասնագետները պետք է ֆրեյմվորքերի աջակցությունն ու FP8-ի հարաբերական արդյունավետությունը դիտարկեն որպես հեղինակի տրամադրած տվյալներ, որոնք ենթակա են ստուգման սեփական աշխատանքային միջավայրում: [1]
- Qwen-ը որպես համատեղելի սպասարկման միջավայրեր նշում է vLLM-ը, SGLang-ը և TokenSpeed-ը՝ կցելով համապատասխան հրահանգներ կամ փաստաթղթեր:
- Մշակողը նշում է, որ FP8 մանրակրկիտ մեթոդն օգտագործում է 128 չափի բլոկներ և պնդում է, որ արդյունքները գրեթե նույնական են օրիգինալ մոդելին:
- Qwen-ը խորհուրդ է տալիս օգտագործել ֆրեյմվորքերի թարմ տարբերակները և ընդգծում է, որ ինֆերենսի արդյունավետությունն ու թողունակությունը կարող են էապես տարբերվել՝ կախված ընտրված գործիքից: [1]
05
Օգտագործման սահմանափակումներ և ինտեգրման առանձնահատկություններ
Պարտադիր տրամաբանման գործընթացը էական ինտեգրացիոն սահմանափակում է: Հավելվածները պետք է պատրաստ լինեն ընդունելու և մշակելու դատողությունների հատվածը նախքան վերջնական բովանդակությունը, ոչ թե ակնկալեն միայն պատրաստի պատասխանի ձևաչափ: Մոդելի քարտում ներկայացված են նաև սեմփլինգի առաջարկվող կարգավորումներ, որոնք, սակայն, Qwen-ի առաջարկություններն են և ոչ թե անկախ հաստատված պահանջներ: [1]
- Ըստ քարտի՝ հասանելի է միայն տեքստային մուտքագրում. մուլտիմոդալ մուտքագրումը չի աջակցվում:
- Տրամաբանման (thinking) ռեժիմը պարտադիր է բոլոր փոխազդեցությունների համար և չի կարող անջատվել: Քարտում նշվում է, որ պատասխաններն ավտոմատ կերպով սկսվում են դատողությունների փուլով՝ նախքան վերջնական ելքը:
- Qwen-ը փաստագրում է տրամաբանման ջանքերի (reasoning effort) երեք մակարդակ՝ xhigh, medium և low: Նշվում է, որ xhigh-ը և preserve_thinking-ը միացված են լռելյայն:
- Քարտում ընդգծվում է, որ պարամետրերի աջակցությունը կարող է տարբերվել՝ կախված ինֆերենսի ֆրեյմվորքից: [1]
06
Փաստերի սահմանները
Qwen-ի քարտը տրամադրված միակ առաջնային աղբյուրն է: Այն թույլ է տալիս արձանագրել, թե ինչ է հրապարակել և հայտարարել Qwen-ը չեքփոյնթի մասին, սակայն անկախ կերպով չի ապացուցում նշված արդյունավետությունը, գործառնական համատեղելիությունը, ռեսուրսների պահանջները կամ մուտքի պայմանները: [1]
- Մոդելի քարտն ու առաջնային աղբյուրը հասանելի են հետևյալ հասցեով՝ https://huggingface.co/Qwen/Qwen3.8-2.4T-A95B-FP8:
- Քարտում ներկայացված Qwen3.8-Max-ի արդյունավետության աղյուսակը չպետք է դիտարկվի որպես այս FP8 չեքփոյնթի անկախ գնահատական:
- Գործնական կիրառությունից առաջ անհրաժեշտ է ստուգել լիցենզիայի բուն ֆայլն ու ռեպոզիտորիայի մուտքի ընթացիկ պայմանները: [1]
07
Ինչ ստուգել նախքան գործարկումը
Մոդելի քարտը նախնական պատկերացում է տալիս գնահատման համար, սակայն շահագործման ամբողջական տեխնիկական բնութագիր չէ: [1]
- 01
Ստուգել ռեպոզիտորիայի հասանելիությունն ու ֆայլերի առկայությունը. տրամադրված տվյալներում նշված չէ՝ մուտքը սահմանափակված է հատուկ թույլտվությամբ, թե ոչ: [1]
- 02
Օգտագործելուց առաջ ուղղակիորեն ծանոթանալ կցված լիցենզիային, հատկապես առևտրային նպատակներով կամ վերաբաշխման դեպքում. դրա պայմանները ներառված չեն աղբյուրում: [1]
- 03
Ստուգել չեքփոյնթը նախատեսված ֆրեյմվորքում և սարքակազմի (hardware) վրա: Qwen-ը նշում է vLLM, SGLang և TokenSpeed գործիքները, սակայն անկախ համատեղելիության թեստեր կամ ռեսուրսների պահանջներ չեն տրամադրվել: [1]
- 04
Հաշվի առնել, որ հարցումները պետք է լինեն միայն տեքստային, և նախատեսել տրամաբանման (reasoning) ելքային հոսքի պահպանումը. ըստ քարտի՝ «մտածելու» ռեժիմը պարտադիր է և չի կարող անջատվել: [1]
08
Այս թողարկման սահմանափակումները
Տրամադրված առաջնային աղբյուրում բացակայում են սարքակազմի, օպերատիվ հիշողության, սկավառակային տարածքի կամ թողունակության պահանջները: [1]
Արտադրողականության կամ ֆրեյմվորքերի համատեղելիության անկախ վերահսկվող գնահատում չի տրամադրվել: Qwen-ի պնդումը, թե FP8-ի արդյունքները գրեթե նույնական են օրիգինալ մոդելին, մնում է միայն հեղինակի հայտարարություն: [1]
Լիցենզիայի տեքստը ներառված չէ, ուստի այս փաթեթի հիման վրա հնարավոր չէ հաստատել թույլտվությունները, սահմանափակումները կամ առևտրային օգտագործման պայմանները: [1]
Քարտի արդյունավետության աղյուսակում ներկայացված են Qwen3.8-Max-ի ցուցանիշները, ոչ թե անպայման այս FP8 ռեպոզիտորիայի. տրամադրված նյութերը չեն հաստատում այդ արդյունքների ուղղակի կիրառելիությունը: [1]
Ռեպոզիտորիայի հասանելիության պայմանները, այդ թվում՝ հատուկ թույլտվության կամ հաստատման անհրաժեշտությունը, աղբյուրում նշված չեն: [1]
SRC
Աղբյուրների բաժին
Ուղիղ հղումներ այս ընտրանու հիմքում եղած նյութերին: Աղբյուրը տեսնելը նույնքան կարևոր է, որքան սինթեզն ընթերցելը:


