skaidrojumi · 6 min · 21.07.2026

Alibaba parāda Qwen3.8 ar 2,4 triljoniem parametru — bez viena testa un bez lejupielādējamiem svariem

Alibaba Qwen komanda 19. jūlijā parādīja Qwen3.8-Max-Preview un nosauca vienu skaitli: 2,4 triljoni parametru. Blakus tam nav neviena publicēta testa rezultāta, nav zināms, cik parametru modelis rēķina uz vienu žetonu, un atvērtos svarus, ko uzņēmums sola, pagaidām nevar lejupielādēt.

Skaitlis ir liels. Ja Alibaba tiešām publicēs šos svarus, tas būtu aptuveni pusotru reizi lielāks par jebkuru līdz šim izlaisto atvērto modeli — līdzšinējais rekordists ir DeepSeek V4 Pro ar 1,6 triljoniem parametru. Modelis parādās divas dienas pēc tam, kad Moonshot AI izlaida Kimi K3 ar 2,8 triljoniem parametru un reāli pieejamiem svariem. Uz šī fona 2,4 triljoni izskatās pēc atbildes konkurentam, nevis pēc gatava produkta.

Ko 2,4 triljoni parametru nepasaka

Qwen3.8 izmanto retinātu ekspertu maisījuma (sparse MoE) arhitektūru, tāpat kā iepriekšējās Qwen3 versijas. Šādā modelī kopējais parametru skaits un tas, cik parametru nostrādā uz katru žetonu, ir divi dažādi skaitļi. Alibaba nosauca tikai pirmo. Aktīvo parametru skaitu un ekspertu konfigurāciju uzņēmums nav atklājis.

Izstrādātājam tas nozīmē vienu praktisku problēmu: bez aktīvo parametru skaita nevar aprēķināt, cik maksās modeļa darbināšana un cik ātri tas atbildēs. DeepSeek V4 Pro pie 1,6 triljoniem kopumā uz vienu žetonu iedarbina aptuveni 3 % parametru — tieši tāpēc tik liels modelis vispār ir izmantojams. Vai Qwen3.8 rīkojas līdzīgi, no publiskās informācijas noskaidrot nevar.

Atšķirība nav teorētiska. Blīvs 2,4 triljonu parametru modelis prasītu vairākus terabaitus videokartes atmiņas tikai svaru glabāšanai un būtu nepraktisks pat lielos datu centros. Retinātais MoE variants glabā visus parametrus, bet rēķina tikai daļu, tāpēc atmiņas prasība paliek augsta, savukārt ātrums tuvinās daudz mazākam modelim. Kad Alibaba nosauc 2,4 triljonus, nepasakot aktīvo daļu, izstrādātājs nevar novērtēt ne dzelžu izmaksas, ne kavējumu.

«Otrais aiz Fable 5» bez viena skaitļa

Vienīgais Alibaba sniegtais salīdzinājums ir apgalvojums, ka Qwen3.8 ir «otrais aiz Fable 5» starp testētajām sistēmām. Kā norāda MarkTechPost, tas ir uzņēmuma paša formulējums, nevis izmērīts rezultāts. Nav nevienas benchmark tabulas, nav metodikas, nav neatkarīgas pārbaudes.

Nosauc vienu skaitli par izmēru un vienu vārdu par sniegumu — pārējo lai iedomājas lasītājs. Tā ir izplatīta metode lielu modeļu paziņojumos, un tā apgrūtina divu laidienu salīdzināšanu.

Alibaba gan konkretizē, kur gaidīt uzlabojumus salīdzinājumā ar iepriekšējo Qwen3.7-Max: kodēšana, pilna steka izstrāde, datu analīze un biroja darbplūsmas. Tie ir apgalvojumi, ko var pārbaudīt tikai tad, kad modelis kļūst brīvi pieejams testēšanai.

Atvērtie svari, ko nevar atvērt

Alibaba paziņojumā svari nosaukti par «drīzumā» pieejamiem. Konkrēta datuma nav, un licence nav norādīta. 19. jūlijā Qwen3.8 modeļa kartes Hugging Face platformā vēl nebija, un OpenRouter katalogā, kur jau atrodami 76 dažādi Qwen modeļi, versijas 3.8 nebija.

Tas ir būtiski, jo tieši atvērtie svari ir iemesls, kāpēc Qwen un Kimi vispār interesē izstrādātājus, kuri negrib būt atkarīgi no viena mākoņa API. Kamēr svarus nevar lejupielādēt, «atvērtais» modelis praktiski neatšķiras no slēgta — to var izmantot tikai caur pakalpojuma sniedzēja serveriem un ar viņa noteikto cenu.

Trešais liels ķīniešu modelis dažu dienu laikā

Qwen3.8 iekļaujas skaidrā rakstā. DeepSeek V4 Pro ar 1,6 triljoniem parametru bija lielākais atvērtais modelis līdz šim. Pēc tam Moonshot AI izlaida Kimi K3 ar 2,8 triljoniem un pieejamiem svariem. Divas dienas vēlāk Alibaba nāca ar 2,4 triljoniem. Trīs ķīniešu laboratorijas dažu nedēļu laikā pārsit viena otras parametru skaitu, un katra jaunā versija liek iepriekšējai izskatīties mazākai. MLQ ziņo, ka Alibaba pati Qwen3.8 pozicionē kā tuvu nozares priekšgalam, taču bez skaitļiem šī tuvība paliek apgalvojums.

Parametru skaits gan ir vieglākais rādītājs, ko palielināt, un grūtākais, ko pārbaudīt. Kimi K3 svarus var lejupielādēt un pārbaudīt jau tagad; Qwen3.8 gadījumā pagaidām ir tikai skaitlis un maksas priekšskatījums. Kuram modelim ir jēga, izšķirs neatkarīgi testi pēc svaru publicēšanas, nevis paziņojuma diena.

Kā to izmēģināt jau tagad

Qwen3.8-Max-Preview jau strādā, bet tikai caur trim Alibaba pārvaldītiem kanāliem: Token Plan abonementu, Qoder un QoderWork. Preview laikā cena ir 10 % no standarta likmes. Atsaucei — iepriekšējais Qwen3.7-Max maksāja 2,50 USD par miljonu ievades žetonu un 7,50 USD par miljonu izvades žetonu, tā ka pilnas Qwen3.8 cenas vēl nav zināmas.

Modelis ir multimodāls: tas apstrādā tekstu, attēlus, video un dokumentus. Vienlaikus jāatceras, ka preview versija ir tieši tā — priekšskatījums. Alibaba to var mainīt, ierobežot vai pilnīgi noņemt bez brīdinājuma, tāpēc būvēt produkciju uz preview galapunkta ir riskanti pat par preview cenu.

Izstrādātājam, kurš tagad izvēlas modeli produkcijai, aina ir šāda — var samaksāt par preview un pats izmērīt sniegumu savā uzdevumā, vai arī nogaidīt, līdz parādās svari un neatkarīgi testi. Publiskie skaitļi šobrīd neļauj izvēlēties uz datu pamata. Tas, ka modelis eksistē un ir liels, vēl neko nepasaka par to, vai tas jūsu uzdevumā strādā labāk nekā tas, kas jums jau ir.

Avoti

komentārisaruna

Komentāri

Šim rakstam vēl nav komentāru. Esi pirmais, kurš dalās ar savu viedokli.

Pievieno komentāru

Tavs e-pasts netiks publicēts. Obligātie lauki atzīmēti.

vēl no skaidrojumisaistītie