Tencent 6. jūlijā publicēja Hy3 — atvērtu valodas modeli ar 295 miljardiem parametru, ko var lejupielādēt un palaist uz sava dzelža. Svari nāk ar Apache 2.0 licenci bez lietojuma vai ģeogrāfiskiem ierobežojumiem, un uzsvars ir uz kodēšanu un aģentu uzdevumiem.
Uzņēmums Hy3 pasniedz kā kompaktāku pretsvaru lielākiem ķīniešu modeļiem. Hy3 ir 295 miljardi parametru pret GLM-5.2 753 miljardiem un DeepSeek-V4-Pro 1,6 triljoniem, taču Tencent apgalvo, ka rezultātos tie turas vienā līmenī. Tas ir arguments tiem, kas rēķina inferences izmaksas.
Kas ir zem pārsega
Hy3 ir Mixture-of-Experts arhitektūra: no 295 miljardiem parametru katram marķierim aktīvi ir tikai 21 miljards. Tīklā ir 192 eksperti, no kuriem uz katru marķieri izvēlas astoņus. Modelis kārto 80 slāņus plus atsevišķu MTP slāni ar 3,8 miljardiem parametru, bet konteksta logs sniedzas līdz 256 tūkstošiem marķieru.
Modeļa kartē uz Hugging Face norādīts BF16 formāts un atsevišķa kvantizēta versija Hy3-FP8. Vārdnīca ir 120 832 marķieri, uzmanības galvas — 64 ar GQA un astoņām KV galvām. Strādā angļu un ķīniešu valodā. MoE pieeja nozīmē, ka atmiņā jātur visi 295 miljardi parametru, bet rēķina laikā strādā tikai 21 miljards — tāpēc caurlaidspēja ir tuvāka daudz mazākam modelim.
Licence, kas mainījās starp versijām
Aprīļa priekšskatījums nāca ar ģeogrāfiskiem ierobežojumiem. Jūlija pilnā versija tos noņem: Apache 2.0 bez lauka-lietojuma klauzulas un bez reģionu izņēmumiem. Praksē tas atļauj svarus izmantot komerciāli, faintūnēt un pārpakot bez papildu atļaujas. Daudzi lielie atvērtā svara modeļi nāk ar pašu izstrādātāju licenci un sīkā drukā ierakstītiem nosacījumiem; Apache 2.0 ir juridiski paredzams un pazīstams jebkuram, kas jau strādā ar atvērto kodu.
Kodēšanas uzsvars šeit ir galvenais. Komanda, kurai kods nedrīkst pamest savu infrastruktūru, ar atvērtiem svariem var uzlikt modeli iekšējā serverī un neko nesūtīt uz svešu API. Slēgts modelis to neļauj — tur pieprasījums vienmēr iziet ārā. Ar Apache 2.0 licenci un lejupielādējamiem svariem Hy3 iekļūst tajā pašā nišā, ko līdz šim aizpildīja DeepSeek un GLM modeļi, tikai ar mazāku parametru skaitu un līdz ar to zemāku rēķina slodzi.
Tencent apgalvo, ka dokumentu apstrādē Hy3 iztērē par 47,4% mazāk marķieru nekā GLM-5.2. Tas ir paša uzņēmuma mērījums, ne neatkarīgs tests — pārbaudi ar savu slodzi, pirms rēķini uz to budžetā.
Benčmarki — ar zvaigznīti
Skaitļi, ko rāda Tencent, ir spēcīgi. SWE-Bench Verified — 78%, SWE-Bench Pro — 57,9%, GPQA Diamond — 90,4%. Zinātnisko uzdevumu testā FrontierScience-Olympiad uzņēmums apgalvo pārsvaru pār GPT-5.5. Visi šie rādītāji nāk no paša izstrādātāja, tāpēc neatkarīgu atkārtojumu vēl vērts nogaidīt. SWE-Bench Verified mēra, cik reālu GitHub problēmu modelis spēj salabot ar patch, kas iztur testus, tāpēc 78% liktu Hy3 blakus dārgākiem slēgtiem modeļiem — ja tie apstiprinātos ārpus Tencent laboratorijas.
Modeļa apmācībā uzsvērta atbildēšana tikai ar pierādījumiem, kas, pēc GIGAZINE apkopotā, samazina faktu sajaukšanu un izdomāšanu. Cik daudz — atkal jāgaida ārējie testi.
Kā to palaist
Serverim vajag daudz atmiņas. Tencent iesaka astoņu GPU tensora paralēlismu ar kartēm H20-3e līmenī vai līdzvērtīgām. Palaišanai der vLLM ar ieslēgtu MTP, SGLang ar EAGLE spekulatīvo dekodēšanu vai parastā transformers bibliotēka. FP8 versija samazina atmiņas prasības, bet astoņu karšu konfigurācija paliek reālais slieksnis pašmāju izvietojumam. Vienam izstrādātājam ar vienu GPU šis modelis mājās nedarbosies — te runa ir par servera līmeņa dzelzi vai mākoni.
Atsevišķais MTP slānis nav tikai skaitlis specifikācijā. MTP nozīmē multi-token prediction — modelis apmācīts paredzēt vairākus marķierus uz priekšu, un tas dod pamatu spekulatīvajai dekodēšanai. Praksē tas paātrina ģenerēšanu: SGLang ar EAGLE izmanto šo slāni, lai vienā solī pieņemtu vairākus marķierus, nevis tos pārrēķinātu pa vienam. Tāpēc caurlaidspēja uz to pašu dzelzi var būt jūtami augstāka nekā modelim bez šāda slāņa.
Cena un kur tas jau strādā
API cena ir 1 juaņa par miljonu ievades marķieru un 4 juaņas par miljonu izvades marķieru. Uz OpenRouter modelis pirmās divas nedēļas pēc laidiena pieejams bez maksas, tāpēc pārbaudīt to var arī bez sava dzelža. Tencent Hy3 jau iebūvējis savos produktos — kodēšanas asistentā CodeBuddy, patērētāju palīgā Yuanbao, OS līmeņa palīgā Marvis un zināšanu rīkā ima. Svari, FP8 versija un palaišanas instrukcijas ir pieejamas Hugging Face, ModelScope, GitCode un CNB platformās.
Komentāri
Šim rakstam vēl nav komentāru. Esi pirmais, kurš dalās ar savu viedokli.