Alibaba lanserte Qwen3.8-Max mandag med sine første publiserte benchmark-tester, og modellen havnet på fjerdeplass på Arena sitt Frontend Code-ledertavle. Kun Claude Opus 5 og Moonshot sin Kimi K3 scoret høyere i testen.
Den 2,4 billioner parametriske modellen forlater forhåndsvisningen i juli med 95 milliarder aktive parametere, et kontekstvindu på 1 million tokens og offentlig API-prising.
Qwen3.8-Max like bak Claude og Kimi i kode-test
Arena sin ledertavle ga Qwen3.8-Max 1668 poeng, ett poeng bak Claude Opus 5 (High). Claude Opus 5 (Max) leder med 1705, mens Kimi K3 (Max) har andreplassen med 1676. Modellen tok også andreplass i Arena sin Consumer Product-kategori.
Følg oss på X for å få de siste nyhetene først
Data delt av Alibaba hevder seiere mot Claude Opus 4.8, Fable 5 og GPT-5.6 på agentiske og multimodale benchmarks. Dataene viser 86,6 på TerminalBench-2.1, 93,0 på PaperBench og 86,1 på OSWorld-Verified.
Imidlertid holder Anthropics Fable 5 et solid forsprang innenfor kjerne software engineering. Den scorer 80,0 på SWE-Pro mot Qwens 67,7, og 88,8 på FrontierSWE mot 73,5.
Første åpne Max-modell lanseres samtidig med kursoppgang for Alibaba
Lanseringen markerer også første gang Alibaba vil open source vektene til en Qwen-Max-klasse modell.
“Neste uke slippes de åpne vektene til Qwen3.8-Max, og Qwen3.8-27B blir også open-weights for alle å ta i bruk!” sa teamet.
Vektene vil bli tilgjengelige på Hugging Face og ModelScope. Samtidig debuterte API-prisingen på $ 2 per million input tokens og $ 6 per million output tokens.
Investorer reagerte raskt på lanseringen. Alibaba aksjen steg 6,15 % til HK$ 124,20 ved lunsjtid i Hongkong, fra et forrige sluttkurs på HK$ 117.
Aksjen bygget videre på fredagens 4,65 % økning, som eksperter knyttet til en rapportert Moonshot chip-avtale. Uavhengige vurderinger kan gi enda tydeligere bilde når vektene slippes neste uke.
Abonner på vår YouTube-kanal for å se ledere og journalister dele ekspertinnsikter









