Alibaba lancerede Qwen3.8-Max i mandags med sine første offentliggjorte målinger, og modellen placerede sig som nummer fire på Arenas Frontend Code-leaderboard. Kun Claude Opus 5 og Moonshots Kimi K3 klarede sig bedre i testen.
Modellen med 2,4 billioner parametre kommer ud af juli-forhåndsvisningen med 95 milliarder aktive parametre, et kontekstvindue på 1 million tokens og offentlig API-prissætning.
Qwen3.8-Max er kun overgået af Claude og Kimi i kodningstest
Arena’s leaderboard gav Qwen3.8-Max 1.668 point, ét point bag Claude Opus 5 (High). Claude Opus 5 (Max) topper listen med 1.705, mens Kimi K3 (Max) har andenpladsen med 1.676. Modellen endte også på andenpladsen i Arenas Consumer Product-kategori.
Følg os på X for at få de seneste nyheder løbende
Data fra Alibaba viser gevinster over Claude Opus 4.8, Fable 5 og GPT-5.6 på agentic og multimodale målinger. Tallene viser 86,6 på TerminalBench-2.1, 93,0 på PaperBench og 86,1 på OSWorld-Verified.
Men på kerne-softwareudvikling holder Anthropic’s Fable 5 et solidt forspring. Den scorer 80,0 på SWE-Pro mod Qwens 67,7, og 88,8 på FrontierSWE mod 73,5.
Første Open Max-model lanceres mens Alibaba-aktien stiger
Lanceringen markerer også første gang, at Alibaba gør vægtene til en Qwen-Max-model open source.
”I næste uge bliver de åbne vægte til Qwen3.8-Max frigivet, og Qwen3.8-27B får også åbne vægte for alle!” sagde teamet.
Vægtene bliver tilgængelige på Hugging Face og ModelScope. Samtidig starter API-priserne ved $2 pr. million input tokens og $6 pr. million output tokens.
Investorer reagerede hurtigt på lanceringen. Alibaba aktien steg 6,15 % til 124,20 HKD ved frokostpause i Hong Kong, fra en tidligere lukning på 117 HKD.
Aktien forlængede fredagens stigning på 4,65 %, som analytikere koblede til en rapporteret Moonshot chip-aftale. Uafhængige evalueringer kan give et klarere billede, når vægtene er offentliggjort i næste uge.
Abonner på vores YouTube-kanal og få ekspertindsigt fra ledere og journalister









