Qwen3.8-Max : 2,4 billions de paramètres, 5e à l'Arena – open source ou promesse ?

Le 3 août 2026, Alibaba met en GA Qwen3.8-Max : 2,4 billions de paramètres, 95B actifs, contexte 1M tokens, MoE sparse. À l'Arena Text : provisoirement 5e mondial (1496 pts) ; Vision : 2e. API à 2 $ / 6 $ le million de tokens — mais les poids ne sont pas publiés, malgré le discours « open source » et une promesse pour la semaine suivante.

Synthèse : Qwen3.8-Max clôt un été chargé côté modèles chinois — après Kimi K3 (poids ouverts le 27 juillet, 2,8T) et DeepSeek V4-Flash (31 juillet). Chiffres clés : Arena 1496, Vision #2, API 2 $ / 6 $, test aveugle Kimi 83 vs preview Qwen 80. Tous les benchmarks cités sont exécutés par les éditeurs. Le backend Qwen d'Apple Intelligence en Chine est un SKU distinct. Tableaux comparatifs, points de friction, runbook en six étapes et FAQ ci-dessous.

00Qu'est-ce que Qwen3.8-Max ?

Flagship texte + vision d'Alibaba Cloud : 2,4T paramètres totaux, 95B activés en inférence, MoE sparse, fenêtre 1 048 576 tokens. Lancement parallèle de Qwen Office Agent (bêta) — agent bureautique (tableurs, slides, e-mail) calé sur 3.8-Max.

SpécificationValeur
Paramètres totaux2,4 billions
Actifs (inférence)95B
Contexte1M tokens
ID APIqwen3.8-max
Tarif APIentrée 2 $ / sortie 6 $ par million
Arena Text (provisoire)#5 — 1496 pts
Arena Vision (provisoire)#2
Poids open sourceSemaine suivante annoncée — absents le 3/8
Trois chiffres à retenir :2,4T / 95B actifs ② Arena Text provisoire 1496 (5e) ③ API sortie 60 % moins chère que Kimi K3 (6 $ vs 15 $/M).

FrictionsCe que le label « open source » masque

  • GA sans poids : impossible d'auditer, fine-tuner ou déployer on-prem le jour J — contrairement à K3 depuis le 27 juillet.
  • Benchmarks vendor-run : scores Alibaba / Moonshot / DeepSeek — comparaison inter-vendors directionnelle seulement.
  • Rang Arena provisoire : 1496 peut bouger ; Vision #2 idem.
  • Piège du contexte 1M : tarif attractif mais volume de tokens (Office Agent, PDF longs) drive la facture.
  • Triple lancement estival : K3, V4-Flash, 3.8-Max en quinze jours — sans politique de routage, coût et qualité divergent.
  • Confusion Apple × Qwen : Intelligence en Chine ≠ API 3.8-Max (contrats, SLA, modèle différents).

01Tableau comparatif

ModèleParamètresContexteAPI (in/out $/M)PoidsSignal
Qwen3.8-Max2,4T / 95B1M2 / 6AnnoncésArena #5 (1496)
Kimi K32,8T1M3 / 15Ouverts 27/7Test aveugle 83
DeepSeek V4-Flash128KBas31/7Coût
Claude Fable 5Fermé200K3 / 15FrontierSWE

02Runbook en six étapes

DashScope — compatible OpenAI
from openai import OpenAI

client = OpenAI(
    api_key="your_dashscope_api_key",
    base_url="https://dashscope.aliyuncs.com/compatible-mode/v1"
)

response = client.chat.completions.create(
    model="qwen3.8-max",
    messages=[{"role": "user", "content": "Résume ce rapport trimestriel et crée un tableau de risques"}]
)
  1. 01
    Clé API DashScope et plafond de dépense mensuel dans la console Alibaba Cloud.
  2. 02
    Valider sur Qwen Chat avant branchement agent — tâches représentatives vs Kimi K3.
  3. 03
    Budget contexte : chunking + cache de résumés même avec 1M tokens.
  4. 04
    Routage hybride : bureau / chinois → Qwen ; max OSS → K3 ; batch → V4-Flash.
  5. 05
    Métriques : tokens, P95, taux de succès — Arena 1496 en signal secondaire.
  6. 06
    Surveiller Hugging Face la semaine suivante ; consolider coût API + hôte agent via tarifs NUKCLOUD.

03NUKCLOUD — nœuds Mac pour agents stables

Brancher Qwen3.8-Max sur des agents Office ou MCP locaux exige des sessions SSH longues et des builds Xcode fiables. Un VPS macOS mutualisé introduit jitter, voisin bruyant et coupures — annulant l'avantage tarifaire 2 $ / 6 $.

NUKCLOUD propose des nœuds Mac bare-metal multi-régions : Apple Silicon dédié, frontière locataire claire. Consultez les tarifs et provisionnez un essai via commander.

  • Open source dès la GA ?
    Non — API seulement. Poids promis la semaine suivante, non vérifiés au 3 août.
  • Faut-il faire confiance au 5e rang Arena ?
    Provisoire. Vos propres tests A/B priment.
  • Kimi 83 vs Qwen 80 — verdict ?
    Un test aveugle vendor-side. Routez par cas d'usage et coût.
  • Apple Intelligence Chine = 3.8-Max ?
    Non — autre SKU Qwen.
  • Où héberger la CI agent ?
    Nœuds Mac dédiés NUKCLOUD plutôt qu'un pool partagé.

Données au 2026-08-04. Sources : annonce Alibaba Qwen, LMSYS Arena (provisoire), grille DashScope.