Synthèse : Qwen3.8-Max clôt un été chargé côté modèles chinois — après Kimi K3 (poids ouverts le 27 juillet, 2,8T) et DeepSeek V4-Flash (31 juillet). Chiffres clés : Arena 1496, Vision #2, API 2 $ / 6 $, test aveugle Kimi 83 vs preview Qwen 80. Tous les benchmarks cités sont exécutés par les éditeurs. Le backend Qwen d'Apple Intelligence en Chine est un SKU distinct. Tableaux comparatifs, points de friction, runbook en six étapes et FAQ ci-dessous.
00Qu'est-ce que Qwen3.8-Max ?
Flagship texte + vision d'Alibaba Cloud : 2,4T paramètres totaux, 95B activés en inférence, MoE sparse, fenêtre 1 048 576 tokens. Lancement parallèle de Qwen Office Agent (bêta) — agent bureautique (tableurs, slides, e-mail) calé sur 3.8-Max.
| Spécification | Valeur |
|---|---|
| Paramètres totaux | 2,4 billions |
| Actifs (inférence) | 95B |
| Contexte | 1M tokens |
| ID API | qwen3.8-max |
| Tarif API | entrée 2 $ / sortie 6 $ par million |
| Arena Text (provisoire) | #5 — 1496 pts |
| Arena Vision (provisoire) | #2 |
| Poids open source | Semaine suivante annoncée — absents le 3/8 |
FrictionsCe que le label « open source » masque
- GA sans poids : impossible d'auditer, fine-tuner ou déployer on-prem le jour J — contrairement à K3 depuis le 27 juillet.
- Benchmarks vendor-run : scores Alibaba / Moonshot / DeepSeek — comparaison inter-vendors directionnelle seulement.
- Rang Arena provisoire : 1496 peut bouger ; Vision #2 idem.
- Piège du contexte 1M : tarif attractif mais volume de tokens (Office Agent, PDF longs) drive la facture.
- Triple lancement estival : K3, V4-Flash, 3.8-Max en quinze jours — sans politique de routage, coût et qualité divergent.
- Confusion Apple × Qwen : Intelligence en Chine ≠ API 3.8-Max (contrats, SLA, modèle différents).
01Tableau comparatif
| Modèle | Paramètres | Contexte | API (in/out $/M) | Poids | Signal |
|---|---|---|---|---|---|
| Qwen3.8-Max | 2,4T / 95B | 1M | 2 / 6 | Annoncés | Arena #5 (1496) |
| Kimi K3 | 2,8T | 1M | 3 / 15 | Ouverts 27/7 | Test aveugle 83 |
| DeepSeek V4-Flash | — | 128K | Bas | 31/7 | Coût |
| Claude Fable 5 | Fermé | 200K | 3 / 15 | — | FrontierSWE |
02Runbook en six étapes
from openai import OpenAI
client = OpenAI(
api_key="your_dashscope_api_key",
base_url="https://dashscope.aliyuncs.com/compatible-mode/v1"
)
response = client.chat.completions.create(
model="qwen3.8-max",
messages=[{"role": "user", "content": "Résume ce rapport trimestriel et crée un tableau de risques"}]
)
-
01
Clé API DashScope et plafond de dépense mensuel dans la console Alibaba Cloud.
-
02
Valider sur Qwen Chat avant branchement agent — tâches représentatives vs Kimi K3.
-
03
Budget contexte : chunking + cache de résumés même avec 1M tokens.
-
04
Routage hybride : bureau / chinois → Qwen ; max OSS → K3 ; batch → V4-Flash.
-
05
Métriques : tokens, P95, taux de succès — Arena 1496 en signal secondaire.
-
06
Surveiller Hugging Face la semaine suivante ; consolider coût API + hôte agent via tarifs NUKCLOUD.
03NUKCLOUD — nœuds Mac pour agents stables
Brancher Qwen3.8-Max sur des agents Office ou MCP locaux exige des sessions SSH longues et des builds Xcode fiables. Un VPS macOS mutualisé introduit jitter, voisin bruyant et coupures — annulant l'avantage tarifaire 2 $ / 6 $.
NUKCLOUD propose des nœuds Mac bare-metal multi-régions : Apple Silicon dédié, frontière locataire claire. Consultez les tarifs et provisionnez un essai via commander.
-
Open source dès la GA ?Non — API seulement. Poids promis la semaine suivante, non vérifiés au 3 août.
-
Faut-il faire confiance au 5e rang Arena ?Provisoire. Vos propres tests A/B priment.
-
Kimi 83 vs Qwen 80 — verdict ?Un test aveugle vendor-side. Routez par cas d'usage et coût.
-
Apple Intelligence Chine = 3.8-Max ?Non — autre SKU Qwen.
-
Où héberger la CI agent ?Nœuds Mac dédiés NUKCLOUD plutôt qu'un pool partagé.
Données au 2026-08-04. Sources : annonce Alibaba Qwen, LMSYS Arena (provisoire), grille DashScope.