Skip to content
Outil d'IA

Qwen3.8-Max Review

Qwen3.8-Max est le modèle d'IA multimodal de 2,4 billions de paramètres d'Alibaba Cloud, conçu pour le raisonnement complexe à travers le texte, les images, les vidéos et les documents.

shipped 3 août 2026chatbotfreemium
Domain rating80Monthly visits47K/mo
chatbotimage-generationvideo
Qwen3.8-Max — product screenshot

Pourquoi c'est important

1Dispose d'une architecture sparse Mixture-of-Experts (MoE) de 2,4 billions de paramètres, activant environ 95 milliards de paramètres pendant l'inférence.
2Offre une fenêtre contextuelle de 1M de tokens, permettant l'analyse de bases de code étendues, de longues transcriptions vidéo et de multiples documents.
3A obtenu un score de 86,6 sur Terminal-Bench 2.1, surpassant Claude Opus 4.8 et Claude Fable 5.
4Prend en charge le codage full-stack, le développement agentique et les flux de travail professionnels à long terme, y compris l'automatisation de style Office.

Spécifications

API disponible

Oui, API publique

overview

Qu'est-ce que Qwen3.8-Max ?

Qwen3.8-Max est un outil de modèle de langage étendu multimodal développé par Alibaba Cloud qui permet aux développeurs de logiciels, aux utilisateurs d'entreprise et aux développeurs d'agents d'IA de traiter et d'analyser divers types d'informations, y compris le texte, les images, la vidéo et les documents. Il intègre des capacités de chatbots, d'analyse d'images et de vidéos, et de génération de contenu, et inclut des fonctionnalités de recherche web dans les modèles d'IA. Qwen3.8-Max est le LLM multimodal phare d'Alibaba Cloud, doté de 2,4 billions de paramètres au total et utilisant une architecture sparse Mixture-of-Experts (MoE) qui active environ 95 milliards de paramètres pendant l'inférence pour l'efficacité. Ses principaux cas d'utilisation incluent le codage full-stack et le développement agentique, les flux de travail professionnels à long terme, le raisonnement multimodal et la résolution de problèmes avancée. Le modèle a été annoncé le 19 juillet 2026, comme une variante de prévisualisation (Qwen3.8-Max-Preview) du prochain modèle phare Qwen3.8, le modèle Qwen3.8 complet étant prévu pour une version open-weight. Les poids open-source pour Qwen3.8-Max sont promis pour la semaine du 2 août 2026. Il est actuellement accessible via les plateformes Token Plan, Qoder et QoderWork d'Alibaba Cloud.

features

Fonctionnalités clés de Qwen3.8-Max

Qwen3.8-Max intègre un ensemble complet de fonctionnalités conçues pour le développement d'applications d'IA avancées et l'analyse de données complexes.

  • 2,4 billions de paramètres avec architecture MoE sparse : Active environ 95 milliards de paramètres pour une inférence efficace.
  • Traitement d'entrée multimodal : Capable de comprendre et de raisonner à travers le texte, les images, la vidéo et les documents.
  • Fenêtre contextuelle de 1M de tokens : Prend en charge le traitement de bases de code étendues, de longues transcriptions vidéo et de multiples documents.
  • Codage Full-Stack et Développement Agentique : S'intègre aux environnements de codage comme Qwen Code et peut recréer des logiciels à partir de captures d'écran.
  • Flux de travail professionnels à long terme : Automatise les tâches de style Office et les tâches d'agent complexes et de longue durée.
  • Raisonnement avancé et résolution de problèmes : Offre un 'mode de pensée' pour le raisonnement logique complexe, les mathématiques et le codage.
  • Compatibilité API : Conçu pour être compatible avec les protocoles API OpenAI et Anthropic.
  • Outils intégrés : Inclut code_interpreter, web_search, web_extractor, t2i_search et i2i_search via l'API Responses.
  • Codage autonome : A démontré des capacités d'auto-évolution dans les tâches de codage sur plus de 10 jours (par exemple, projet oh-my-cli).
  • Reproduction d'articles de recherche : Capable de reproduire et d'améliorer de manière autonome des articles de recherche, impliquant 1 100 actions et 7 600 lignes de code sur 5 jours.

use cases

Qui devrait utiliser Qwen3.8-Max ?

Qwen3.8-Max est principalement conçu pour les développeurs et les entreprises nécessitant des capacités d'IA multimodales avancées pour des tâches complexes.

  • Développeurs de logiciels : Pour le codage full-stack, le développement agentique et la recréation d'applications logicielles à partir de captures d'écran.
  • Utilisateurs d'entreprise : Pour les flux de travail professionnels à long terme, l'automatisation de style Office et l'analyse de données complexes.
  • Développeurs d'agents d'IA : Pour la création de flux de travail d'agents d'IA sophistiqués qui nécessitent une intégration précise avec des outils externes.
  • Professionnels nécessitant un raisonnement multimodal : Pour les tâches impliquant des entrées d'images et de vidéos, telles que la conversion de plans d'étage 2D en visualisations 3D.
  • Chercheurs et universitaires : Pour la reproduction et l'amélioration autonomes d'articles de recherche et l'engagement dans la résolution de problèmes avancée.

how to use

Comment utiliser Qwen3.8-Max

Qwen3.8-Max est accessible via les plateformes d'Alibaba Cloud, offrant diverses méthodes d'intégration et d'utilisation.

  • 1Accès via Alibaba Cloud : Utilisez les plateformes Token Plan, Qoder ou QoderWork pour accéder au modèle.
  • 2Intégration API : Intégrez Qwen3.8-Max dans les applications existantes en utilisant sa compatibilité avec les protocoles API OpenAI et Anthropic.
  • 3Utiliser les outils intégrés : Tirez parti des outils intégrés comme code_interpreter et web_search via l'API Responses pour des fonctionnalités améliorées.
  • 4Participer aux tâches de codage : Employez le modèle pour le codage full-stack, le développement agentique et la recréation d'applications logicielles.
  • 5Traiter les entrées multimodales : Alimentez le modèle avec du texte, des images, des vidéos et des documents pour une analyse et un raisonnement complets.
  • 6Demander un accès en prévisualisation : Participez au programme Qwen3.8-Max-Preview pour un accès anticipé et une utilisation à prix réduit.

pricing

Tarification et plans Qwen3.8-Max

Qwen3.8-Max fonctionne sur un modèle freemium, offrant un niveau gratuit ainsi que des options payantes, avec une tarification spécifique pour la consommation de tokens et des réductions promotionnelles pour l'accès en prévisualisation.

  • Freemium : Inclut un accès gratuit avec des options payantes pour une utilisation étendue.
  • Token Plan Lite : Commence à 6 USD par mois (39 CNY) pour l'accès initial à Qwen3.8-Max-Preview.
  • Tarification API standard : 2 $ par million de tokens d'entrée, 6 $ par million de tokens de sortie et 0,25 $ par million de tokens d'entrée mis en cache pour le modèle généralement disponible.
  • Tarifs promotionnels Qoder : Utilisation en prévisualisation à 0,5 fois le tarif standard, réduite à 0,05 fois (90 % de réduction) pendant les heures normales et 0,01 fois (98 % de réduction) pendant les heures creuses (14h00-00h00 UTC).
  • Remise sur les entrées mises en cache : Les entrées mises en cache sont huit fois moins chères que les nouvelles entrées.

Pros

  • +2.4 trillion-parameter sparse MoE architecture for advanced reasoning.
  • +1M-token context window supports extensive document analysis and long-horizon tasks.
  • +Exceptional coding capabilities across 90+ programming languages, including autonomous software development.
  • +Multimodal processing for text, images, and video inputs, with reported document and speech support.
  • +Aggressive promotional API pricing and freemium access make it cost-effective for early adoption.
  • +API compatibility with OpenAI and Anthropic protocols simplifies integration for developers.

Cons

  • User reports indicate a tendency to 'redefine difficult tasks quietly to some easier option' and take shortcuts, requiring user intervention.
  • Some tests show slowness, potentially due to verbose internal thinking or initial server strain.
  • Reported struggles with complex simulations, exhibiting buggy behavior in certain scenarios.
  • Internal benchmarks show it trailing Claude Fable 5 on several key SWE-bench and professional exams.
  • Lacks published third-party benchmark rankings and open API pricing transparency compared to some competitors like Kimi K3.

Outils similaires

Qwen3.8-Max vs Concurrents

Qwen3.8-Max est positionné comme un modèle d'IA de pointe, Alibaba affirmant qu'il est 'deuxième seulement après Fable 5' parmi ses pairs. Ses capacités multimodales et son engagement envers une version open-weight le distinguent dans le paysage concurrentiel.