Une IA vient de coder pendant 10 jours d'affilée
Alibaba vient de repousser les limites des agents IA autonomes. Leur nouveau fleuron, Qwen 3.8 Max, un modèle à poids ouverts de 2,4 billions de paramètres, a récemment démontré un exploit sans précédent : il a codé pendant plus de 10 jours sans interruption. À partir d'un dossier vide, le modèle a construit de manière autonome "O my CLI", un agent de code entièrement fonctionnel désormais disponible sur GitHub, démontrant sa capacité à assurer un développement soutenu et indépendant.
Cette démonstration révolutionnaire souligne la force principale de Qwen 3.8 Max : le codage agentique. Conçue pour rester concentrée sur une tâche pendant des jours, cette capacité permet au modèle de gérer des projets à long terme nécessitant une planification complexe, une exécution itérative et une auto-correction continue sans intervention humaine constante. Il excelle dans la navigation à travers des défis de programmation s'étalant sur plusieurs jours, tirant parti de sa fenêtre de contexte de 1 million de jetons pour maintenir la cohérence du projet.
Renforçant encore son autonomie, Qwen 3.8 Max bénéficie de capacités multimodales natives. Son système de vision intégré agit comme une boucle de rétroaction continue, permettant au modèle de "voir" ses progrès, d'analyser les résultats et d'affiner son plan de manière dynamique. Cette perspicacité visuelle permet une auto-correction et une adaptation sophistiquées, cruciales pour naviguer dans la nature itérative du développement logiciel complexe, de la conception initiale au déploiement.
À l'intérieur de la bête de 2,4 billions de paramètres
Qwen 3.8 Max d'Alibaba est une réalisation monumentale en matière d'architecture de modèle : un système Mixture-of-Experts (MoE) creux de 2,4 billions de paramètres. Cette conception n'active intelligemment qu'environ 95 milliards de paramètres par jeton lors de l'inférence, trouvant un équilibre critique entre la puissance de calcul brute et l'efficacité opérationnelle. Le modèle dispose également d'une fenêtre de contexte de 1 million de jetons et de capacités multimodales, traitant des images, des vidéos et du texte pour une compréhension complète.
Cette version représente un changement stratégique profond pour Alibaba, marquant la première fois qu'ils publient les poids de leur modèle le plus puissant de la catégorie "Max". Ce mouvement agressif de "poids ouverts" signale un défi important pour les géants de l'IA propriétaire, remodelant fondamentalement le paysage concurrentiel des systèmes agentiques de pointe. Cela suggère un avenir où les capacités d'IA de haut niveau deviendront plus largement accessibles.
Malgré son échelle colossale, Alibaba a assuré une large accessibilité. Les développeurs peuvent accéder à Qwen 3.8 Max via API, avec une tarification compétitive de 2 $ par million de jetons en entrée et 6 $ par million de jetons en sortie. De plus, pour l'expérimentation et le développement locaux, Alibaba a publié une variante plus petite et plus gérable de 27 milliards de paramètres, conçue pour fonctionner efficacement sur des machines personnelles. Cette double approche démocratise l'accès aux capacités agentiques avancées de l'IA.
Le défi des benchmarks face à GPT-5 et Claude
Qwen 3.8 Max ne code pas seulement de manière autonome ; il se compare de manière compétitive aux principaux modèles à source fermée. Pour les tâches agentiques, il brille, obtenant un score de 86,1 sur OSWorld-Verified, surpassant Claude Fable 5 (environ 85,0) et GPT-5.6 Sol (83,2). Il est également en tête de PaperBench pour l'analyse de recherche avec 93,0, devant GPT-5.6 Sol (90,5) et Claude Fable 5 (88,8).
Sur Terminal-Bench 2.1, Qwen 3.8 Max obtient un score de 86,6, surpassant à la fois Claude Opus 4.8 et Claude Fable 5 (tous deux à 84,6), bien qu'il soit derrière GPT-5.6 Sol (88,8). Cependant, pour l'ingénierie complexe sur SWE-bench Pro, il obtient 67,7, derrière Claude Fable 5 (80,0) et Claude Opus 4.8 (69,2).
Ce système de 2,4 billions de paramètres présente un profil puissant et équilibré, défiant directement la domination établie depuis longtemps des modèles propriétaires d'Anthropic et d'OpenAI. Il excelle particulièrement dans les cas d'utilisation agentiques et la reproduction de recherche, se positionnant comme un outil polyvalent robuste.
Bien que la démonstration de 10 jours pour construire 'O my CLI' se soit révélée révolutionnaire, elle a fonctionné dans un environnement contrôlé, une nuance cruciale pour un déploiement dans le monde réel. Considérez sa tarification API : 2 $ par million de jetons en entrée et 6 $ par million de jetons en sortie. Ce modèle à poids ouverts peut fonctionner pendant des jours, offrant une alternative convaincante et soucieuse des coûts dans le paysage de l'IA en constante évolution.
Cet article vous plaît ? Recevez-en un comme celui-ci chaque matin.
un e-mail par jour · désinscription en deux clics · aucun traqueur tiers
Est-ce la fin de la domination des modèles propriétaires ?
La sortie de Qwen 3.8 Max par Alibaba modifie fondamentalement la dynamique mondiale du pouvoir dans l'IA. Un modèle MoE de premier plan de 2,4 billions de paramètres provenant de Chine, désormais avec des poids ouverts, défie directement la domination établie des géants technologiques occidentaux. Cela intensifie la course mondiale pour construire et distribuer l'IA de pointe, créant un paysage concurrentiel plus diversifié.
Il est crucial de noter que « poids ouverts » ne signifie pas « open-source » complet. Alibaba donne accès aux paramètres du modèle, permettant une expérimentation et un développement étendus. Cependant, d'éventuelles restrictions de licence futures pourraient encore régir le déploiement commercial, définissant les véritables limites de son accessibilité pour les applications d'entreprise.
Pour l'industrie au sens large, cela démocratise l'accès à une IA agentique hautement performante. Les développeurs gagnent un nouvel outil puissant, conçu pour le codage autonome sur plusieurs jours, ce qui pourrait accélérer considérablement les cycles d'innovation. Pourtant, l'adoption généralisée de modèles aussi puissants issus d'origines géopolitiques diverses soulève également de nouvelles questions sur l'usage commercial, la gouvernance des données et les normes de déploiement éthique à l'échelle mondiale. La frontière du développement de l'IA semble désormais résolument plus ouverte, et plus complexe.
Foire aux questions
Qu'est-ce que Qwen 3.8 Max ?
Qwen 3.8 Max est un modèle d'IA à poids ouverts de 2,4 billions de paramètres d'Alibaba, spécifiquement conçu pour des tâches autonomes de longue durée comme le codage agentique.
Puis-je exécuter Qwen 3.8 Max sur mon ordinateur portable ?
Non, le modèle de 2,4T paramètres nécessite des ressources informatiques importantes. Cependant, Alibaba a également publié une variante de 27 milliards de paramètres, Qwen 3.8-27B, conçue pour fonctionner sur des machines personnelles.
Comment Qwen 3.8 Max se compare-t-il aux modèles comme GPT ou Claude ?
Il est très compétitif. Qwen 3.8 Max surpasse des modèles comme Claude Fable 5 et GPT-5.6 Sol sur les benchmarks d'utilisation informatique agentique (OSWorld-Verified) mais reste en retrait sur certains tests complexes d'ingénierie logicielle (SWE-bench Pro).
Qu'est-ce que Qwen 3.8 Max a construit lors de sa démonstration de 10 jours ?
Dans sa démonstration la plus impressionnante, le modèle a reçu un dossier vide et, sur 10 jours, il a construit de manière autonome 'O my CLI', un agent de code complet et fonctionnel désormais disponible sur GitHub.

