Skip to content
research

Le nouveau modèle fantôme de l'IA est terrifiant de performance

Une IA mystérieuse sans nom vient de surpasser les géants de l'industrie sur un benchmark de codage clé. Mais l'utilisation de ce « modèle furtif » gratuit comporte un coût caché sérieux.

Aki Tanaka
Le nouveau modèle fantôme de l'IA est terrifiant de performance

Le fantôme dans la machine apparaît

Un nouveau concurrent a fait son apparition dans l'arène de l'IA le 20 août 2026, sans aucun battage médiatique mais avec un impact immense. Surnommé Ox Alpha, ce modèle anonyme a fait surface sur les plateformes de développement OpenRouter et OpenCode, attirant instantanément l'attention. Sa provenance reste un mystère, mais ses capacités en disent long, suggérant un développeur inconnu et redoutable.

Les développeurs ont rapidement découvert les spécifications techniques époustouflantes d'Ox Alpha, établissant une nouvelle référence en matière de performance. Il dispose d'une immense fenêtre de contexte de 1 048 576 jetons, une capacité qui éclipse de nombreux modèles établis et permet un raisonnement long inédit. De plus, il a démontré de véritables entrées multimodales, traitant de manière transparente :

  • le texte
  • les images
  • la vidéo

Au-delà de la compréhension d'entrées diverses, Ox Alpha offrait des fonctionnalités robustes cruciales pour les applications avancées. Il prenait entièrement en charge l'appel d'outils et de fonctions, ainsi que la sortie JSON structurée, ce qui le rend idéal pour les flux de travail agentiques complexes et les systèmes de production. Pendant environ une semaine après son lancement, cette puissance était entièrement gratuite, alimentant une ruée frénétique parmi les développeurs désireux de tester ses limites avant l'expiration de l'accès temporaire.

Briser les benchmarks

Les capacités d'Ox Alpha ont immédiatement réécrit les attentes de performance de l'industrie. Sur le benchmark notoirement difficile DeepSWE, un test complet d'aptitude en génie logiciel, le modèle a atteint un score étonnant de 80 % au Pass@1.

Ce résultat a surpassé de manière décisive les leaders établis. Pour le contexte, des modèles de premier plan comme Claude Fable Studio Studio 5 ont obtenu 70 % et GPT-5.6 Sol a atteint 72,7 % lors de la même évaluation rigoureuse. Ox Alpha a démontré un bond significatif dans la génération de code automatisée et la résolution de problèmes.

Les leaders de l'industrie ont rapidement remarqué cette performance sans précédent. Le PDG de Stripe, connu pour son œil avisé sur les applications pratiques de l'IA, a publiquement fait l'éloge d'Ox Alpha, le qualifiant de « très impressionnant » pour le codage au niveau de la production. Son aptitude aux tâches agentiques complexes a encore renforcé sa position.

Au-delà de simples extraits de code, Ox Alpha a fait preuve d'une profonde capacité à gérer des défis d'ingénierie complexes en plusieurs étapes. Cela suggère un modèle capable non seulement d'écrire du code, mais aussi d'orchestrer de manière autonome des flux de travail de développement logiciel plus larges. Son arrivée anonyme a donc imposé une nouvelle norme redoutable pour les assistants IA.

Démasquer le fantôme

L'apparition soudaine et anonyme d'Ox Alpha sur des plateformes comme OpenRouter et OpenCode a déclenché une enquête médico-légale immédiate sur ses véritables origines. Les analystes techniques ont rapidement convergé vers Zhipu AI comme étant le développeur hautement probable. Les preuves issues de l'empreinte digitale du tokenizer et de modèles de messages d'erreur spécifiques pointent avec une certitude de près de 99 % vers une variante multimodale non publiée de la série GLM-5.x de Zhipu AI. Cette analyse détaillée suggère un début calculé et furtif pour un nouveau modèle puissant.

Bien que la théorie GLM reste la plus solide, quelques analyses alternatives ont également lié Ox Alpha à la famille MAI de Microsoft. Cependant, les signatures techniques cohérentes s'alignent plus solidement avec l'architecture propriétaire de Zhipu AI, les établissant fermement comme le favori. Cette connexion potentielle remodèle considérablement le paysage concurrentiel de l'IA.

Si Ox Alpha est effectivement un modèle GLM-5.x, cela signale une nouvelle stratégie agressive de la part de Zhipu AI. Leur lancement anonyme, suivi d'un accès gratuit temporaire, a permis des tests de résistance en conditions réelles et une perturbation du marché sans attribution directe. Doté d'une fenêtre de contexte d'un million de jetons, de capacités multimodales pour le texte, l'image et la vidéo, ainsi que d'un appel d'outils avancé, ce modèle représente un défi redoutable pour les acteurs établis. De plus amples détails sur ses capacités sont disponibles sur Ox Alpha. Ce mouvement calculé positionne Zhipu AI comme une force silencieuse mais puissante, prête à conquérir une part plus importante du marché de l'IA avancée.

Cet article vous plaît ? Recevez-en un comme celui-ci chaque matin.

un e-mail par jour · désinscription en deux clics · aucun traqueur tiers

Le prix élevé d'un repas gratuit

L'accès gratuit d'une semaine à Ox Alpha sur des plateformes comme OpenRouter était assorti d'une condition critique, souvent négligée. L'avertissement explicite d'OpenRouter indiquait que le fournisseur anonyme conservait toutes les invites et les complétions — bien que ce ne soit explicitement pas pour l'entraînement du modèle. Cette collecte de données unilatérale, provenant d'une entité inconnue, a immédiatement soulevé une préoccupation majeure en matière de confidentialité et de sécurité des données pour quiconque utilisait ce modèle puissant.

Pour les entreprises, en particulier celles opérant sous des cadres réglementaires stricts, cela représente un champ de mines de conformité redoutable. Soumettre du code source propriétaire, des documents internes sensibles ou même des données clients à un tiers non divulgué, indépendamment de la clause de « non-entraînement », pourrait constituer une violation grave de la gouvernance des données et exposer les entreprises à d'immenses pénalités juridiques et financières en vertu de réglementations telles que l'EU AI Act.

Ce déploiement audacieux et anonyme impose une interrogation cruciale sur son véritable objectif. Ox Alpha était-il une version bêta marketing brillamment exécutée, bien qu'éthiquement ambiguë, pour la série GLM-5.x non publiée de Zhipu AI, conçue pour générer un buzz généralisé et recueillir des mesures de performance réelles inestimables ? Ou a-t-il fonctionné comme une opération de collecte de données sophistiquée et étendue, récoltant des invites et des données de qualité production à haute valeur ajoutée auprès de milliers de développeurs et d'entreprises sans méfiance à travers le monde ? Le prix réel de ce repas gratuit séduisant ne deviendra peut-être clair que longtemps après l'expiration de l'offre.

Foire aux questions

Qu'est-ce qu'Ox Alpha ?

Ox Alpha était un modèle d'IA « furtif » anonyme et haute performance qui a été brièvement disponible gratuitement sur des plateformes comme OpenRouter en août 2026. Il présentait une fenêtre de contexte d'un million de jetons et des capacités multimodales.

Comment Ox Alpha a-t-il performé sur les benchmarks ?

Ox Alpha aurait atteint un score révolutionnaire de 80 % Pass@1 sur le benchmark de codage DeepSWE, surpassant les modèles établis comme Claude Fable 5 (70 %) et GPT-5.6 Sol (72,7 %) à l'époque.

Qui se cache probablement derrière Ox Alpha ?

Bien qu'officiellement non confirmé, l'analyse technique suggère fortement qu'Ox Alpha est un modèle non publié de la série GLM-5 de Zhipu AI (Z.ai), basé sur son tokenizer et ses modèles d'erreur.

L'utilisation d'Ox Alpha était-elle sûre ?

Il y avait des préoccupations importantes en matière de confidentialité. Le fournisseur anonyme conservait explicitement les invites et les complétions des utilisateurs, créant des risques de sécurité des données et de conformité, en particulier pour les entreprises.

Found this useful? Share it.

For builders

Want Stork to write one of these about your product?

Send us a URL. We use the product, form a view, and publish what we actually think — in 8 languages, labeled Sponsored, with no copy approval on your side. That last part is what makes it worth quoting.

See how it works$500 · AI tools & software only