Imaginez un grand atelier qui progresse sans agrandir son bâtiment. Les outils restent en place ; les ouvriers apprennent à organiser une mission difficile, contrôler l’avancement et changer de plan après un échec. Voilà l’idée de GLM-5.3 : la même base que 5.2, mais un mois de post-entraînement intensif pour les longues tâches d’ingénierie.
Pour l’IA privée, la nuance compte. La taille d’un modèle ressemble à un loyer : chaque paramètre exige stockage, bande passante et exploitation. 5.3 ne réduit pas le loyer élevé de 5.2 ; il promet plus de savoir-faire dans le même bâtiment. Z.ai conserve 744 milliards de paramètres, environ 40 milliards actifs, et augmente environnements, diversité et RL via SAO et slime.
Les résultats suivent provisoirement ce récit. Terminal-Bench 3.0 monte de 4,6 à 28,3, DeepSWE de 46,2 à 66,9 et AutomationBench de 26,2 à 48,2. Il faut utiliser des outils, lire les effets puis se corriger. Un modèle brillant sur une réponse peut se perdre après vingt actions ; l’entraînement vise cette dérive.
La cybersécurité impressionne mais demande de la nuance. 84,5 % à CyberGym mène la découverte et la validation. 54,4 % à ExploitBench double 5.2, tandis que Fable 5 atteint 78,0 et Sol 76,5. GLM trouve mieux les portes dangereuses ; les meilleurs fermés parcourent encore mieux le labyrinthe derrière.
Le registre Z.ai recense 2 436 découvertes dans 269 projets, après revue et déduplication, dont 53 publiques au lancement. Cela reste une preuve conduite par le fournisseur, mais un registre inspectable vaut mieux qu’un slogan.
Le mot local doit rester exact. Aucun téléchargement le premier jour ; poids promis sous deux semaines, licence et API générale absentes. Coding Plan et ZCode sont les accès actuels. Une promesse de fichier n’est pas un fichier sur votre serveur.
Si Z.ai livre, le déploiement ressemblera à 5.2 : énorme mémoire, logiciel mature et quantification prudente. Les opérateurs de 5.2 auront une avance, mais les mesures exactes attendront les poids. D’où le #2 provisoire : DeepSeek V4 Flash demeure le premier choix honnête parce qu’il est exécutable aujourd’hui.