GLM-5.2 Is The New Best Open Model
- Auteurs
- Zvi Mowshowitz, thezvi.wordpress.com
- Thème
- IA
- Mots-clés
- GLM-5.2, open weights, frontier, Pareto, benchmarks, open model
- Ton
- news
Résumé
Zvi Mowshowitz analyse GLM-5.2, qu'il considère comme le meilleur modèle open weights du moment. Le modèle affiche d'excellents benchmarks et représente un grand pas par rapport à GLM-5.1, mais reste substantiellement derrière la frontière absolue (4 à 7 mois de retard selon lui), plausiblement sur la frontière de Pareto coût-bénéfice. En pratique, son utilité reste délicate : ni assez bon marché pour les tâches de masse, ni assez fort pour les tâches les plus exigeantes, et sans vision.
💡 Pourquoi ça compte
GLM-5.2 incarne l'argument « suffisant vs frontière » : un modèle ouvert, des mois derrière le top, mais imbattable sur le couple prix/disponibilité — un rappel que la valeur ne se joue plus uniquement sur le benchmark.
Analyse approfondie
GLM-5.2 est arrivé la semaine dernière. Il affiche d'excellents benchmarks et a l'air solide.
Les benchmarks ici sont un plafond de facto de sa qualité, pas une estimation ponctuelle. Pour l'essentiel, tous les autres aspects d'un modèle open comme celui-ci, au-delà de la vitesse et du prix, seront presque toujours pires que ce que les chiffres suggèrent. Impressionnant tout de même.
C'est clairement un grand pas en avant par rapport à GLM-5.1, et probablement le modèle open le plus fort.
GLM-5.2 reste substantiellement derrière la frontière absolue, bien que plausiblement sur la frontière de Pareto coût-bénéfice. Il semble plus proche de la frontière que les efforts précédents, y compris probablement plus proche que ne l'était DeepSeek R1 lors du « moment DeepSeek ».
C'est le nouveau moment « pic juste derrière ». Son existence est une mise à jour substantielle qui repousse dans le sens inverse certaines des mises à jour du type « où sont passées toutes les mises à jour ».
Purement en termes de tâches centrales que GLM-5.2 sait faire, et en ignorant les fonctionnalités manquantes et sa généralisation inférieure, en ignorant qu'il est distillé depuis Claude, en ignorant la classe de modèles Mythos, et en se basant purement sur la date de sortie publique, on peut défendre que GLM-5.2 est entre 4 et 7 mois derrière la frontière, à un prix inférieur.
Cela ne veut pas dire qu'il est si utile en pratique. Trouver sa niche est délicat à moins de valoriser intrinsèquement l'ouverture. Il n'est pas assez bon marché, ni assez meilleur que des alternatives moins chères, pour les vraies tâches de masse ; ni assez fort pour les tâches les plus exigeantes. Il y a diverses difficultés pratiques, notamment l'absence de vision.
(Le billet poursuit ensuite avec un traitement complet des capacités du modèle, après une parenthèse politique de l'auteur soutenant un candidat au Congrès, Alex Bores, champion d'une régulation raisonnable de l'IA.)