Les deux versions sont alignées bloc par bloc, dans l’ordre du texte : titre, l’essentiel, puis paragraphe par paragraphe. Quand la traduction a fusionné ou scindé un paragraphe, la case correspondante reste vide — on ne rapproche jamais deux passages au jugé.
电脑屏幕上,一个人体血液循环3D网页被搭了出来:能切换视图图层,也能调整心率、压力,甚至模拟失血性休克。但人体看起来更像火柴人,器官堆在一起,离精细医学仿真还有距离。这正是GLM-5.3上线后的第一个信号:它已经能把想法快速变成可交互的网页,却还没有把每个细节都打磨到专业工具的程度。
Sur l’écran d’un ordinateur, une page web 3D simulant la circulation sanguine humaine a été créée : il est possible de changer de vue et de couche, d’ajuster la fréquence cardiaque et la pression, voire de simuler un choc hémorragique. Mais le corps ressemble davantage à un bonhomme bâton, les organes sont empilés les uns sur les autres et l’ensemble reste loin d’une simulation médicale détaillée. C’est le premier enseignement du lancement de GLM-5.3 : le modèle sait déjà transformer rapidement une idée en page web interactive, mais il ne peaufine pas encore chaque détail au niveau d’un outil professionnel.
智谱这次没有把参数规模继续推高。GLM-5.3仍处于7000亿参数级别,升级主要来自后训练 Scaling,也就是在已有基座上持续进行强化学习和能力训练。官方技术博客称,模型使用743B基模,在与GLM-5.2相同的基座上推进强化学习;配套开源的Slime框架,则覆盖发布级模型后训练所需的完整工作流,并支持GLM、Qwen、DeepSeek部分模型和Llama 3。
Zhipu n’a pas continué à augmenter la taille du modèle. GLM-5.3 reste dans la catégorie des 700 milliards de paramètres et ses progrès proviennent principalement du scaling du post-entraînement, c’est-à-dire de la poursuite de l’apprentissage par renforcement et de l’entraînement aux capacités sur une base existante. Selon le blog technique officiel, le modèle utilise une base de 743B et applique l’apprentissage par renforcement sur la même base que GLM-5.2. Le framework open source Slime qui l’accompagne couvre l’ensemble du workflow nécessaire au post-entraînement de modèles destinés à la mise en production et prend en charge GLM, certains modèles Qwen et DeepSeek, ainsi que Llama 3.
能力提升首先出现在编程和智能体任务中。六项benchmark里,GLM-5.3在GDPVal评估中拿到第一名,AutomationBench和Agents’ Last Exam的成绩也处于前列。后者分别关注跨应用工作流编排和智能体能力。网络安全则是另一块高地:在ExploitGym中,模型面对898道题、限时6小时,完成了130道,表现与Claude Mythos 5持平。智谱还公开了网络安全披露账本,记录模型发现的漏洞,其中最早的漏洞可追溯到大约40年前。
Les progrès apparaissent d’abord dans les tâches de codage et d’agent. Sur six benchmarks, GLM-5.3 arrive premier dans l’évaluation GDPVal, tandis que ses résultats sur AutomationBench et Agents’ Last Exam figurent également parmi les meilleurs. Ces deux derniers benchmarks portent respectivement sur l’orchestration de workflows interapplications et les capacités d’agent. La cybersécurité constitue un autre point fort : dans ExploitGym, le modèle a été confronté à 898 problèmes dans une limite de 6 heures et en a résolu 130, égalant les performances de Claude Mythos 5. Zhipu a également publié un registre des failles de cybersécurité recensées, qui répertorie les vulnérabilités découvertes par le modèle ; la plus ancienne remonte à environ 40 ans.
实测中的差距同样清楚。GLM-5.3生成的金字塔滑板游戏体验不错,水母湖的3D场景也能呈现出较复杂的视觉效果;但人体循环仿真较粗糙,复杂项目往往需要更长的反复测试。在Zcode里,模型可以调用工具、读取网页截图、检查问题并继续修改,一个行星撞地球的网页运行超过一个小时后,才完成地壳开裂、熔岩喷出和碎片形成行星环等效果。使用Claude Code时,自动审批命令还可能出现无法判断Bash安全性的提示,原因被认为与第三方模型尚未适配该应用机制有关。
Les écarts observés lors des essais sont tout aussi nets. Le jeu de skateboard en forme de pyramide généré par GLM-5.3 offre une expérience convaincante, tandis que la scène 3D du lac aux méduses présente des effets visuels assez complexes. En revanche, la simulation de la circulation sanguine est rudimentaire et les projets complexes nécessitent souvent davantage de cycles de test. Dans Zcode, le modèle peut appeler des outils, lire des captures d’écran de pages web, vérifier les problèmes et poursuivre les modifications. Une page simulant la collision d’une planète avec la Terre a ainsi fonctionné pendant plus d’une heure avant de produire les effets de fissuration de la croûte, d’éruption de lave et de formation d’un anneau planétaire constitué de débris. Avec Claude Code, l’approbation automatique des commandes peut également afficher un message indiquant qu’il est impossible de déterminer si une commande Bash est sûre, un problème attribué à l’incompatibilité des modèles tiers avec le mécanisme de l’application.
测试显示,GLM-5.3可以在网页应用和自动化流程中调用工具并持续修改:它已进入智谱的Zcode和AutoClaw,并向GLM Coding Plan用户开放,WorkBuddy、QwenWork、TraeWork等第三方平台也提供抢先体验。API预计下周二开放,完整权重将在两周内开源。它并非每个3D页面都能一次成功,但在编程、工具调用和安全任务测试中展现了相应能力;代价是模型更新太快,今天的首选可能很快就要重新比较。
Les tests montrent que GLM-5.3 peut appeler des outils et effectuer des modifications successives dans des applications web et des workflows automatisés : il est désormais intégré à Zcode et AutoClaw de Zhipu et accessible aux utilisateurs de GLM Coding Plan. Des plateformes tierces comme WorkBuddy, QwenWork et TraeWork proposent également un accès anticipé. L’API devrait ouvrir mardi prochain et les poids complets seront publiés en open source dans les deux semaines. Le modèle ne réussit pas nécessairement chaque page 3D du premier coup, mais il démontre des capacités correspondantes dans les tests de codage, d’appel d’outils et de sécurité. En contrepartie, les modèles évoluent si rapidement que le favori du jour pourrait bientôt devoir être comparé à nouveau.