科技与AI

CAISI评估Z.ai的GLM-5.2:发布时可能是最强开放权重模型,但生物类敏感问题拦截更少

CAISI于7月17日发布对Z.ai模型GLM-5.2的评估结果

美国国家标准与技术研究院下属人工智能标准与创新中心(CAISI)在2026年7月17日公布对中国企业Z.ai(原智谱AI)模型GLM-5.2的评估。该模型于2026年6月16日发布,评估工作在2026年7月8日完成。能力一面,CAISI认为GLM-5.2在发布时很可能是当时最强的开放权重模型:整体能力与2025年12月的GPT-5.2相当,网络能力与2026年2月的Opus 4.6相近。安全防护一面则好坏参半:它会协助智能体式的网络漏洞开发,对敏感生物类问题的拦截也少于美国参照模型;但与其他受评的中国开放权重模型相比,它在抵御智能体劫持和越狱攻击上表现出更强的稳健性。CAISI同时提醒,这类测试衡量的只是模型对提示式越狱的抵抗力,开放权重模型一旦被自行部署,安全防护是可以被绕过的。这一提醒把评估结论的适用边界划得很清楚。

能力与防护被拆成两条独立的评价线,而不是笼统的“安全”或“不安全”。GLM-5.2恰好落在能力靠前、部分防护偏弱的位置,说明两者并不同步演进。

开放权重模型的评测正在形成可跨模型比较的固定维度:能力对标时点、网络协助意愿、生物类问题拦截率、抗劫持稳健性。企业选型和政策讨论都可以直接引用这些维度。

后续关注

关注CAISI已公布的GLM-5.2完整评估报告中的测试方法细节,以及自行部署条件下防护可被绕过的问题是否进入后续评测方法。

信息来源

  1. NIST Artificial Intelligence官方原始材料 · en · 2026年7月17日发布

GFT Finance 整理归纳公开信息并总结要点,不构成投资建议。数据以来源原文为准。