Andrew Ng氏が主宰する独立系AIニュースレターDeepLearning.AIの「The Batch」(2025年8月6日付)によると、Zhipu AI(Z.ai)が公開したオープンウェイトモデルGLM-4.5(総パラメータ3,550億、活性化パラメータ320億)は、ツール利用ベンチマークで平均90.6%の精度を記録しClaude Sonnet 4の89.5%を上回り、数学ベンチマークAIME24では91.0%を記録しClaude Opus 4の75.7%を上回ったと報じられています。一方でコーディングベンチマークSWE-bench Verifiedでは64.2%となり、Claude 4 Sonnetの70.4%には及ばなかったとも報じられています。同記事はこれらをZ.ai社が公表した評価結果として紹介しており、「エージェント用途における『最良』のオープンモデルは週単位で変化している」と評しています。