Anthropicは、Zhipu AIが提供するオープンウェイトモデル「GLM-5.3」に関する評価結果を公開しました。同報告によると、GLM-5.3は特定のセキュリティ指標において、Anthropicの「Claude Mythos Preview」と極めて近い能力を有していることが確認されました。
今回評価された「GLM-5.3」は、Zhipu AIが開発するオープンウェイトモデルです。Anthropicは、本モデルが特に悪用(エクスプロイト)の構築を目的としたタスクにおいて、高いパフォーマンスを発揮していると指摘しています。
評価の結果、GLM-5.3は攻撃的なコード生成能力において、クローズドモデルであるClaude Mythos Previewに肉薄するレベルに達していることが明らかになりました。これはオープンウェイトモデルが最先端モデルに匹敵する性能を持ち始めていることを示唆しており、AIの安全性評価と監視の重要性が改めて強調される結果となりました。
今回の評価は、AIモデルの安全性に関する透明性を確保するための一環として実施されました。急速に進化するオープンウェイトモデルと、それがもたらすセキュリティ上の課題に対し、今後も継続的かつ客観的な検証が不可欠です。