2026-08-26 14:42:13
Zhipu、8月26日にGLM-5.3-Flashモデルをリリース、コストを10分の1に抑え、Claude Opus級の性能を実現
Z.aiによると、8月26日、Zhipuは総パラメータ数3,200億、アクティブパラメータ数180億のネイティブマルチモーダル大規模言語モデル「GLM-5.3-Flash」を発表した。同モデルは、コーディングおよびエージェントのベンチマークでGLM-5.2を大幅に上回り、Claude Opusに迫る性能を示しながら、同等の代替モデルと比べて料金を約10分の1に抑えている。 同モデルは、スパースアテンション機構と線形アテンション機構を組み合わせたハイブリッドアーキテクチャを採用し、300兆個のマルチモーダルトークンで訓練されている。これにより、長文脈推論のコストをGLM-5.3のおよそ3分の1に削減した。Artificial Analysis Intelligence Index v4.1.1では、GLM-5.3-Flashはタスクあたり0.045ドルで、57ポイントの性能評価を達成した。Zhipuによると、同モデルは中国国内の大規模AIチップクラスター上で、NVIDIA GPUに匹敵する推論効率を実現している。