Z.ai、AIの記憶力と賢さ向上
Z.ai Launches GLM-5.2 With a Usable 1M-Token Context, Two Thinking-Effort Levels, and No Benchmarks at Launch

Z.aiの新しい文章作成AI「GLM-5.2」は、一度に100万トークンもの情報を扱え、複雑なプログラミング作業をより効率的に行えるようになりました。
GLM-5.2はZ.aiが提供する最新のlarge language modelであり、GLM-5ラインにおける3番目の主要なリリースとなります。GLM-5(2月11日)、GLM-5-Turbo(3月15日)、GLM-5.1(4月7日)に続くものです。これにより、約4ヶ月で4つのフラッグシップ級のコーディング関連リリースが行われたことになります。 1M-Token Context Window GLM-5.2の際立った特徴は、1,000,000-tokenのcontext windowです。Z.aiは、このバリアントを独自の構成でglm-5.2[1m]と呼んでいます。各応答では最大131,072の出力tokenを返すことができます。これはGLM-5.1の200,000-token windowから約5倍の増加です。1M-token windowは、coding agentが実際にどのように機能するかを変えます。このagentは、中規模のrepository全体をworking memoryに保持できます。これには、ソースファイル、テスト、設定、および会話履歴が含まれます。これにより、より小さなwindowで強制される絶え間ない要約が不要になります。 このリリースでは、HighとMaxという2つのthinking-effort levelsも追加されています。Z.aiは、複雑な多段階のコーディング作業にはMaxの努力レベルを推奨しています。Claude Codeでは、/effortコマンドがこの設定を制御します。xhigh、max、ultracodeのオプションはすべてGLM-5.2のMax努力レベルにマッピングされます。 アーキテクチャと変更点 Z.aiは、GLM-5.2の発表資料でそのアーキテクチャを明記していません。しかし、コミュニティのメモに基づくと、GLM-5のベースは744-billion-parameterのMixture-of-Experts modelです。これはtokenごとに40 billion parametersを活性化します。GLM-5.1は、post-trainingを再ターゲットすることで同じバックボーンを維持していました。 MTP Explainer Playground #mtp-glm52-demo, #mtp-glm52-demo * { box-sizing:border-box!important; } #mtp-glm52-demo hr, #mtp-glm52-demo p:empty, #mtp-glm52-demo del, #mtp-glm52-demo s { display:none!important; } #mtp-glm52-demo { background:#111!important; color:#e8e8e8!important; border:1px solid #2a2a2a!important; border-radius:14px!important; font-family:-apple-system,BlinkMacSystemFont,"Segoe UI",Roboto,Helvetica,Arial,sans-serif!important; max-width:900px!important; margin:24px auto!important; padding:24px!important; line-height:1.5!important; } #mtp-glm52-demo .g52-head
この記事について質問
記事の内容に答えます。記事外のことは都度ウェブで調べます。