智谱AI在ModelScope发布GLM-5.2模型,支持100万上下文窗口,并显著提升编码能力。该模型在Code Arena全球可用模型中排名第二,在FrontierSWE、SWE-Marathon和PostTrainBench等基准上成为排名最高的开源模型,性能介于Claude Opus 4.7和4.8之间。GLM-5.2采用KV8、LayerSplit、IndexShare等技术实现百万上下文,在Terminal-Bench 2.1上达到开源SOTA,较GLM-5.1提升17.5%。开发者可使用vLLM、SGLang、Transformers进行推理部署。 核心观点: 1. GLM-5.2在Code Arena全球所有可用模型中排名第二。 2. 在Terminal-Bench 2.1上达到开源SOTA,较GLM-5.1提升17.5%。 3. 采用KV8、LayerSplit、IndexShare技术实现100万上下文窗口。
Z.ai 发布 GLM-5.2 旗舰模型,支持 1M token 上下文窗口,在编码和长程智能体任务上显著提升。Terminal-Bench 2.1 得分从 62.0 升至 81.0;IndexShare 技术使 1M 上下文下每 token FLOPs 降低 2.9 倍,改进的 MTP 将投机解码接受率提升 20%。模型提供 High/Max 两种推理努力级别,已获 SGLang 首日支持。 核心观点: 1. GLM-5.2 在 Terminal-Bench 2.1 上得分 81.0,相比 GLM-5.1 的 62.0 提升显著。 2. IndexShare 技术使 1M token 上下文下每 token FLOPs 降低 2.9 倍。 3. 改进的 MTP 将投机解码接受率提升最多 20%。
Zai_org 发布了其旗舰模型 GLM-5.2,该模型已在 Nebius Token Factory 平台上线并获得 Day 0 支持。新模型在编码能力、智能体能力和长上下文执行方面有显著提升,旨在满足高要求的工程工作流需求。 核心观点: 1. GLM-5.2 在 Nebius Token Factory 获得 Day 0 支持,即发布当天即可使用。 2. 新模型在编码、智能体能力和长上下文执行方面有提升。
MiniMax 发布开放权重模型 MiniMax M3。该模型总参数量约 428B、激活参数量约 23B,支持 1M-token 上下文窗口与原生多模态理解,并具备前沿编码与 Agent 能力。模型权重已上架 Hugging Face,同时发布了 MiniMax Sparse Attention 论文。开发者可直接下载部署,在超长上下文、多模态及 Agent 场景中进行应用开发与评测。 核心观点: 1. MiniMax M3 总参数量约 428B,激活参数量约 23B,以开放权重形式发布。 2. 模型支持 1M-token 上下文窗口,具备原生多模态理解及前沿编码与 Agent 能力。 3. 权重已上架 Hugging Face,并配套发布 MiniMax Sparse Attention 技术论文。