# 智谱AI发布GLM-5.2，在移动应用开发能力上实现大幅提升，内部基准测试完成率从21/70提升至48/70

- 来源：智谱AI
- 发布时间：2026-06-19 10:54
- AIWatch 分数：70
- AIWatch 标记：本月精选
- AIWatch 链接：https://aiwatch.icu/events/evt_01kvsxv3x422nt4r3sdd92df7e
- 原文链接：https://x.com/Zai_org/status/2067803569319731396

## 精选理由

高信息密度，值得细读

## AI 摘要

智谱AI发布GLM-5.2模型，在移动应用开发能力上实现大幅提升。内部基准测试包含35个挑战性移动开发任务，每个任务运行两次共70次试验，以核心功能无重大问题为完成标准。GLM-5.2完成率从GLM-5.1的21/70提升至48/70，提升超过两倍，但仍低于Claude Fable 5的56/70。对开发者而言，该模型在长周期任务上的进步值得关注。
核心观点：
1. GLM-5.2在内部移动开发基准测试中完成率从21/70提升至48/70，提升超过两倍。
2. 基准测试包含35个挑战性移动开发任务，每个任务运行两次共70次试验。
3. Claude Fable 5在该基准上完成率为56/70，高于GLM-5.2。

## 正文

智谱AI发布GLM-5.2模型，在移动应用开发能力上实现大幅提升。内部基准测试包含35个挑战性移动开发任务，每个任务运行两次共70次试验，以核心功能无重大问题为完成标准。GLM-5.2完成率从GLM-5.1的21/70提升至48/70，提升超过两倍，但仍低于Claude Fable 5的56/70。对开发者而言，该模型在长周期任务上的进步值得关注。
核心观点：
1. GLM-5.2在内部移动开发基准测试中完成率从21/70提升至48/70，提升超过两倍。
2. 基准测试包含35个挑战性移动开发任务，每个任务运行两次共70次试验。
3. Claude Fable 5在该基准上完成率为56/70，高于GLM-5.2。
