Parasail 上线 GLM-5.2 开源权重模型,在长周期智能体任务上接近闭源前沿,FrontierSWE 基准超越 GPT-5.5
Parasail 上线 GLM-5.2 开源权重模型,在长周期智能体任务上接近闭源前沿,FrontierSWE 基准超越 GPT-5.5。
Parasail 平台上线了 GLM-5.2 开放权重模型。该模型在长周期智能体任务上首次显著缩小了与闭源前沿模型的差距,在 FrontierSWE 基准测试中得分超过 GPT-5.5,仅次于 Opus 4.8。这为开发者提供了一个在复杂智能体工作流中接近顶级闭源性能的开源选择。 核心观点: 1. GLM-5.2 在 FrontierSWE 基准上超越 GPT-5.5,仅次于 Opus 4.8。 2. 该模型是首个在长周期智能体任务上接近闭源前沿的开放权重模型。
推荐理由常规版本更新,跟进即可
开放权重模型智能体基准测试Parasail
72/100查看详情