GLM-5.2 登顶 LiveBench 与 Vals Index
智谱 GLM-5.2 在 LiveBench 上取得与 Claude 4.6 Opus high 持平的成绩,考虑国产模型语言平均偏后,有用户认为性能对标 GPT-5.4 xhigh 甚至 GPT-5.5 xhigh。同时,ValsAI 确认 GLM-5.2 在 Vals Index、Vibe Code Bench 和 Terminal Bench 上取得开源权重模型 SOTA,全部模型(含闭源)排名第五。 LiveBench 被视为目前未被系统性刷榜的基准之一,但用户指出国产模型存在语言平均偏低、Gemini 首发版不反映降智后水平、测试链路偏短等局限。社区对 GLM-5.2 是真实进步还是针对性刷榜存在分歧,缺乏来自官方 coding plan 的大规模实测反馈。