暂无内容
BitpushNews

Terminal-Bench 4.0:GLM-5.3 冲到第三,超过 GPT-5.6 Sol

发布于 2026/8/29 13:59:04

AI 摘要

Terminal-Bench 发布 4.0 基准测试,重新校准了任务执行资源,修复并移除部分任务。最新榜单中,Opus 5 + Claude Code 以 51.8% 居首,Fable 5 以 44.5% 第二,GLM-5.3 + Claude Code 以 41.8% 升至第三,超过 GPT-5.6 Sol + Codex 的 37.3%。相比 3.0 版本,GLM-5.3 从第四名反超 Sol。

#AI#基准测试
AI 评分: 75
🔗 访问原文

其他报道 (2条)

📰
火星财经·2026/8/29 13:58:36
Terminal-Bench 4.0:GLM-5.3冲到第三,超过GPT-5.6 Sol
🔗
📰
BlockBeats·2026/8/29 13:50:02
Terminal-Bench 4.0:GLM-5.3冲到第三,超过GPT-5.6 Sol
🔗