中国政策档案 Governance Archive HOLDINGS 234,771 · FONDS 122
Record · qbitai ACC. 900075020

Zhipu Open-Sources GLM-4.5, Tool Calling Surpasses Claude Opus 4.1 with Cost of Only 1.4%

智谱开源GLM-4.5工具调用超越Claude Opus 4.1,成本仅1.4%

Issuer
Date
2025-09-02
Instrument
other
Cited by
0
The document reports that Zhipu AI's open-source model GLM-4.5 outperforms Claude Opus 4.1 in the Berkeley tool use benchmark, achieving higher performance at a fraction of the cost. It highlights the model's capabilities in coding and tool calling, as well as cost-effective integration with tools like Claude Code.
Full text · 原文 1,197 字
闻乐 发自 凹非寺<br> 量子位 | 公众号 QbitAI<br> 在对手最擅长的地方打败对手,智谱做到了。<br> 开源模型GLM-4.5在伯克利工具使用榜单上超越Claude Opus 4.1,运行相同任务成本仅为1.4%。<br> 抢在GPT-5之前发布的融合大模型GLM-4.5,以其在前端开发、跨文件修改、全栈项目构建等场景中的卓越表现受到不少关注。<br> 现在,GLM-4.5的编程能力也已经接近Claude 4。<br> 性能更高、速度更快、价格更低<br> GLM-4.5采用MoE架构,为评估Agentic Coding能力,团队构建了CC-Bench评测体系。<br> 通过在覆盖六大开发领域、52个实际编程任务中对比GLM-4.5与Claude Sonnet 4、DeepSeek-V3.1、Kimi-K2和 Qwen3-Coder-480B,可以看出GLM-4.5在与顶尖开源模型对比时表现强劲,尤其在任务完成效果和工具调用可靠性方面。<br> 在与Claude Sonnet 4的直接竞争中可以发现,GLM-4.5在编码性能方面接近行业标杆Claude Sonnet 4。<br> 并且,艾伦人工智能研究所研究科学家Tim Dettmers体验后表示:开源的GLM-4.5在推理速度上和闭源模型一样好,甚至比Opus 4.1快3倍、比GPT-5快5倍。<br> 甚至有反馈称,在涵盖多语言、多种函数调用测试的大模型能力权威榜单伯克利工具调用排行榜中,GLM-4.5已经超越Claude 4、Grok-4等。<br> 再细看榜单还可以发现,GLM-4.5花费的成本还是最低的。<br> 说到花费,值得提一嘴的是,智谱还推出了高性价比的Claude Code套餐,价格仅为Claude的1/7,适用于GLM-4.5以及GLM-4.5-Air。<br> Claude Code是Anthropic推出的开源工具,简单来说就是Claude Code CLI与各类AI模型供应商之间的智能中介,将不同模型接入Claude Code后,就可以根据任务需求选用不同成本的模型。<br> 不止Claude Code,团队称未来还将拓展到更多Coding工具。<br> 目前,GLM-4.5已接入包括Claude Code、Cline、Gemini CLI、Grok CLI、CodeGeeX、Kilo Code、Roo Code、Trae在内的多款主流编程工具,全面支持日常开发流程。<br> 所以,被Claude价格门槛劝退的你,会不会尝试一下GLM-4.5呢?<br> 参考链接:<br> [1]https://x.com/alxfazio/status/1962399641376354724<br> [2]https://x.com/Zai_org/status/1962522757536887205<br> [3]https://x.com/KhaledAlwaleed/status/1962545997373919740<br> — 完 —