近期,智谱正式发布并开源了新一代人工智能大模型GLM-4.6,作为GLM系列的最新版本,这款模型以卓越的代码能力引发业界广泛关注。

01 技术突破:多项性能大幅提升

GLM-4.6作为智谱GLM系列的最新版本,在模型架构上展现了显著的技术进步。模型总参数量达到355B,激活参数为32B,在保持高效推理的同时实现了性能的全面提升。

模型的核心升级之一是它上下文窗口从128K大幅扩展至200K token,能够处理更复杂的智能体任务和更庞大的文档。

在token效率方面,GLM-4.6实现了超过30%的提升,在平均token消耗上比GLM-4.5节省30%以上,为同类模型最低,这意味着用户可以在相同预算下处理更多的任务。

GLM-4.6在代码能力上较GLM-4.5提升27%,在公开基准与真实编程任务中,代码能力已对齐Claude Sonnet 4

除了代码能力,GLM-4.6在推理能力、信息搜索、写作能力与智能体应用等多个方面也实现全面提升。

同时支持在推理过程中调用工具,增强了模型在工具调用和搜索智能体上的表现。

02 实测表现:国际基准与真实任务双验证

在权威性的八大基准测试中,GLM-4.6展现出了与国际顶尖模型抗衡的实力。这些基准包括AIME 2025、LCB v6、HLE、SWE-Bench Verified等权威测试集。

测试结果显示,GLM-4.6在大部分榜单表现对齐Claude Sonnet 4/Claude Sonnet 4.5稳居国产模型首位。

更为引人注目的是,在贴近实际开发环境的真实场景测试中,研究团队在Claude Code环境下进行了74个真实场景编程任务测试。

结果显示,GLM-4.6实测表现超过Claude Sonnet 4,超越其他国产模型。

在编程体验上,GLM-4.6进一步提升了PPT的可用性、前端代码的美观度与更先进的版面布局,显示出在多模态生成和全栈开发方面的实力。

03 开发者福音:亲民价格与开源策略

GLM-4.6不仅带来了技术上的飞跃,更为开发者社区提供了实实在在的福利。

API价格仅为Claude的1/7!这意味着开发者可以以极低的成本享受到接近国际顶尖水平的代码生成能力。

随着模型发布,智谱同步升级了GLM Coding Plan套餐,最低20元包月,新增图像识别与搜索能力,支持Claude Code、Roo Code等10+主流编程工具。

GLM-4.6的发布不仅仅是一次技术迭代,更标志着国产大模型在国际赛场上的真正突围。其在74个真实编程任务中超越Claude Sonnet 4,在八大基准测试中与全球顶尖模型媲美,这些成绩印证了中国AI技术的飞速进步。

体验链接

Logo

码道开发者社区,聚焦华为云码道 CodeArts 代码智能体,沉淀 Agent、Skill、鸿蒙开发实战内容,供开发者查阅资料、交流技术、分享工程实践

更多推荐