当前位置：首页 > 元宇宙 > AI

智谱发布新一代开源 AI 模型 GLM-4-32B-0414 系列，效果比肩 GPT 系列和 DeepSeek-V3 R1

来源：责编：时间：2025-04-17 06:44:23 218观看

导读 4 月 15 日消息，智谱昨日（4 月 14 日）发布博文，宣布推出新一代 GLM-4-32B-0414 系列模型，320 亿参数，效果比肩 OpenAI 的 GPT 系列和 DeepSeek 的 V3 / R1 系列，且支持非常友好的本地部署特性。该系列模型共有 GLM-4

4 月 15 日消息，智谱昨日（4 月 14 日）发布博文，宣布推出新一代 GLM-4-32B-0414 系列模型，320 亿参数，效果比肩 OpenAI 的 GPT 系列和 DeepSeek 的 V3 / R1 系列，且支持非常友好的本地部署特性。

该系列模型共有 GLM-4-32B-Base-0414、GLM-Z1-32B-0414、GLM-Z1-Rumination-32B-0414 和 GLM-Z1-9B-0414 四款模型。

GLM-4-32B-Base-0414

在预训练阶段，该模型采用 15T 高质量数据，其中包含大量推理类的合成数据，这为后续的强化学习扩展打下了基础。

在后训练阶段，除了针对对话场景进行了人类偏好对齐外，团队还通过拒绝采样和强化学习等技术强化了模型在指令遵循、工程代码、函数调用方面的效果，加强了智能体任务所需的原子能力。

GLM-4-32B-0414 在工程代码、Artifacts 生成、函数调用、搜索问答及报告等方面都取得了不错的效果，部分 Benchmark 甚至可以媲美更大规模的 GPT-4o、DeepSeek-V3-0324（671B）等模型。

GLM-Z1-32B-0414

该模型是具有深度思考能力的推理模型，在 GLM-4-32B-0414 的基础上，通过冷启动和扩展强化学习，以及在数学、代码和逻辑等任务上对模型的进一步训练得到的。

相对于基础模型，GLM-Z1-32B-0414 显著提升了数理能力和解决复杂任务的能力。在训练的过程中，该团队还引入了基于堆栈排序反馈的通用强化学习，进一步增强了模型的通用能力。

GLM-Z1-Rumination-32B-0414

该模型是具有沉思能力的深度推理模型（对标 Open AI 的 Deep Research）。

沉思模型通过更长时间的深度思考来解决更开放和复杂的问题（例如：撰写两个城市 AI 发展对比情况，以及未来的发展规划），结合搜索工具处理复杂任务，并经过利用多种规则型奖励来指导和扩展端到端强化学习训练得到。

GLM-Z1-9B-0414

这是一个开源 9B 小尺寸模型，在数学推理和通用任务中依然展现出极为优秀的能力，其整体表现已处于同尺寸开源模型中的领先水平。

测试结果

GLM-4 系列在多项基准测试中表现优异。例如，在 IFEval 指令遵循测试中得分 87.6；在 TAU-Bench 任务自动化测试中，零售场景得分 68.7，航空场景得分 51.2；在 SimpleQA 搜索增强问答测试中得分 88.1。

模型IFEvalBFCL-v3 (Overall)BFCL-v3 (MultiTurn)TAU-Bench (Retail)TAU-Bench (Airline)SimpleQAHotpotQAQwen2.5-Max85.650.930.558.322.079.052.8GPT-4o-112081.969.641.062.846.082.863.9DeepSeek-V3-032483.466.235.860.732.482.654.6DeepSeek-R184.357.512.433.037.383.963.1GLM-4-32B-041487.669.641.568.751.288.163.8

代码修复方面，GLM-4 在 SWE-bench 测试中的成功率达 33.8%。采用 MIT 许可的 GLM-4 降低了计算成本，为研究和企业提供了高性能 AI 解决方案。

模型框架SWE-bench VerifiedSWE-bench Verified miniGLM-4-32B-0414Moatless[1]33.838.0GLM-4-32B-0414Agentless[2]30.734.0GLM-4-32B-0414OpenHands[3]27.228.0

附上参考地址

GLM-4-0414 系列模型

THUDM Releases GLM 4: A 32B Parameter Model Competing Head-to-Head with GPT-4o and DeepSeek-V3

本文链接：http://www.28at.com/showinfo-45-12317-0.html智谱发布新一代开源 AI 模型 GLM-4-32B-0414 系列，效果比肩 GPT 系列和 DeepSeek-V3 R1

声明：本网页内容旨在传播知识，若有侵权等问题请及时与本网联系，我们将在第一时间删除处理。邮件：2376512515@qq.com

上一篇：人工智能开发平台 Hugging Face 收购 Pollen Robotics，进军人形机器人市场

下一篇：真·质之选：北京现代OE四驱，让安全与舒适超越配置堆砌

标签：

热门焦点

人间诚实周鸿祎：360 All in 大模型的六个解读

主笔 / 村口有牛文章架构师 / 毛自聪出品 / 巨头财经5月至今，人间躁动，各路大模型你方唱罢我登场，VC圈互联网圈媒体圈已近癫狂。谁也没想到，今日，360再度刷屏，老牌互联网巨头展现
AI大模型“战火”烧到了教育领域

作者：刘旷自2023年开年以来，AI大模型这股风是越吹越猛烈了。随着ChatGPT的出圈爆火，再度掀起了一波AI热浪，无论是在国内还是国外都有不少企业宣布入局或者跟进AI大模型领域。与
Meta、谷歌、微软竞相涌入元宇宙，小型企业该如何伺机而动？

目前来看元宇宙不会影响到小型企业的发展，但在接下来的十年内可能会发生很多变化。很多有商业头脑的企业家都在密切关注着元宇宙的发展。元宇宙这个词，你一定或
从NFT顶级公链到Web3.0基础设施：带你了解不一样的Flow

对于大部分年轻人来说，刚刚过去的春节有一个词语突然成为了品牌宣传的流行语，作为从NFT中衍生出来的“数字藏品”一时间获得了不少品牌青睐，他们纷纷推出自己的数
餐桌上怎么变出元宇宙？

作者：星影“元宇宙让餐饮业脱胎换骨。”实体的餐饮与虚拟的元宇宙，看起来风马牛不相及，但最近全世界的餐饮企业都掀起了一股注册元宇宙商标的热潮。2月初，全球最大
借VR产业东风，江西抢滩布局“元宇宙”

自2016年起就在VR上倾注了大量精力的江西省，迅速搭上了“元宇宙”。VR、AR等技术是通往元宇宙的关键接口，使人们可以在数字空间和物理空间自由穿梭。自2016年起
在元宇宙开会是什么样一种体验

空间就是一切还记得面对面的会议吗？就在不久前，与会者需要飞到遥远的目的地，并进行鼓舞人心的对话、网络、免费食物，甚至可能会有一两个很好的小组讨论。随之而来
Interface正大光明的“跑路”，社区成员赞格局大

今日凌晨，一个广泛受社区期待的潜力蓝筹项目Interfaces突然发文宣布项目停止运营，后续也不会有铸造NFT系列的活动。这对社区来说就是一重磅炸弹，大多数人完全不明
在互联网考古后，我被豆瓣上这座元宇宙古城征服了

最近一段时间，豆瓣可谓命途多舛：APP屡次下架，平台也被相关部门约谈、处罚，国家网信办甚至派人入驻豆瓣以督促整改。有爆料称豆瓣将陆续关闭“小组”功能：这个曾经小

首页

元宇宙

NFT

区块链

虚拟人

AR/VR

AI

元宇宙百科

智谱发布新一代开源 AI 模型 GLM-4-32B-0414 系列，效果比肩 GPT 系列和 DeepSeek-V3 R1

人间诚实周鸿祎：360 All in 大模型的六个解读

AI大模型“战火”烧到了教育领域

Meta、谷歌、微软竞相涌入元宇宙，小型企业该如何伺机而动？

从NFT顶级公链到Web3.0基础设施：带你了解不一样的Flow

餐桌上怎么变出元宇宙？

借VR产业东风，江西抢滩布局“元宇宙”

在元宇宙开会是什么样一种体验

Interface正大光明的“跑路”，社区成员赞格局大

在互联网考古后，我被豆瓣上这座元宇宙古城征服了

最新推荐

元宇宙带来沉浸式智能登录？你学会了吗？

江西将探索成立元宇宙联盟，韩国将加强对NFT和元宇宙的监管

城市数字孪生标准化白皮书（2022版）

2021年中国智慧城市行业概览：AI慧眼独具，赋能“双碳”目标

美国单曲排行榜Billboard和World of Women合作推出NFT杂志封面

TX加入的NFT数字收藏品，元宇宙的破圈之路?

猜你喜欢

热门推荐

相关资讯