“北京造”大模型GLM-4.5开源 综合性能世界领先

2个月前 来源:千龙网 观看:81

7月28日晚,北京智谱华章科技股份有限公司(以下简称"智谱AI")发布其新一代旗舰大模型GLM-4.5,这是一款专为智能体应用打造的基础模型,在复杂推理、代码生成及智能体交互等通用能力上实现能力融合与技术突破,综合测试性能已跻身全球领先行列。F9I即热新闻——关注每天科技社会生活新变化gihot.com

图片1F9I即热新闻——关注每天科技社会生活新变化gihot.com

这款新模型的发布,代表了AI迈向通用人工智能的一次重要转变。它不再满足于扮演一个被动回答问题的“聊天机器人”,而是要成为能够理解复杂目标、自主规划并执行多步骤任务的“全优生”。例如,模型能够胜任全栈开发任务,一键生成较为复杂的应用、游戏、交互网页。在实际例子中,用户通过z.ai使用该模型时,仅用一句简单的指令,就可让GLM-4.5独立开发出具备搜索功能的“谷歌”网站、可以发弹幕的“B站”,甚至直接上线一个完整的“Flappy Bird”小游戏。F9I即热新闻——关注每天科技社会生活新变化gihot.com

在性能评估中,GLM-4.5的表现展示了其架构优势。在涵盖研究生水平推理和复杂软件工程解题等12项全球公认的硬核测试中,其综合得分位列全球第三,在所有国产模型和开源模型中均排名第一。F9I即热新闻——关注每天科技社会生活新变化gihot.com

大型语言模型性能评估表,包含智能体、推理与编码基准测试数据(图源:智谱)F9I即热新闻——关注每天科技社会生活新变化gihot.com

该款旗舰大模型发布仅十小时,便引发全球外媒关注。价格因素同样是关注焦点,报道普遍聚焦该模型 “成本更低、性能更优” 的特性,部分媒体还对其参数进行了详细解析与同类对比。目前该系列模型API调用价格低至输入0.8元/百万tokens、输出2元/百万tokens,远低于市场主流价格。F9I即热新闻——关注每天科技社会生活新变化gihot.com

28日模型发布后不到两个小时,X平台就在首页推荐了这款中国大模型。CNBC在28日报道称:“中国企业正在研发的人工智能模型不仅智能化水平提升,使用成本也持续降低,这与深度求索(DeepSeek)当年震动市场的突破核心优势相呼应。” 路透社28日在报道中提到,作为中国 “AI 六小虎” 之一的智谱,自今年6月被OpenAI“点名”后便备受关注。彭博社表示,OpenAI的挑战者智谱AI发布开源模型,试图在这个蓬勃发展的行业中抢占制高点。另一家美国知名科技媒体VentureBeat则在文章中指出:“GLM-4.5的发布为企业团队提供了一个可行的、高性能的基础模型。对于平衡创新和运营限制的团队来说,这是一个令人信服的选择。”发布后不到12小时,GLM-4.5模型已经位列国际开源社区Hugging-Face榜单全球第二。《环球时报》针对于该款模型进行整版报道,受到国内外业界高度关注。F9I即热新闻——关注每天科技社会生活新变化gihot.com

美国科技网站Techi 认为,中国AI发展正清晰呈现 “易获取” 的趋势:“智谱努力与深度求索、OpenAI等行业巨头同台竞技。随着更多企业推出开源模型并压低价格,中国正逐步成为全球AI竞争的核心参与者,力争占据领先地位。未来几个月,这些快速变化将带来何种影响——是催生新的监管政策,还是推动新的技术创新,仍有待观察。”F9I即热新闻——关注每天科技社会生活新变化gihot.com

受到大模型关注的除了这款大模型的性能,还有一个最大亮点是这是首款原生融合模型,首次在单个模型中实现将推理、编码和智能体能力原生融合,以满足智能体应用的复杂需求。F9I即热新闻——关注每天科技社会生活新变化gihot.com

大语言模型的目标是在广泛领域达到人类认知水平。然而,现有模型仍然算不上真正的通用模型:有些擅长编程,有些精于数学,有些在推理方面表现出色,但没有一个能在所有任务上都达到最佳表现。GLM-4.5正是朝着统一各种能力这一目标努力,力求在一个模型中集成所有这些不同的能力。大模型的下一个范式,一定是把各种能力整合到一起,成为一个“全优生”。F9I即热新闻——关注每天科技社会生活新变化gihot.com

图片2F9I即热新闻——关注每天科技社会生活新变化gihot.com

其次这款模型拥有更高的参数效率。GLM-4.5的参数量仅为一些主流模型的一半甚至三分之一,但在多项标准基准测试中表现得更为出色。在衡量模型代码能力的SWE-bench Verified 榜单上,GLM-4.5系列位于性能/参数比帕累托前沿,这表明在相同规模下,GLM-4.5系列实现了最佳性能。F9I即热新闻——关注每天科技社会生活新变化gihot.com

目前,这款集高性能、低成本和开源特性于一体的模型已在智谱开放平台上线。用户可通过智谱大模型开放平台使用该模型,其开源版本也将同步登陆Hugging Face与ModelScope平台。F9I即热新闻——关注每天科技社会生活新变化gihot.com

7月28日晚,北京智谱华章科技股份有限公司(以下简称"智谱AI")发布其新一代旗舰大模型GLM-4.5,这是一款专为智能体应用打造的基础模型,在复杂推理、代码生成及智能体交互等通用能力上实现能力融合与技术突破,综合测试性能已跻身全球领先行列。F9I即热新闻——关注每天科技社会生活新变化gihot.com

图片1F9I即热新闻——关注每天科技社会生活新变化gihot.com

这款新模型的发布,代表了AI迈向通用人工智能的一次重要转变。它不再满足于扮演一个被动回答问题的“聊天机器人”,而是要成为能够理解复杂目标、自主规划并执行多步骤任务的“全优生”。例如,模型能够胜任全栈开发任务,一键生成较为复杂的应用、游戏、交互网页。在实际例子中,用户通过z.ai使用该模型时,仅用一句简单的指令,就可让GLM-4.5独立开发出具备搜索功能的“谷歌”网站、可以发弹幕的“B站”,甚至直接上线一个完整的“Flappy Bird”小游戏。F9I即热新闻——关注每天科技社会生活新变化gihot.com

在性能评估中,GLM-4.5的表现展示了其架构优势。在涵盖研究生水平推理和复杂软件工程解题等12项全球公认的硬核测试中,其综合得分位列全球第三,在所有国产模型和开源模型中均排名第一。F9I即热新闻——关注每天科技社会生活新变化gihot.com

大型语言模型性能评估表,包含智能体、推理与编码基准测试数据(图源:智谱)F9I即热新闻——关注每天科技社会生活新变化gihot.com

该款旗舰大模型发布仅十小时,便引发全球外媒关注。价格因素同样是关注焦点,报道普遍聚焦该模型 “成本更低、性能更优” 的特性,部分媒体还对其参数进行了详细解析与同类对比。目前该系列模型API调用价格低至输入0.8元/百万tokens、输出2元/百万tokens,远低于市场主流价格。F9I即热新闻——关注每天科技社会生活新变化gihot.com

28日模型发布后不到两个小时,X平台就在首页推荐了这款中国大模型。CNBC在28日报道称:“中国企业正在研发的人工智能模型不仅智能化水平提升,使用成本也持续降低,这与深度求索(DeepSeek)当年震动市场的突破核心优势相呼应。” 路透社28日在报道中提到,作为中国 “AI 六小虎” 之一的智谱,自今年6月被OpenAI“点名”后便备受关注。彭博社表示,OpenAI的挑战者智谱AI发布开源模型,试图在这个蓬勃发展的行业中抢占制高点。另一家美国知名科技媒体VentureBeat则在文章中指出:“GLM-4.5的发布为企业团队提供了一个可行的、高性能的基础模型。对于平衡创新和运营限制的团队来说,这是一个令人信服的选择。”发布后不到12小时,GLM-4.5模型已经位列国际开源社区Hugging-Face榜单全球第二。《环球时报》针对于该款模型进行整版报道,受到国内外业界高度关注。F9I即热新闻——关注每天科技社会生活新变化gihot.com

美国科技网站Techi 认为,中国AI发展正清晰呈现 “易获取” 的趋势:“智谱努力与深度求索、OpenAI等行业巨头同台竞技。随着更多企业推出开源模型并压低价格,中国正逐步成为全球AI竞争的核心参与者,力争占据领先地位。未来几个月,这些快速变化将带来何种影响——是催生新的监管政策,还是推动新的技术创新,仍有待观察。”F9I即热新闻——关注每天科技社会生活新变化gihot.com

受到大模型关注的除了这款大模型的性能,还有一个最大亮点是这是首款原生融合模型,首次在单个模型中实现将推理、编码和智能体能力原生融合,以满足智能体应用的复杂需求。F9I即热新闻——关注每天科技社会生活新变化gihot.com

大语言模型的目标是在广泛领域达到人类认知水平。然而,现有模型仍然算不上真正的通用模型:有些擅长编程,有些精于数学,有些在推理方面表现出色,但没有一个能在所有任务上都达到最佳表现。GLM-4.5正是朝着统一各种能力这一目标努力,力求在一个模型中集成所有这些不同的能力。大模型的下一个范式,一定是把各种能力整合到一起,成为一个“全优生”。F9I即热新闻——关注每天科技社会生活新变化gihot.com

图片2F9I即热新闻——关注每天科技社会生活新变化gihot.com

其次这款模型拥有更高的参数效率。GLM-4.5的参数量仅为一些主流模型的一半甚至三分之一,但在多项标准基准测试中表现得更为出色。在衡量模型代码能力的SWE-bench Verified 榜单上,GLM-4.5系列位于性能/参数比帕累托前沿,这表明在相同规模下,GLM-4.5系列实现了最佳性能。F9I即热新闻——关注每天科技社会生活新变化gihot.com

目前,这款集高性能、低成本和开源特性于一体的模型已在智谱开放平台上线。用户可通过智谱大模型开放平台使用该模型,其开源版本也将同步登陆Hugging Face与ModelScope平台。F9I即热新闻——关注每天科技社会生活新变化gihot.com

本文链接:http://www.gihot.com/news-2-3187-0.html“北京造”大模型GLM-4.5开源 综合性能世界领先

声明:本网页内容由互联网博主自发贡献,不代表本站观点,本站不承担任何法律责任。天上不会到馅饼,请大家谨防诈骗!若有侵权等问题请及时与本网联系,我们将在第一时间删除处理。

上一篇:调查|外骨骼机器人火了!能干啥?哪儿能买?贵不贵?

下一篇:清华突破软体机器人操控难题 磁性机器人像“液滴”般移动

为你推荐
16日,工业和信息化部发布2024年全年造船业最新数据,我国造船业三大指标——造船完工量、新接订单量、手持订单量继续稳步增长,连续15年全球...
01-21
1月9日,国家药品监督管理局发布最新药品获批证明文件,华润三九携手中国工程院院士张伯礼及团队研发的益气清肺颗粒正式获批上市。益气清肺颗粒是以古...
01-21
  2025年春运于1月14日正式启动。当日,记者从省公安厅交管局举行的新闻发布会上获悉,全省公安交管部门...
01-21
  1月8日,蜜丝佛陀的天猫和抖音官方旗舰店均已暂停营业并下架全部商品。蜜丝佛陀母公司科蒂集...
01-21
新闻记者 潘锡珩通讯员 苏杭 徐媛媛1月21日凌晨0时55分,1168名旅客从广州白云站搭乘G4554次“夜行高铁”踏上返回武汉的归程,虽已是深夜,但旅客们回家的热情满满。这是中国铁路...
01-22
  中新经纬1月17日电 国新办17日就2024年国民经济运行情况举行发布会。国家统计局局长康义表示,从未来看,支撑消费持续增长的有利条件较多。  有记者提问称:中央经济工作会...
01-21
1 月 24 日消息,奥迪(Audi)昨日(1 月 23 日)在 Facebook 上发布动态,展示了一款基于 Q6 Sportback e-tron 打造的越野概念车。这款概念车外观炫酷,配备了门式车桥和巨大的...
01-25
1 月 26 日消息,多年来,除了对续航里程、充电速度和基础设施的担忧之外,选择不购买电动汽车的消费者常常将电动汽车的高价作为一个主要因素。然而最新研究显示,电动汽车...
01-27
  1、《难哄》温以凡之所以拒绝桑延,是因为她经历了太多不幸的事情,在大伯家还遭到他人猥亵欺负,她在面对桑延时不再自信。  2、一系列不幸和痛苦的事情的发生,不仅让温以...
02-17
《余烬之上》廖知白真实存在吗?廖知白是幻想出来的吗?在《余烬之上》的剧情设定中,廖知白是真实存在的。廖知白是电视剧《余烬之上》中的角色,由孙阳饰演。他原...
02-21
21世纪经济报道记者武瑛港 北京报道近日,羟基磷灰石的使用问题在医美行业内快速升温。记者获悉,2025年1月21日,深圳市市场监督管理局、深圳市...
01-23
  科技日报北京2月5日电(记者张梦然)一种无药物、微创的新型干预方法,可逆转脊髓性肌萎缩症(SMA)的...
02-06
  大众网记者 司心鹏 报道  12月25日,济南特殊教育中心与济南市公安局公共交通分局联动会议在自强楼会议室召开。  济南特殊教育中心的学校领导热情接待了来访的警...
01-21
寒假第一天,沈阳医学院的辅导员们又踏上了家访路……这是沈阳医学院通过“辅导员百家行”进行爱心传递的...
01-21
  自营理财业务的主动关停或被动离场已成为众多中小银行不得不面对的现实。  “我已告别资...
01-22
  本报记者 彭妍  近期,广东南澳农商银行、山西怀仁农商银行等部分中小银行的1年期、2年期存...
02-13
天蝎座的男生通常都很神秘、独立而又有魅力,他们对感情非常认真,因此要想让一个天蝎男心...
01-22
巨蟹座的男生通常是温柔、体贴和敏感的,他们对待感情非常认真。如果你想知道一个巨蟹男...
01-22
休闲男装搭配? 男装休闲搭配?休闲男装搭配?01.条纹衬衫+牛仔裤这一身穿搭单品款式上组合看起来不仅休闲感满满,而且还透露出非常清爽的感觉,经典怀旧的牛仔休闲裤,跟上衣浅粉条纹...
02-07
会议正装男士穿搭? 40岁男士夏季穿搭商务休闲文化?一、会议正装男士穿搭?1.西服套装和西装套裙,一般搭配浅色、纯色或纯白色的衬衣,脚下穿简约款皮鞋,鞋子的颜色与服装匹配,不要过...
02-17
1.拼多多加大对短剧领域的投入拼多多向短剧领域发起了春节攻势。据了解,拼多多近期更新并发布了两项针对短剧领域的新政策。一是“新版多多有好剧计划”,作为对旧版计划的升级...
02-07
直播带货行业,杀出一匹黑马。1.B站直播带货让人刮目相看自从 B站2021年12月正式入局直播带货以来,面对的质疑声此起彼伏。不少人表示,B站向来以独特的二次元文化和多元化的内容...
02-09
3月7日消息,妇女节来临,同程旅行联合唯品会共同发布《2025年中国女性出行及品牌消费趋势报告》,基于双方过去一年的消费数据,揭示发生在“购物车”与“旅行箱”之间的隐秘关联。...
03-09
3月6日消息,携程集团与山东文旅集团近日宣布达成全方位战略合作,两大旅游集团20强将围绕“平台赋能+产业创新”主线,通过资源整合与模式创新,共同构建覆盖“产品开发、营销推广...
03-09
自去年底开始,黄金多头优势逐渐退却,国际现货黄金价格经历几次大跌后一度跌下2700关口,多空进入漫长的震荡周期,多头始终无法找到再度冲高的时机。  北京时间1月21日,国际现货...
01-24
12月13日消息,深圳市光因科技有限公司(简称”光因科技”)近日完成数亿元A轮融资,本轮融资由徐州高新区产业投资母基金、梅花创投、科珹资本、神骐资本...
02-07
根据国外游戏论坛IconEra管理员爆料,SIE已不再计划将《恶魔之魂》和《GT赛车7》移植到PC平台。 关于《GT赛车7》,爆料称原本有一个PC版正在开发中,但最终被取消...
02-03
《城市:天际线2》中国地区资产包现已免费上线Paradox Mods,官方表示中国资产包的目标是重现这种独特的融合——从四合院的历史韵味到现代高层建筑的宏伟规模。此...
02-11
极目新闻记者 张秀娟 2月5日上午9时10分许,武汉市民之家企业开办综合办事窗口,工作人员将崭新的营业执照交至武汉国有资本投资运营集团有限公司办事人员彭艳丽的手中。这是武...
02-05
随着电影《哪吒之魔童闹海》热映,“哪吒”系列导演饺子也走进了大众视野,大家对这位“半路出家”的“细节控”颇感兴趣,在一些饺子接受媒体采访的视频片段下,总能看到不少网友的...
02-08
返回

点击右上角微信好友

朋友圈

点击浏览器下方“”分享微信好友Safari浏览器请点击“”按钮

点击右上角QQ

点击浏览器下方“”分享QQ好友Safari浏览器请点击“”按钮