“北京造”大模型GLM-4.5开源 综合性能世界领先

7个月前 来源:千龙网 观看:91

7月28日晚,北京智谱华章科技股份有限公司(以下简称"智谱AI")发布其新一代旗舰大模型GLM-4.5,这是一款专为智能体应用打造的基础模型,在复杂推理、代码生成及智能体交互等通用能力上实现能力融合与技术突破,综合测试性能已跻身全球领先行列。cFe即热新闻——关注每天科技社会生活新变化gihot.com

图片1cFe即热新闻——关注每天科技社会生活新变化gihot.com

这款新模型的发布,代表了AI迈向通用人工智能的一次重要转变。它不再满足于扮演一个被动回答问题的“聊天机器人”,而是要成为能够理解复杂目标、自主规划并执行多步骤任务的“全优生”。例如,模型能够胜任全栈开发任务,一键生成较为复杂的应用、游戏、交互网页。在实际例子中,用户通过z.ai使用该模型时,仅用一句简单的指令,就可让GLM-4.5独立开发出具备搜索功能的“谷歌”网站、可以发弹幕的“B站”,甚至直接上线一个完整的“Flappy Bird”小游戏。cFe即热新闻——关注每天科技社会生活新变化gihot.com

在性能评估中,GLM-4.5的表现展示了其架构优势。在涵盖研究生水平推理和复杂软件工程解题等12项全球公认的硬核测试中,其综合得分位列全球第三,在所有国产模型和开源模型中均排名第一。cFe即热新闻——关注每天科技社会生活新变化gihot.com

大型语言模型性能评估表,包含智能体、推理与编码基准测试数据(图源:智谱)cFe即热新闻——关注每天科技社会生活新变化gihot.com

该款旗舰大模型发布仅十小时,便引发全球外媒关注。价格因素同样是关注焦点,报道普遍聚焦该模型 “成本更低、性能更优” 的特性,部分媒体还对其参数进行了详细解析与同类对比。目前该系列模型API调用价格低至输入0.8元/百万tokens、输出2元/百万tokens,远低于市场主流价格。cFe即热新闻——关注每天科技社会生活新变化gihot.com

28日模型发布后不到两个小时,X平台就在首页推荐了这款中国大模型。CNBC在28日报道称:“中国企业正在研发的人工智能模型不仅智能化水平提升,使用成本也持续降低,这与深度求索(DeepSeek)当年震动市场的突破核心优势相呼应。” 路透社28日在报道中提到,作为中国 “AI 六小虎” 之一的智谱,自今年6月被OpenAI“点名”后便备受关注。彭博社表示,OpenAI的挑战者智谱AI发布开源模型,试图在这个蓬勃发展的行业中抢占制高点。另一家美国知名科技媒体VentureBeat则在文章中指出:“GLM-4.5的发布为企业团队提供了一个可行的、高性能的基础模型。对于平衡创新和运营限制的团队来说,这是一个令人信服的选择。”发布后不到12小时,GLM-4.5模型已经位列国际开源社区Hugging-Face榜单全球第二。《环球时报》针对于该款模型进行整版报道,受到国内外业界高度关注。cFe即热新闻——关注每天科技社会生活新变化gihot.com

美国科技网站Techi 认为,中国AI发展正清晰呈现 “易获取” 的趋势:“智谱努力与深度求索、OpenAI等行业巨头同台竞技。随着更多企业推出开源模型并压低价格,中国正逐步成为全球AI竞争的核心参与者,力争占据领先地位。未来几个月,这些快速变化将带来何种影响——是催生新的监管政策,还是推动新的技术创新,仍有待观察。”cFe即热新闻——关注每天科技社会生活新变化gihot.com

受到大模型关注的除了这款大模型的性能,还有一个最大亮点是这是首款原生融合模型,首次在单个模型中实现将推理、编码和智能体能力原生融合,以满足智能体应用的复杂需求。cFe即热新闻——关注每天科技社会生活新变化gihot.com

大语言模型的目标是在广泛领域达到人类认知水平。然而,现有模型仍然算不上真正的通用模型:有些擅长编程,有些精于数学,有些在推理方面表现出色,但没有一个能在所有任务上都达到最佳表现。GLM-4.5正是朝着统一各种能力这一目标努力,力求在一个模型中集成所有这些不同的能力。大模型的下一个范式,一定是把各种能力整合到一起,成为一个“全优生”。cFe即热新闻——关注每天科技社会生活新变化gihot.com

图片2cFe即热新闻——关注每天科技社会生活新变化gihot.com

其次这款模型拥有更高的参数效率。GLM-4.5的参数量仅为一些主流模型的一半甚至三分之一,但在多项标准基准测试中表现得更为出色。在衡量模型代码能力的SWE-bench Verified 榜单上,GLM-4.5系列位于性能/参数比帕累托前沿,这表明在相同规模下,GLM-4.5系列实现了最佳性能。cFe即热新闻——关注每天科技社会生活新变化gihot.com

目前,这款集高性能、低成本和开源特性于一体的模型已在智谱开放平台上线。用户可通过智谱大模型开放平台使用该模型,其开源版本也将同步登陆Hugging Face与ModelScope平台。cFe即热新闻——关注每天科技社会生活新变化gihot.com

7月28日晚,北京智谱华章科技股份有限公司(以下简称"智谱AI")发布其新一代旗舰大模型GLM-4.5,这是一款专为智能体应用打造的基础模型,在复杂推理、代码生成及智能体交互等通用能力上实现能力融合与技术突破,综合测试性能已跻身全球领先行列。cFe即热新闻——关注每天科技社会生活新变化gihot.com

图片1cFe即热新闻——关注每天科技社会生活新变化gihot.com

这款新模型的发布,代表了AI迈向通用人工智能的一次重要转变。它不再满足于扮演一个被动回答问题的“聊天机器人”,而是要成为能够理解复杂目标、自主规划并执行多步骤任务的“全优生”。例如,模型能够胜任全栈开发任务,一键生成较为复杂的应用、游戏、交互网页。在实际例子中,用户通过z.ai使用该模型时,仅用一句简单的指令,就可让GLM-4.5独立开发出具备搜索功能的“谷歌”网站、可以发弹幕的“B站”,甚至直接上线一个完整的“Flappy Bird”小游戏。cFe即热新闻——关注每天科技社会生活新变化gihot.com

在性能评估中,GLM-4.5的表现展示了其架构优势。在涵盖研究生水平推理和复杂软件工程解题等12项全球公认的硬核测试中,其综合得分位列全球第三,在所有国产模型和开源模型中均排名第一。cFe即热新闻——关注每天科技社会生活新变化gihot.com

大型语言模型性能评估表,包含智能体、推理与编码基准测试数据(图源:智谱)cFe即热新闻——关注每天科技社会生活新变化gihot.com

该款旗舰大模型发布仅十小时,便引发全球外媒关注。价格因素同样是关注焦点,报道普遍聚焦该模型 “成本更低、性能更优” 的特性,部分媒体还对其参数进行了详细解析与同类对比。目前该系列模型API调用价格低至输入0.8元/百万tokens、输出2元/百万tokens,远低于市场主流价格。cFe即热新闻——关注每天科技社会生活新变化gihot.com

28日模型发布后不到两个小时,X平台就在首页推荐了这款中国大模型。CNBC在28日报道称:“中国企业正在研发的人工智能模型不仅智能化水平提升,使用成本也持续降低,这与深度求索(DeepSeek)当年震动市场的突破核心优势相呼应。” 路透社28日在报道中提到,作为中国 “AI 六小虎” 之一的智谱,自今年6月被OpenAI“点名”后便备受关注。彭博社表示,OpenAI的挑战者智谱AI发布开源模型,试图在这个蓬勃发展的行业中抢占制高点。另一家美国知名科技媒体VentureBeat则在文章中指出:“GLM-4.5的发布为企业团队提供了一个可行的、高性能的基础模型。对于平衡创新和运营限制的团队来说,这是一个令人信服的选择。”发布后不到12小时,GLM-4.5模型已经位列国际开源社区Hugging-Face榜单全球第二。《环球时报》针对于该款模型进行整版报道,受到国内外业界高度关注。cFe即热新闻——关注每天科技社会生活新变化gihot.com

美国科技网站Techi 认为,中国AI发展正清晰呈现 “易获取” 的趋势:“智谱努力与深度求索、OpenAI等行业巨头同台竞技。随着更多企业推出开源模型并压低价格,中国正逐步成为全球AI竞争的核心参与者,力争占据领先地位。未来几个月,这些快速变化将带来何种影响——是催生新的监管政策,还是推动新的技术创新,仍有待观察。”cFe即热新闻——关注每天科技社会生活新变化gihot.com

受到大模型关注的除了这款大模型的性能,还有一个最大亮点是这是首款原生融合模型,首次在单个模型中实现将推理、编码和智能体能力原生融合,以满足智能体应用的复杂需求。cFe即热新闻——关注每天科技社会生活新变化gihot.com

大语言模型的目标是在广泛领域达到人类认知水平。然而,现有模型仍然算不上真正的通用模型:有些擅长编程,有些精于数学,有些在推理方面表现出色,但没有一个能在所有任务上都达到最佳表现。GLM-4.5正是朝着统一各种能力这一目标努力,力求在一个模型中集成所有这些不同的能力。大模型的下一个范式,一定是把各种能力整合到一起,成为一个“全优生”。cFe即热新闻——关注每天科技社会生活新变化gihot.com

图片2cFe即热新闻——关注每天科技社会生活新变化gihot.com

其次这款模型拥有更高的参数效率。GLM-4.5的参数量仅为一些主流模型的一半甚至三分之一,但在多项标准基准测试中表现得更为出色。在衡量模型代码能力的SWE-bench Verified 榜单上,GLM-4.5系列位于性能/参数比帕累托前沿,这表明在相同规模下,GLM-4.5系列实现了最佳性能。cFe即热新闻——关注每天科技社会生活新变化gihot.com

目前,这款集高性能、低成本和开源特性于一体的模型已在智谱开放平台上线。用户可通过智谱大模型开放平台使用该模型,其开源版本也将同步登陆Hugging Face与ModelScope平台。cFe即热新闻——关注每天科技社会生活新变化gihot.com

本文链接:http://www.gihot.com/news-2-3196-0.html“北京造”大模型GLM-4.5开源 综合性能世界领先

声明:本网页内容由互联网博主自发贡献,不代表本站观点,本站不承担任何法律责任。天上不会到馅饼,请大家谨防诈骗!若有侵权等问题请及时与本网联系,我们将在第一时间删除处理。

上一篇:调查|外骨骼机器人火了!能干啥?哪儿能买?贵不贵?

下一篇:清华突破软体机器人操控难题 磁性机器人像“液滴”般移动

为你推荐
记者从中国载人航天工程办公室获悉,我国2025年计划发射神舟二十号、神舟二十一号两艘载人飞船和天舟九号货运飞船。1月20日,三次飞行任务的任务标识...
01-21
据《光子能源杂志》最新发表的一项研究称,以色列内盖夫本-古里安大学科学家开发出一种将液晶和纳米多孔微粒相结合的新方法,从而创造出一种能同时控...
01-24
    2024年12月28日,韩国游客文鉉堣(左后)一家在上海外滩合影。他们在圣诞节来到上海并计划游...
01-21
  预计今天(2月14日)开始,西南地区东部、江南、江淮、华南等地又将迎来一次明显降水过程,局地或现...
02-14
新闻通讯员 木子春运承载着亿万游子对家乡的眷恋与期盼,春节的脚步近了,归心似箭的人们纷纷踏上返乡之路。据交通运输等部门预计,今年春运全社会跨区域人员流动量将达到90亿人...
01-22
  中新经纬1月19日电 (薛宇飞)换了一部新手机,之前的旧手机怎么办?在消费补贴落地后,手机等数码产品市场出现什么变化?  近日,中新经纬走进二手闲置交易平台转转位于北京市朝...
01-21
1 月 26 日消息,日前特斯拉 Autopilot 高级软件工程师 Phil Duan 针对用户对特斯拉 FSD 技术的质疑作出回应,暗示公司在该领域取得了显著进展。一位长期持有特斯拉股...
01-27
1 月 27 日消息,雷军昨日发文称,小米汽车已和 13 家行业内优质运营商达成充电补能网络合作,超过 102 万充电桩入驻「小米充电地图」,今年的 Flag要成为“公用桩充电之王...
01-28
最近打开社交应用,总能看到关于《重症外伤中心》中白江赫选择成为急救医生的讨论。这一话题引发了广泛的关注,今天我们就来探讨一下白江赫的决定背后的原因。...
02-19
在璀璨夺目的娱乐圈内,何炅凭借其出色的主持能力和温文尔雅的气质,早已赢得了众多粉丝的喜爱与尊敬。然而,近日,这位年过半百的知名主持人再度成为话题中心,原因竟是他那令人惊叹...
02-22
  央广网北京1月3日消息(记者 雷妍)国家卫生健康委1月3日召开新闻发布会。会上,国家卫健委新闻发言人、宣传司副司长胡强强介绍,2025年全国卫生健康工作会议于近日召开,...
01-21
  ――医保、药监部门就集采药品问题答记者问  本报记者 孙秀艳  今年1月,有专家认为某些集采药品可能存在“血压不降、麻药不睡、泻药不泻”质量风险,有关部门迅...
02-11
  大众网记者 王一刚 报道  1.暖·冬至  冬至,在我国农历的舞台上,它不仅是一个至关重要的节气,更是一场阖家团圆、传承民俗的文化盛宴。  为了在幼儿心底种下传统...
01-21
2025年1月辽宁省普通高中学业水平合格性考试报名工作已于2024年11月24日结束。为满足考生需求,结合工作...
01-21
  近年来,随着个人消费贷款需求不断增长,不法贷款中介、电信诈骗不法人员盯上了这块“蛋糕”。...
01-24
  摘要  【“双焦”重挫,向下空间有多大?】前期利多预期兑现后,交易逻辑再次回归基本面,预计短...
02-06
天蝎座的男生通常都有着强烈的个人魅力和吸引力,因此很容易吸引到一些暗恋他们的女生。...
01-22
双子座的男生善于交际,聪明机智,喜欢追求新鲜刺激的感觉。然而,有时候他们也会变得烦躁不...
01-22
精彩纷呈的男装T台走秀:时尚与艺术的完美交融在时尚界,T台走秀是一场视觉盛宴,不仅是品牌展示新季服装的机会,更是模特与设计师艺术灵感的碰撞。今天,我想和大家分享一些关于男装...
02-07
走秀时刻:模特T台舞曲背后的节奏与魅力走进时尚秀场,灯光闪烁,摄影机的快门声此起彼伏,模特们如同展翅的蝴蝶,在T台上演绎着万千风情。而这一切的背后,离不开那一曲曲精心挑选的舞...
02-07
2月13日消息,转转集团发布春节期间(1月5日-2月5日)旗下平台二手潮奢商品的交易数据。春节期间,转转集团旗下的转转APP和红布林APP二手潮奢商品累计交易量同比增长25%;五线城市的...
02-14
又一奢侈品电商巨头将撤出中国。奢侈品电商平台Net-a-Porter近日发布公告称,公司将于3月20日关闭包括天猫、微信小程序、小红书、抖音旗舰店、公司网站和App在内的所有中国线...
02-18
2月22日消息,以“办好‘关键小事’ 托举幸福晚年”为主题的创新发展老年助餐服务座谈会近日在北京举行,饿了么总裁方永新在活动分享中表示,饿了么将在政策指引下,进一步深耕老年...
02-23
2月24日消息,飞猪数据显示,春运期间(1月14日-2月22日)出行的租车订单量再创新高,同比去年增长超40%,其中90后和00后占比约六成。三亚、海口、成都、昆明、广州等是春运期间租车消...
02-25
近日,华力创科学宣布完成数千万元A+轮融资,本轮融资由金属3D打印领域头部上市公司铂力特独家投资。据披露,本轮融资所募集的资金将专注于深挖高性能光学多模态感知技术,结合金属...
01-24
对于浪潮云来说,从2018年开始,IPO就是一个既定的战略。但时至今日,伴随着云计算市场的风云变幻,浪潮云的上市进程仍是一个进行时。近日,证监会官网披露...
02-07
近日,PlayStation Network(PSN)遭遇严重宕机,至今已超过24小时未恢复正常服务,导致全球玩家无法访问在线内容,甚至连单人数字游戏也受到影响。这一事件迅速在社交媒...
02-10
《街头霸王6》联动角色不知火舞已上线。近日油管主GoGa No Commentary分享了不知火舞被全角色花式KO合集,妹子被各种虐打,让人心疼。一起来欣赏下视频吧! 视频欣...
02-10
蛇年春节前夕一条拍摄于编组站的铁路版贪吃蛇短视频在网络上走红相关话题迅速冲上热搜吸引众多网友点赞留言“我还说能有多像……打开以后真的很像”“这家伙还能连续变道”...
02-07
2月9日是哈尔滨亚冬会开幕后的第二个比赛日,中国代表团以15金15银14铜继续领跑奖牌榜。在滑雪登山女子短距离、滑雪登山男子短距离、越野滑雪女子5公里(自由技术)、自由式滑雪...
02-10
返回

点击右上角微信好友

朋友圈

点击浏览器下方“”分享微信好友Safari浏览器请点击“”按钮

点击右上角QQ

点击浏览器下方“”分享QQ好友Safari浏览器请点击“”按钮