“北京造”大模型GLM-4.5开源 综合性能世界领先

9个月前 来源:千龙网 观看:131

7月28日晚,北京智谱华章科技股份有限公司(以下简称"智谱AI")发布其新一代旗舰大模型GLM-4.5,这是一款专为智能体应用打造的基础模型,在复杂推理、代码生成及智能体交互等通用能力上实现能力融合与技术突破,综合测试性能已跻身全球领先行列。QX4即热新闻——关注每天科技社会生活新变化gihot.com

图片1QX4即热新闻——关注每天科技社会生活新变化gihot.com

这款新模型的发布,代表了AI迈向通用人工智能的一次重要转变。它不再满足于扮演一个被动回答问题的“聊天机器人”,而是要成为能够理解复杂目标、自主规划并执行多步骤任务的“全优生”。例如,模型能够胜任全栈开发任务,一键生成较为复杂的应用、游戏、交互网页。在实际例子中,用户通过z.ai使用该模型时,仅用一句简单的指令,就可让GLM-4.5独立开发出具备搜索功能的“谷歌”网站、可以发弹幕的“B站”,甚至直接上线一个完整的“Flappy Bird”小游戏。QX4即热新闻——关注每天科技社会生活新变化gihot.com

在性能评估中,GLM-4.5的表现展示了其架构优势。在涵盖研究生水平推理和复杂软件工程解题等12项全球公认的硬核测试中,其综合得分位列全球第三,在所有国产模型和开源模型中均排名第一。QX4即热新闻——关注每天科技社会生活新变化gihot.com

大型语言模型性能评估表,包含智能体、推理与编码基准测试数据(图源:智谱)QX4即热新闻——关注每天科技社会生活新变化gihot.com

该款旗舰大模型发布仅十小时,便引发全球外媒关注。价格因素同样是关注焦点,报道普遍聚焦该模型 “成本更低、性能更优” 的特性,部分媒体还对其参数进行了详细解析与同类对比。目前该系列模型API调用价格低至输入0.8元/百万tokens、输出2元/百万tokens,远低于市场主流价格。QX4即热新闻——关注每天科技社会生活新变化gihot.com

28日模型发布后不到两个小时,X平台就在首页推荐了这款中国大模型。CNBC在28日报道称:“中国企业正在研发的人工智能模型不仅智能化水平提升,使用成本也持续降低,这与深度求索(DeepSeek)当年震动市场的突破核心优势相呼应。” 路透社28日在报道中提到,作为中国 “AI 六小虎” 之一的智谱,自今年6月被OpenAI“点名”后便备受关注。彭博社表示,OpenAI的挑战者智谱AI发布开源模型,试图在这个蓬勃发展的行业中抢占制高点。另一家美国知名科技媒体VentureBeat则在文章中指出:“GLM-4.5的发布为企业团队提供了一个可行的、高性能的基础模型。对于平衡创新和运营限制的团队来说,这是一个令人信服的选择。”发布后不到12小时,GLM-4.5模型已经位列国际开源社区Hugging-Face榜单全球第二。《环球时报》针对于该款模型进行整版报道,受到国内外业界高度关注。QX4即热新闻——关注每天科技社会生活新变化gihot.com

美国科技网站Techi 认为,中国AI发展正清晰呈现 “易获取” 的趋势:“智谱努力与深度求索、OpenAI等行业巨头同台竞技。随着更多企业推出开源模型并压低价格,中国正逐步成为全球AI竞争的核心参与者,力争占据领先地位。未来几个月,这些快速变化将带来何种影响——是催生新的监管政策,还是推动新的技术创新,仍有待观察。”QX4即热新闻——关注每天科技社会生活新变化gihot.com

受到大模型关注的除了这款大模型的性能,还有一个最大亮点是这是首款原生融合模型,首次在单个模型中实现将推理、编码和智能体能力原生融合,以满足智能体应用的复杂需求。QX4即热新闻——关注每天科技社会生活新变化gihot.com

大语言模型的目标是在广泛领域达到人类认知水平。然而,现有模型仍然算不上真正的通用模型:有些擅长编程,有些精于数学,有些在推理方面表现出色,但没有一个能在所有任务上都达到最佳表现。GLM-4.5正是朝着统一各种能力这一目标努力,力求在一个模型中集成所有这些不同的能力。大模型的下一个范式,一定是把各种能力整合到一起,成为一个“全优生”。QX4即热新闻——关注每天科技社会生活新变化gihot.com

图片2QX4即热新闻——关注每天科技社会生活新变化gihot.com

其次这款模型拥有更高的参数效率。GLM-4.5的参数量仅为一些主流模型的一半甚至三分之一,但在多项标准基准测试中表现得更为出色。在衡量模型代码能力的SWE-bench Verified 榜单上,GLM-4.5系列位于性能/参数比帕累托前沿,这表明在相同规模下,GLM-4.5系列实现了最佳性能。QX4即热新闻——关注每天科技社会生活新变化gihot.com

目前,这款集高性能、低成本和开源特性于一体的模型已在智谱开放平台上线。用户可通过智谱大模型开放平台使用该模型,其开源版本也将同步登陆Hugging Face与ModelScope平台。QX4即热新闻——关注每天科技社会生活新变化gihot.com

7月28日晚,北京智谱华章科技股份有限公司(以下简称"智谱AI")发布其新一代旗舰大模型GLM-4.5,这是一款专为智能体应用打造的基础模型,在复杂推理、代码生成及智能体交互等通用能力上实现能力融合与技术突破,综合测试性能已跻身全球领先行列。QX4即热新闻——关注每天科技社会生活新变化gihot.com

图片1QX4即热新闻——关注每天科技社会生活新变化gihot.com

这款新模型的发布,代表了AI迈向通用人工智能的一次重要转变。它不再满足于扮演一个被动回答问题的“聊天机器人”,而是要成为能够理解复杂目标、自主规划并执行多步骤任务的“全优生”。例如,模型能够胜任全栈开发任务,一键生成较为复杂的应用、游戏、交互网页。在实际例子中,用户通过z.ai使用该模型时,仅用一句简单的指令,就可让GLM-4.5独立开发出具备搜索功能的“谷歌”网站、可以发弹幕的“B站”,甚至直接上线一个完整的“Flappy Bird”小游戏。QX4即热新闻——关注每天科技社会生活新变化gihot.com

在性能评估中,GLM-4.5的表现展示了其架构优势。在涵盖研究生水平推理和复杂软件工程解题等12项全球公认的硬核测试中,其综合得分位列全球第三,在所有国产模型和开源模型中均排名第一。QX4即热新闻——关注每天科技社会生活新变化gihot.com

大型语言模型性能评估表,包含智能体、推理与编码基准测试数据(图源:智谱)QX4即热新闻——关注每天科技社会生活新变化gihot.com

该款旗舰大模型发布仅十小时,便引发全球外媒关注。价格因素同样是关注焦点,报道普遍聚焦该模型 “成本更低、性能更优” 的特性,部分媒体还对其参数进行了详细解析与同类对比。目前该系列模型API调用价格低至输入0.8元/百万tokens、输出2元/百万tokens,远低于市场主流价格。QX4即热新闻——关注每天科技社会生活新变化gihot.com

28日模型发布后不到两个小时,X平台就在首页推荐了这款中国大模型。CNBC在28日报道称:“中国企业正在研发的人工智能模型不仅智能化水平提升,使用成本也持续降低,这与深度求索(DeepSeek)当年震动市场的突破核心优势相呼应。” 路透社28日在报道中提到,作为中国 “AI 六小虎” 之一的智谱,自今年6月被OpenAI“点名”后便备受关注。彭博社表示,OpenAI的挑战者智谱AI发布开源模型,试图在这个蓬勃发展的行业中抢占制高点。另一家美国知名科技媒体VentureBeat则在文章中指出:“GLM-4.5的发布为企业团队提供了一个可行的、高性能的基础模型。对于平衡创新和运营限制的团队来说,这是一个令人信服的选择。”发布后不到12小时,GLM-4.5模型已经位列国际开源社区Hugging-Face榜单全球第二。《环球时报》针对于该款模型进行整版报道,受到国内外业界高度关注。QX4即热新闻——关注每天科技社会生活新变化gihot.com

美国科技网站Techi 认为,中国AI发展正清晰呈现 “易获取” 的趋势:“智谱努力与深度求索、OpenAI等行业巨头同台竞技。随着更多企业推出开源模型并压低价格,中国正逐步成为全球AI竞争的核心参与者,力争占据领先地位。未来几个月,这些快速变化将带来何种影响——是催生新的监管政策,还是推动新的技术创新,仍有待观察。”QX4即热新闻——关注每天科技社会生活新变化gihot.com

受到大模型关注的除了这款大模型的性能,还有一个最大亮点是这是首款原生融合模型,首次在单个模型中实现将推理、编码和智能体能力原生融合,以满足智能体应用的复杂需求。QX4即热新闻——关注每天科技社会生活新变化gihot.com

大语言模型的目标是在广泛领域达到人类认知水平。然而,现有模型仍然算不上真正的通用模型:有些擅长编程,有些精于数学,有些在推理方面表现出色,但没有一个能在所有任务上都达到最佳表现。GLM-4.5正是朝着统一各种能力这一目标努力,力求在一个模型中集成所有这些不同的能力。大模型的下一个范式,一定是把各种能力整合到一起,成为一个“全优生”。QX4即热新闻——关注每天科技社会生活新变化gihot.com

图片2QX4即热新闻——关注每天科技社会生活新变化gihot.com

其次这款模型拥有更高的参数效率。GLM-4.5的参数量仅为一些主流模型的一半甚至三分之一,但在多项标准基准测试中表现得更为出色。在衡量模型代码能力的SWE-bench Verified 榜单上,GLM-4.5系列位于性能/参数比帕累托前沿,这表明在相同规模下,GLM-4.5系列实现了最佳性能。QX4即热新闻——关注每天科技社会生活新变化gihot.com

目前,这款集高性能、低成本和开源特性于一体的模型已在智谱开放平台上线。用户可通过智谱大模型开放平台使用该模型,其开源版本也将同步登陆Hugging Face与ModelScope平台。QX4即热新闻——关注每天科技社会生活新变化gihot.com

本文链接:http://www.gihot.com/news-2-3187-0.html“北京造”大模型GLM-4.5开源 综合性能世界领先

声明:本网页内容由互联网博主自发贡献,不代表本站观点,本站不承担任何法律责任。天上不会到馅饼,请大家谨防诈骗!若有侵权等问题请及时与本网联系,我们将在第一时间删除处理。

上一篇:调查|外骨骼机器人火了!能干啥?哪儿能买?贵不贵?

下一篇:清华突破软体机器人操控难题 磁性机器人像“液滴”般移动

为你推荐
图源:图虫创意 还有10天就是除夕,作为2025蛇年春晚独家电商...
01-21
这两天,小红书“霸屏”了,成为网络热议话题。如果还有人不明所以,可以打开小红书App浏览一下,就会发现刷到外国博主的几率非常大,他们还给自己贴上了“T...
01-21
  春节的脚步日益临近,丹东市花卉市场迎来了一年中的销售旺季,品质优良的各式花卉被摆放在最显眼的位置...
01-22
  ◎刘侠本报记者滕继濮  2月4日,正值新春假期。四川自贡的夜空,被一盏盏精美绝伦的彩灯点缀...
02-11
  库迪咖啡回应不涨价:坚持9.9元价格策略,仍将给予联营商门店补贴  每经记者 李卓  近期,咖啡豆等原料价格持续上涨,引发市场对咖啡消费波动的普遍担忧,不少咖啡品牌纷纷以...
01-21
  首日销售突破1.7亿 6部新片争流春节档  记者 卢扬 实习记者 刘曼华  1月19日,据灯塔专业版,2025年春节档电影开启预售,截至1月19日21时40分,档期预售总票房已突破1.7亿...
01-21
  21世纪经济报道特约记者钱伯彦法兰克福报道  不出意料,奔驰的2024年并不好过。  1月10日...
01-21
[本站 资讯] 日前,比亚迪官方宣布,2025款汉家族OTA升级内测,本次升级包含5项新增功能和6项优化体验。值得一提的是,本次OTA升级,涉及不同款型配置,以实际收到的OTA推送内容...
01-24
最近热播的《大梁第一女仵作》受到许多观众的喜爱,大家不仅追剧热情高涨,还对情节和人物充满好奇。为了让大家更全面地了解这部电视剧,这里整理了一些相关信息...
02-19
  1、《爱你》电视剧原著小说叫《爱你,是我做过最好的事》,小说由笙离所著。  2、原著小说讲的是一个温暖的爱情故事,改编后的电视剧由张凌赫跟徐若晗领衔主演,即将上星江...
02-20
  记者从国家医保局了解到,12月1日,全国医保正式上线慢性阻塞性肺疾病、类风湿关节炎、冠心病、病毒性肝炎、强直性脊柱炎等5种门...
01-21
21世纪经济报道记者 唐唯珂 广州报道代糖产业也被卷入贸易压力。近期,中国赤藓糖醇行业面临来自欧盟和美国的双重贸易压力。2025年1月16日,...
02-08
  大众网记者 王一刚 报道  “秦时明月汉时关,万里长征人未还。”一首《出塞》传诵千年,以举行“赤子心·家国情”主题画展及宣讲为驱动,一堂基于语文课标要求的跨学科...
01-21
  大众网记者 司心鹏 通讯员 薛现伟 康宁 报道  12月8日,山东省职业院校技能大赛(高职组)“应用软件系统开发”赛项在山东工业职业学院举行,全省共57个参赛队,经过紧张角...
01-21
春节临近,各地返乡客流与出游人群交织,北京、深圳等城市的地铁站里人潮涌动,成为人们出行的关键枢...
01-27
  摘要  【每日龙虎榜】豆油增仓近8万手,烧碱减仓2万余手,日内资金净流入86.15亿元。一文带你...
02-08
在星座中,有一个特别能够理解和欣赏射手男性格的星座女子。她们与射手男之间有着特殊的...
01-22
金牛座的男生通常被认为是稳重、务实、有责任感的代表。如果你想吸引一个金牛男并让他...
01-22
模特写真与T台走秀:魅力与艺术的完美交融提到模特写真和T台走秀,我们的脑海中常常浮现出奢华的服装、专业的妆容和自信的身姿。作为时尚界的重要一环,它们不仅是品牌形象的代表...
02-07
魅力无限:帅气女明星带给我们的时尚风潮在当今娱乐圈,女明星们不仅仅是表演艺术的展现,更是时尚与个性的一种引领。在我看来,帅气女明星之所以吸引眼球,不仅在于她们的才华与美貌...
02-12
2月16日消息,时值服饰行业春季上新节点,快手电商男装运动行业联合快手电商中小商家行业、快手商业化男装运动行业发起“早春新风尚-男装运动鞋服焕新季”活动。2月12日-2月28...
02-17
2月20日消息,为帮助商家抓住微信电商增长机遇,微盟智慧零售与微商城解决方案已上线微盟小程序商城跳转微信小店能力,支持小程序“一键送礼”,实现流量高效转化。该功能旨在帮助...
02-21
图片来源:图虫创意 乳企仍在经历原奶下行周期的阵痛。2月1...
02-21
3月7日消息,飞猪宣布,自今年3月起,每月8日都将举办“全球旅行节”促销,首期2025年3月的“全球旅行节”报名商品总数已破万件。针对每月8日的促销活动,飞猪持续丰富营销渠道,加大流...
03-09
在农村义务教育学生营养改善计划备受瞩目的背景下,来自中粮福临门学生营养餐专用食用植物调和油的好消息让市场看到了团膳定制油方向的广阔空间。数据显示,自2024年8月上市以...
01-22
【#合肥市创业投资引导基金公司增资至59亿# 增幅23%】天眼查App显示,近日,合肥市创业投资引导基金有限公司发生工商变更,注册资本由约48.2亿人民币增至约59.2亿人民币,增幅约23%...
02-09
近日,中国台湾艺人大S(徐熙媛)因急性疾病在日本去世的传闻引发广泛关注和热议。 根据多家媒体最新报道,大S去世的消息不幸得到了证实,年仅48岁。 2月3日,小S经纪人发...
02-04
随着动漫游戏额不断发展,声优行业也越来越壮大,日前日本专业声优杂志发布“声优名鉴2025 女性篇”,记载现役声优人数已经达到了1099人。 ·要知道该名鉴在2001年...
02-12
记者今天(7日)从国家气候中心获悉,最新海温监测结果显示,赤道中东太平洋海温已进入拉尼娜状态,这也导致了我国东部地区这个冬季降水明显偏少。预测显示,拉尼娜状态将维持到春季中...
02-07
极目新闻记者 陈倩摄影记者 刘中灿“我们军工人真不容易。他们(指黄旭华和同事们)是搞水下的,比我们更艰难。”2月9日,在吊唁黄旭华的现场,中船集团701所的退休职工许志同深有感...
02-09
返回

点击右上角微信好友

朋友圈

点击浏览器下方“”分享微信好友Safari浏览器请点击“”按钮

点击右上角QQ

点击浏览器下方“”分享QQ好友Safari浏览器请点击“”按钮