“北京造”大模型GLM-4.5开源 综合性能世界领先

5个月前 来源:千龙网 观看:110

7月28日晚,北京智谱华章科技股份有限公司(以下简称"智谱AI")发布其新一代旗舰大模型GLM-4.5,这是一款专为智能体应用打造的基础模型,在复杂推理、代码生成及智能体交互等通用能力上实现能力融合与技术突破,综合测试性能已跻身全球领先行列。BRG即热新闻——关注每天科技社会生活新变化gihot.com

图片1BRG即热新闻——关注每天科技社会生活新变化gihot.com

这款新模型的发布,代表了AI迈向通用人工智能的一次重要转变。它不再满足于扮演一个被动回答问题的“聊天机器人”,而是要成为能够理解复杂目标、自主规划并执行多步骤任务的“全优生”。例如,模型能够胜任全栈开发任务,一键生成较为复杂的应用、游戏、交互网页。在实际例子中,用户通过z.ai使用该模型时,仅用一句简单的指令,就可让GLM-4.5独立开发出具备搜索功能的“谷歌”网站、可以发弹幕的“B站”,甚至直接上线一个完整的“Flappy Bird”小游戏。BRG即热新闻——关注每天科技社会生活新变化gihot.com

在性能评估中,GLM-4.5的表现展示了其架构优势。在涵盖研究生水平推理和复杂软件工程解题等12项全球公认的硬核测试中,其综合得分位列全球第三,在所有国产模型和开源模型中均排名第一。BRG即热新闻——关注每天科技社会生活新变化gihot.com

大型语言模型性能评估表,包含智能体、推理与编码基准测试数据(图源:智谱)BRG即热新闻——关注每天科技社会生活新变化gihot.com

该款旗舰大模型发布仅十小时,便引发全球外媒关注。价格因素同样是关注焦点,报道普遍聚焦该模型 “成本更低、性能更优” 的特性,部分媒体还对其参数进行了详细解析与同类对比。目前该系列模型API调用价格低至输入0.8元/百万tokens、输出2元/百万tokens,远低于市场主流价格。BRG即热新闻——关注每天科技社会生活新变化gihot.com

28日模型发布后不到两个小时,X平台就在首页推荐了这款中国大模型。CNBC在28日报道称:“中国企业正在研发的人工智能模型不仅智能化水平提升,使用成本也持续降低,这与深度求索(DeepSeek)当年震动市场的突破核心优势相呼应。” 路透社28日在报道中提到,作为中国 “AI 六小虎” 之一的智谱,自今年6月被OpenAI“点名”后便备受关注。彭博社表示,OpenAI的挑战者智谱AI发布开源模型,试图在这个蓬勃发展的行业中抢占制高点。另一家美国知名科技媒体VentureBeat则在文章中指出:“GLM-4.5的发布为企业团队提供了一个可行的、高性能的基础模型。对于平衡创新和运营限制的团队来说,这是一个令人信服的选择。”发布后不到12小时,GLM-4.5模型已经位列国际开源社区Hugging-Face榜单全球第二。《环球时报》针对于该款模型进行整版报道,受到国内外业界高度关注。BRG即热新闻——关注每天科技社会生活新变化gihot.com

美国科技网站Techi 认为,中国AI发展正清晰呈现 “易获取” 的趋势:“智谱努力与深度求索、OpenAI等行业巨头同台竞技。随着更多企业推出开源模型并压低价格,中国正逐步成为全球AI竞争的核心参与者,力争占据领先地位。未来几个月,这些快速变化将带来何种影响——是催生新的监管政策,还是推动新的技术创新,仍有待观察。”BRG即热新闻——关注每天科技社会生活新变化gihot.com

受到大模型关注的除了这款大模型的性能,还有一个最大亮点是这是首款原生融合模型,首次在单个模型中实现将推理、编码和智能体能力原生融合,以满足智能体应用的复杂需求。BRG即热新闻——关注每天科技社会生活新变化gihot.com

大语言模型的目标是在广泛领域达到人类认知水平。然而,现有模型仍然算不上真正的通用模型:有些擅长编程,有些精于数学,有些在推理方面表现出色,但没有一个能在所有任务上都达到最佳表现。GLM-4.5正是朝着统一各种能力这一目标努力,力求在一个模型中集成所有这些不同的能力。大模型的下一个范式,一定是把各种能力整合到一起,成为一个“全优生”。BRG即热新闻——关注每天科技社会生活新变化gihot.com

图片2BRG即热新闻——关注每天科技社会生活新变化gihot.com

其次这款模型拥有更高的参数效率。GLM-4.5的参数量仅为一些主流模型的一半甚至三分之一,但在多项标准基准测试中表现得更为出色。在衡量模型代码能力的SWE-bench Verified 榜单上,GLM-4.5系列位于性能/参数比帕累托前沿,这表明在相同规模下,GLM-4.5系列实现了最佳性能。BRG即热新闻——关注每天科技社会生活新变化gihot.com

目前,这款集高性能、低成本和开源特性于一体的模型已在智谱开放平台上线。用户可通过智谱大模型开放平台使用该模型,其开源版本也将同步登陆Hugging Face与ModelScope平台。BRG即热新闻——关注每天科技社会生活新变化gihot.com

7月28日晚,北京智谱华章科技股份有限公司(以下简称"智谱AI")发布其新一代旗舰大模型GLM-4.5,这是一款专为智能体应用打造的基础模型,在复杂推理、代码生成及智能体交互等通用能力上实现能力融合与技术突破,综合测试性能已跻身全球领先行列。BRG即热新闻——关注每天科技社会生活新变化gihot.com

图片1BRG即热新闻——关注每天科技社会生活新变化gihot.com

这款新模型的发布,代表了AI迈向通用人工智能的一次重要转变。它不再满足于扮演一个被动回答问题的“聊天机器人”,而是要成为能够理解复杂目标、自主规划并执行多步骤任务的“全优生”。例如,模型能够胜任全栈开发任务,一键生成较为复杂的应用、游戏、交互网页。在实际例子中,用户通过z.ai使用该模型时,仅用一句简单的指令,就可让GLM-4.5独立开发出具备搜索功能的“谷歌”网站、可以发弹幕的“B站”,甚至直接上线一个完整的“Flappy Bird”小游戏。BRG即热新闻——关注每天科技社会生活新变化gihot.com

在性能评估中,GLM-4.5的表现展示了其架构优势。在涵盖研究生水平推理和复杂软件工程解题等12项全球公认的硬核测试中,其综合得分位列全球第三,在所有国产模型和开源模型中均排名第一。BRG即热新闻——关注每天科技社会生活新变化gihot.com

大型语言模型性能评估表,包含智能体、推理与编码基准测试数据(图源:智谱)BRG即热新闻——关注每天科技社会生活新变化gihot.com

该款旗舰大模型发布仅十小时,便引发全球外媒关注。价格因素同样是关注焦点,报道普遍聚焦该模型 “成本更低、性能更优” 的特性,部分媒体还对其参数进行了详细解析与同类对比。目前该系列模型API调用价格低至输入0.8元/百万tokens、输出2元/百万tokens,远低于市场主流价格。BRG即热新闻——关注每天科技社会生活新变化gihot.com

28日模型发布后不到两个小时,X平台就在首页推荐了这款中国大模型。CNBC在28日报道称:“中国企业正在研发的人工智能模型不仅智能化水平提升,使用成本也持续降低,这与深度求索(DeepSeek)当年震动市场的突破核心优势相呼应。” 路透社28日在报道中提到,作为中国 “AI 六小虎” 之一的智谱,自今年6月被OpenAI“点名”后便备受关注。彭博社表示,OpenAI的挑战者智谱AI发布开源模型,试图在这个蓬勃发展的行业中抢占制高点。另一家美国知名科技媒体VentureBeat则在文章中指出:“GLM-4.5的发布为企业团队提供了一个可行的、高性能的基础模型。对于平衡创新和运营限制的团队来说,这是一个令人信服的选择。”发布后不到12小时,GLM-4.5模型已经位列国际开源社区Hugging-Face榜单全球第二。《环球时报》针对于该款模型进行整版报道,受到国内外业界高度关注。BRG即热新闻——关注每天科技社会生活新变化gihot.com

美国科技网站Techi 认为,中国AI发展正清晰呈现 “易获取” 的趋势:“智谱努力与深度求索、OpenAI等行业巨头同台竞技。随着更多企业推出开源模型并压低价格,中国正逐步成为全球AI竞争的核心参与者,力争占据领先地位。未来几个月,这些快速变化将带来何种影响——是催生新的监管政策,还是推动新的技术创新,仍有待观察。”BRG即热新闻——关注每天科技社会生活新变化gihot.com

受到大模型关注的除了这款大模型的性能,还有一个最大亮点是这是首款原生融合模型,首次在单个模型中实现将推理、编码和智能体能力原生融合,以满足智能体应用的复杂需求。BRG即热新闻——关注每天科技社会生活新变化gihot.com

大语言模型的目标是在广泛领域达到人类认知水平。然而,现有模型仍然算不上真正的通用模型:有些擅长编程,有些精于数学,有些在推理方面表现出色,但没有一个能在所有任务上都达到最佳表现。GLM-4.5正是朝着统一各种能力这一目标努力,力求在一个模型中集成所有这些不同的能力。大模型的下一个范式,一定是把各种能力整合到一起,成为一个“全优生”。BRG即热新闻——关注每天科技社会生活新变化gihot.com

图片2BRG即热新闻——关注每天科技社会生活新变化gihot.com

其次这款模型拥有更高的参数效率。GLM-4.5的参数量仅为一些主流模型的一半甚至三分之一,但在多项标准基准测试中表现得更为出色。在衡量模型代码能力的SWE-bench Verified 榜单上,GLM-4.5系列位于性能/参数比帕累托前沿,这表明在相同规模下,GLM-4.5系列实现了最佳性能。BRG即热新闻——关注每天科技社会生活新变化gihot.com

目前,这款集高性能、低成本和开源特性于一体的模型已在智谱开放平台上线。用户可通过智谱大模型开放平台使用该模型,其开源版本也将同步登陆Hugging Face与ModelScope平台。BRG即热新闻——关注每天科技社会生活新变化gihot.com

本文链接:http://www.gihot.com/news-2-3187-0.html“北京造”大模型GLM-4.5开源 综合性能世界领先

声明:本网页内容由互联网博主自发贡献,不代表本站观点,本站不承担任何法律责任。天上不会到馅饼,请大家谨防诈骗!若有侵权等问题请及时与本网联系,我们将在第一时间删除处理。

上一篇:调查|外骨骼机器人火了!能干啥?哪儿能买?贵不贵?

下一篇:清华突破软体机器人操控难题 磁性机器人像“液滴”般移动

为你推荐
从“缴纳猫税”(海外用户发布宠物照片)到互相请教数学/英语,再到对工作时间、生活方式的提问,小红书无疑是国内外这几天最受关注的几...
01-21
记忆力衰退,言语令人费解,行为变得怪异,突然发脾气、摔东西,曾经游刃有余的工作如今变得力不从心,甚至生活难以自理……一些老年人的性格和...
01-22
今晚夜间全省晴有时多云最低气温沈阳、抚顺、本溪、阜新、辽阳、铁岭、朝阳地区和沈抚示范区零下28℃到...
01-30
  辽宁省海洋预警监测中心2月6日16时发布海浪Ⅳ级蓝色警报。  受强冷空气影响,预计6日夜间至7日白天...
02-07
  1月20日,北京住房公积金管理中心(以下简称“公积金中心”)发布《关于开展提取住房公积金直付...
01-21
春节临近,年味渐浓。每到除夕前几天,置办年货成了消费者日常生活中的“头等大事”。年货种类繁多,尤其是食品类年货更是多种多样,其中又以四川特产年货最受全国消费者欢迎。从麻...
01-22
为了呈现安全可靠的驾驶乐趣,全新BMW X3“炼狱式”测试有多猛?据悉,在全新BMW X3实际路试中,全球共运行了500余辆测试车,测试总里程达200万公里,相当于绕行赤道50圈。纯粹驾驶乐趣...
01-21
[本站 新车上市] 1月10日,特斯拉Model Y焕新版价格公布,共推出2款配置,售价分别为26.35万和30.35万。焕新Model Y首发版不仅拥有首发版标识,包括尾门徽章、迎宾灯徽章投...
01-21
近期,电视剧《难哄》在各大短视频平台爆火,剧中苏浩安的官配成为追剧党热议的话题。大家都对苏浩安和钟思乔的感情线充满兴趣。《难哄》这部电视剧中,苏浩安和...
02-20
最近打开社交app时,经常能看到关于“许食堂韩剧女主是谁演的”的讨论。《许食堂》是一部备受期待的韩剧,由EXY秋昭贞和金珉锡主演,讲述了一段奇幻又浪漫的喜剧...
02-20
21世纪经济报道记者 唐唯珂 广州报道社会办医的洗牌期仍在继续。2025年1月,新华医疗挂牌转让旗下山东新华昌国医院投资管理有限公司55%股权...
01-25
21世纪经济报道记者 韩利明 上海报道随着四大跨国疫苗企业辉瑞、葛兰素史克(GSK)、默沙东、赛诺菲陆续发布2024年业绩,21世纪经济报道记者依...
02-11
澎湃新闻记者从中国科学院大学资源与环境学院方面获悉,中国科学院大学资...
01-21
  大众网记者 司心鹏 报道  12月24日上午,廉洁文化进学校暨“青春·清菏韵泽”廉洁文化馆开馆仪式在菏泽职业学院举行。市委常委、市纪委书记、市监委主任赵永强、市...
01-21
  四家上市险企业绩预增  股债共振推动利润预期改善  □记者 张小洁 北京报道  中国太...
02-05
  2024年年底,成都新易盛通信技术股份有限公司(以下简称“新易盛”)发布公告称,收到公司控股股东...
02-06
星座配对一直是人们关注的话题,其中双子座男和处女座女的组合备受瞩目。他们之间的配对...
01-22
狮子座的男生通常自信、热情和有领导力,他们喜欢成为注意的焦点。如果你想让一个狮子男...
01-22
T恤穿搭技巧? 男士t恤衫穿搭技巧?一、T恤穿搭技巧?01 T恤+吊带裙简约T恤与长款吊带连衣裙搭配,优雅大气,而且能凸显优美的身材曲线。手臂粗的姑娘们,可以选择袖子宽松的T恤,腰部较...
02-12
当衣橱成为画布:那些穿衣大胆的女明星在娱乐圈中,总有一些女明星以她们的穿衣风格而引人注目。她们不仅是在荧幕上出镜,更是在影响着时尚的潮流。选择挑战常规、突破传统的服装...
02-17
2月19日消息,小红书电商日前正式启动运营服务商招募,通过运营服务商的专业化能力和经验,为商家提供账号定位、内容打造、直播操盘、店铺运营、投流推广、货盘供应等服务,加速潜...
02-20
2月20日消息,为帮助商家抓住微信电商增长机遇,微盟智慧零售与微商城解决方案已上线微盟小程序商城跳转微信小店能力,支持小程序“一键送礼”,实现流量高效转化。该功能旨在帮助...
02-21
中国火锅品牌正在逐步打开中东市场的大门。近年来,刘一手、海底捞、小龙坎、哥老官等在中国各城市常见的连锁火锅品牌,纷纷进入中东...
03-01
3月1日消息,曹操出行日前举办曹操智行自动驾驶平台上线仪式,宣布已成功构建国内首个“F立方”全域自研闭环智驾生态,同时在苏杭两地开启Robotaxi运营试点,并投放搭载吉利最新智...
03-01
自去年底开始,黄金多头优势逐渐退却,国际现货黄金价格经历几次大跌后一度跌下2700关口,多空进入漫长的震荡周期,多头始终无法找到再度冲高的时机。  北京时间1月21日,国际现货...
01-24
近日,华力创科学宣布完成数千万元A+轮融资,本轮融资由金属3D打印领域头部上市公司铂力特独家投资。据披露,本轮融资所募集的资金将专注于深挖高性能光学多模态感知技术,结合金属...
01-24
根据外媒的一份新报告,法国外设厂商NACON称他们预计公司2025/2026财年上半年的销量将大幅增长,作为增长的其中一个原因,他们认为任天堂Switch 2将在此期间发布,即2...
01-22
根据网络安全研究人员 Shalzuth 在博客上发布的一篇报告称,目前 Steam 上最受欢迎的多人游戏之一《漫威争锋》存在着“巨大安全漏洞”。 据称,该漏洞可以让黑...
02-13
据央视新闻报道,乌克兰总统泽连斯基2月1日在接受采访时称,乌克兰实际所获得的来自美国的支持远低于美方声称的数额,巨大的差额去哪儿了?他也不知道。据报道,泽连斯基在接受采访时...
02-04
极目新闻记者 肖名远2月3日晚,广东湛江徐闻县西连镇发生一起火灾,一对父子在救火时遇难,另有四人严重受伤。因经济困难,伤者的家人在网上发起求助,一天内就获得各方好心人的50万...
02-06
返回

点击右上角微信好友

朋友圈

点击浏览器下方“”分享微信好友Safari浏览器请点击“”按钮

点击右上角QQ

点击浏览器下方“”分享QQ好友Safari浏览器请点击“”按钮