“北京造”大模型GLM-4.5开源 综合性能世界领先

6个月前 来源:千龙网 观看:88

7月28日晚,北京智谱华章科技股份有限公司(以下简称"智谱AI")发布其新一代旗舰大模型GLM-4.5,这是一款专为智能体应用打造的基础模型,在复杂推理、代码生成及智能体交互等通用能力上实现能力融合与技术突破,综合测试性能已跻身全球领先行列。nIA即热新闻——关注每天科技社会生活新变化gihot.com

图片1nIA即热新闻——关注每天科技社会生活新变化gihot.com

这款新模型的发布,代表了AI迈向通用人工智能的一次重要转变。它不再满足于扮演一个被动回答问题的“聊天机器人”,而是要成为能够理解复杂目标、自主规划并执行多步骤任务的“全优生”。例如,模型能够胜任全栈开发任务,一键生成较为复杂的应用、游戏、交互网页。在实际例子中,用户通过z.ai使用该模型时,仅用一句简单的指令,就可让GLM-4.5独立开发出具备搜索功能的“谷歌”网站、可以发弹幕的“B站”,甚至直接上线一个完整的“Flappy Bird”小游戏。nIA即热新闻——关注每天科技社会生活新变化gihot.com

在性能评估中,GLM-4.5的表现展示了其架构优势。在涵盖研究生水平推理和复杂软件工程解题等12项全球公认的硬核测试中,其综合得分位列全球第三,在所有国产模型和开源模型中均排名第一。nIA即热新闻——关注每天科技社会生活新变化gihot.com

大型语言模型性能评估表,包含智能体、推理与编码基准测试数据(图源:智谱)nIA即热新闻——关注每天科技社会生活新变化gihot.com

该款旗舰大模型发布仅十小时,便引发全球外媒关注。价格因素同样是关注焦点,报道普遍聚焦该模型 “成本更低、性能更优” 的特性,部分媒体还对其参数进行了详细解析与同类对比。目前该系列模型API调用价格低至输入0.8元/百万tokens、输出2元/百万tokens,远低于市场主流价格。nIA即热新闻——关注每天科技社会生活新变化gihot.com

28日模型发布后不到两个小时,X平台就在首页推荐了这款中国大模型。CNBC在28日报道称:“中国企业正在研发的人工智能模型不仅智能化水平提升,使用成本也持续降低,这与深度求索(DeepSeek)当年震动市场的突破核心优势相呼应。” 路透社28日在报道中提到,作为中国 “AI 六小虎” 之一的智谱,自今年6月被OpenAI“点名”后便备受关注。彭博社表示,OpenAI的挑战者智谱AI发布开源模型,试图在这个蓬勃发展的行业中抢占制高点。另一家美国知名科技媒体VentureBeat则在文章中指出:“GLM-4.5的发布为企业团队提供了一个可行的、高性能的基础模型。对于平衡创新和运营限制的团队来说,这是一个令人信服的选择。”发布后不到12小时,GLM-4.5模型已经位列国际开源社区Hugging-Face榜单全球第二。《环球时报》针对于该款模型进行整版报道,受到国内外业界高度关注。nIA即热新闻——关注每天科技社会生活新变化gihot.com

美国科技网站Techi 认为,中国AI发展正清晰呈现 “易获取” 的趋势:“智谱努力与深度求索、OpenAI等行业巨头同台竞技。随着更多企业推出开源模型并压低价格,中国正逐步成为全球AI竞争的核心参与者,力争占据领先地位。未来几个月,这些快速变化将带来何种影响——是催生新的监管政策,还是推动新的技术创新,仍有待观察。”nIA即热新闻——关注每天科技社会生活新变化gihot.com

受到大模型关注的除了这款大模型的性能,还有一个最大亮点是这是首款原生融合模型,首次在单个模型中实现将推理、编码和智能体能力原生融合,以满足智能体应用的复杂需求。nIA即热新闻——关注每天科技社会生活新变化gihot.com

大语言模型的目标是在广泛领域达到人类认知水平。然而,现有模型仍然算不上真正的通用模型:有些擅长编程,有些精于数学,有些在推理方面表现出色,但没有一个能在所有任务上都达到最佳表现。GLM-4.5正是朝着统一各种能力这一目标努力,力求在一个模型中集成所有这些不同的能力。大模型的下一个范式,一定是把各种能力整合到一起,成为一个“全优生”。nIA即热新闻——关注每天科技社会生活新变化gihot.com

图片2nIA即热新闻——关注每天科技社会生活新变化gihot.com

其次这款模型拥有更高的参数效率。GLM-4.5的参数量仅为一些主流模型的一半甚至三分之一,但在多项标准基准测试中表现得更为出色。在衡量模型代码能力的SWE-bench Verified 榜单上,GLM-4.5系列位于性能/参数比帕累托前沿,这表明在相同规模下,GLM-4.5系列实现了最佳性能。nIA即热新闻——关注每天科技社会生活新变化gihot.com

目前,这款集高性能、低成本和开源特性于一体的模型已在智谱开放平台上线。用户可通过智谱大模型开放平台使用该模型,其开源版本也将同步登陆Hugging Face与ModelScope平台。nIA即热新闻——关注每天科技社会生活新变化gihot.com

7月28日晚,北京智谱华章科技股份有限公司(以下简称"智谱AI")发布其新一代旗舰大模型GLM-4.5,这是一款专为智能体应用打造的基础模型,在复杂推理、代码生成及智能体交互等通用能力上实现能力融合与技术突破,综合测试性能已跻身全球领先行列。nIA即热新闻——关注每天科技社会生活新变化gihot.com

图片1nIA即热新闻——关注每天科技社会生活新变化gihot.com

这款新模型的发布,代表了AI迈向通用人工智能的一次重要转变。它不再满足于扮演一个被动回答问题的“聊天机器人”,而是要成为能够理解复杂目标、自主规划并执行多步骤任务的“全优生”。例如,模型能够胜任全栈开发任务,一键生成较为复杂的应用、游戏、交互网页。在实际例子中,用户通过z.ai使用该模型时,仅用一句简单的指令,就可让GLM-4.5独立开发出具备搜索功能的“谷歌”网站、可以发弹幕的“B站”,甚至直接上线一个完整的“Flappy Bird”小游戏。nIA即热新闻——关注每天科技社会生活新变化gihot.com

在性能评估中,GLM-4.5的表现展示了其架构优势。在涵盖研究生水平推理和复杂软件工程解题等12项全球公认的硬核测试中,其综合得分位列全球第三,在所有国产模型和开源模型中均排名第一。nIA即热新闻——关注每天科技社会生活新变化gihot.com

大型语言模型性能评估表,包含智能体、推理与编码基准测试数据(图源:智谱)nIA即热新闻——关注每天科技社会生活新变化gihot.com

该款旗舰大模型发布仅十小时,便引发全球外媒关注。价格因素同样是关注焦点,报道普遍聚焦该模型 “成本更低、性能更优” 的特性,部分媒体还对其参数进行了详细解析与同类对比。目前该系列模型API调用价格低至输入0.8元/百万tokens、输出2元/百万tokens,远低于市场主流价格。nIA即热新闻——关注每天科技社会生活新变化gihot.com

28日模型发布后不到两个小时,X平台就在首页推荐了这款中国大模型。CNBC在28日报道称:“中国企业正在研发的人工智能模型不仅智能化水平提升,使用成本也持续降低,这与深度求索(DeepSeek)当年震动市场的突破核心优势相呼应。” 路透社28日在报道中提到,作为中国 “AI 六小虎” 之一的智谱,自今年6月被OpenAI“点名”后便备受关注。彭博社表示,OpenAI的挑战者智谱AI发布开源模型,试图在这个蓬勃发展的行业中抢占制高点。另一家美国知名科技媒体VentureBeat则在文章中指出:“GLM-4.5的发布为企业团队提供了一个可行的、高性能的基础模型。对于平衡创新和运营限制的团队来说,这是一个令人信服的选择。”发布后不到12小时,GLM-4.5模型已经位列国际开源社区Hugging-Face榜单全球第二。《环球时报》针对于该款模型进行整版报道,受到国内外业界高度关注。nIA即热新闻——关注每天科技社会生活新变化gihot.com

美国科技网站Techi 认为,中国AI发展正清晰呈现 “易获取” 的趋势:“智谱努力与深度求索、OpenAI等行业巨头同台竞技。随着更多企业推出开源模型并压低价格,中国正逐步成为全球AI竞争的核心参与者,力争占据领先地位。未来几个月,这些快速变化将带来何种影响——是催生新的监管政策,还是推动新的技术创新,仍有待观察。”nIA即热新闻——关注每天科技社会生活新变化gihot.com

受到大模型关注的除了这款大模型的性能,还有一个最大亮点是这是首款原生融合模型,首次在单个模型中实现将推理、编码和智能体能力原生融合,以满足智能体应用的复杂需求。nIA即热新闻——关注每天科技社会生活新变化gihot.com

大语言模型的目标是在广泛领域达到人类认知水平。然而,现有模型仍然算不上真正的通用模型:有些擅长编程,有些精于数学,有些在推理方面表现出色,但没有一个能在所有任务上都达到最佳表现。GLM-4.5正是朝着统一各种能力这一目标努力,力求在一个模型中集成所有这些不同的能力。大模型的下一个范式,一定是把各种能力整合到一起,成为一个“全优生”。nIA即热新闻——关注每天科技社会生活新变化gihot.com

图片2nIA即热新闻——关注每天科技社会生活新变化gihot.com

其次这款模型拥有更高的参数效率。GLM-4.5的参数量仅为一些主流模型的一半甚至三分之一,但在多项标准基准测试中表现得更为出色。在衡量模型代码能力的SWE-bench Verified 榜单上,GLM-4.5系列位于性能/参数比帕累托前沿,这表明在相同规模下,GLM-4.5系列实现了最佳性能。nIA即热新闻——关注每天科技社会生活新变化gihot.com

目前,这款集高性能、低成本和开源特性于一体的模型已在智谱开放平台上线。用户可通过智谱大模型开放平台使用该模型,其开源版本也将同步登陆Hugging Face与ModelScope平台。nIA即热新闻——关注每天科技社会生活新变化gihot.com

本文链接:http://www.gihot.com/news-2-3196-0.html“北京造”大模型GLM-4.5开源 综合性能世界领先

声明:本网页内容由互联网博主自发贡献,不代表本站观点,本站不承担任何法律责任。天上不会到馅饼,请大家谨防诈骗!若有侵权等问题请及时与本网联系,我们将在第一时间删除处理。

上一篇:调查|外骨骼机器人火了!能干啥?哪儿能买?贵不贵?

下一篇:清华突破软体机器人操控难题 磁性机器人像“液滴”般移动

为你推荐
随着人类探索太空的脚步迈得越来越大,在月球上,甚至在火星上驻留并建设基地成为可能。想在月球上居住和旅行,水、氧气等生存资源和交通工具就不可或缺...
01-21
  中新社北京2月6日电(记者高凯)据猫眼专业版数据,截至北京时间2月6日13时25分,电影《哪吒之魔...
02-08
  作者:本报记者李晓东《光明日报》(2025年02月16日05版)  乐山甜皮鸭。周艺珣绘  【至味人...
02-18
  2025年,北京、杭州、深圳等多个城市相继迎来土拍“开门红”,为楼市持续增添暖意。  1月2日,...
01-21
新闻记者 康旭阳 通讯员 沈商轩实习生 何世银1月21日,全国手机、平板、智能手表(手环)购新补贴政策实施暨“年在荆楚 巳巳如意”湖北新春消费季启动仪式在武汉举行。新闻记者获...
01-22
  近期,国家发展改革委和财政部发布了《关于2025年加力扩围实施大规模设备更新和消费品以旧换...
01-24
  2月3日,生态环境部着手修改轻型汽车污染物排放限值及测量方法(中国第六阶段),《轻型汽车污染物...
02-06
《余烬之上》近日正式播出,这部备受期待的剧集在宣传阶段就引起了广泛关注。观众们对剧集的热情持续高涨,特别是第27集的剧情成为讨论的热点。当年,戚美华通过...
02-22
近期,追剧党们非常关注的话题是《只此江湖梦》在哪个平台播出。这部剧在各个短视频APP上爆火,引发了观众的热烈讨论。备受期待的剧集《只此江湖梦》定档于2月...
02-22
  新华社北京12月18日电 12月18日,《新华每日电讯》发表题为《人均预期78.6岁,如何迎接长寿“新常态”?》的报道。 &emsp...
01-21
21世纪经济报道记者 韩利明 上海报道2025年作为“十四五”规划收官之年,正风肃纪反腐走向纵深。医药行业因资金链长、权力集中、利润空间大...
02-09
  大众网记者 隋宜笑 报道  12月26日,山东政法学院党委委员、副校长胡晓清,山东政法学院传媒学院党总支书记徐永青,山东政法学院传媒学院副院长常洪卫等一行5人到访山东...
01-21
  2024年8月20日,我和弟弟参加了北京银行西安分行和华商网童学会联合举办的“京苗小记者”研学活动,不仅过了一把警察瘾,而且从中学到了很多的新知识。  怀着激动的心情,我...
01-21
  乌鲁木齐银行再次因股权拍卖引发市场关注。2025年1月19日,该行第三大股东深圳君豪集团有限公...
01-22
  推动科技型企业“知产”变“资产”,健全多层次的金融服务体系是关键。近日,金融管理部门先后...
01-23
水瓶座是黄道十二宫中的第十一宫,出生于1月20日至2月18日之间。他们被认为是最具创造力...
01-22
天蝎男是一个神秘而深沉的星座,他们喜欢与人保持一定的距离感,不轻易展示自己的内心世界...
01-22
揭开女明星内务:这背后的秘密与挑战当我们谈论女明星时,通常脑海中浮现的是华丽的红毯、璀璨的灯光,以及她们令人艳羡的生活。但在这些光鲜外表之下,她们的内务生活又是怎样的呢...
02-12
jeep品牌介绍? museum服饰品牌介绍?jeep品牌介绍?Jeep是一个具有历史和传奇色彩的汽车品牌,始于二战时期的美军轻型越野车。它的产品系列现包括了越野SUV、皮卡车和轿车等不同款...
02-12
2月14日消息,有网友近日发帖称,在长沙盒马门店偶遇阿里巴巴集团创始人马云。据网友表示,马云此次到访的是盒马长沙星沙万象汇店,不少网友在社交媒体上晒出了马云在门店考察的图...
02-14
阿里电商要增长,扶持商家是第一优先级。据晚点LatePost消息,2月2日(大年初五),阿里电商事业群CEO蒋凡召开小范围高管会,明确了2025年淘宝天猫的第一件大事是通过扶持优质品牌和商...
02-20
2月10日消息,美团外卖发布《年轻人春节送礼报告(2025)》,2025年春节期间,美团平台上“春节送礼”搜索量同比增速达165%,外卖餐饮礼券赠送量环比节前增长120%。其中95后消费者占比...
02-11
国内心理咨询行业的发展历程并不长,2000年之后才真正进入高速发展阶段。复旦大学心理健康与教育中心心理咨询师陈倩对《消费者报道...
03-04
全球性金融券商集团英国EBC Group平台始终致力于以领先生态,与全球交易者共塑交易的未来。 自第一届交易大赛起,为赤忱的热爱和卓越的才华提供舞台,在全球内寻找交易好手以赋能...
01-24
2024年12月2日、深圳市盛联投资控股有限公司(以下简称“盛联投资”)完成对江苏超级欧克人工智能科技有限公司(以下简称“欧克科技”)进行战略性投资,融...
02-07
四川资中一小孩因燃放鞭炮引起的沼气燃爆,致使8辆汽车受损一事,引起网友热议。 因为受损车辆包括林肯、雷克萨斯、奥迪、保时捷等豪华品牌,事件发生后,网上出现多...
02-03
据网络平台数据显示,截至1月31日11时55分,2025年春节档电影总票房(含预售)破40亿,再创新高。 其中,《哪吒之魔童闹海》、《唐探1900》、《封神第二部:战火西岐》分列...
02-03
极目新闻记者 周治涛“这一杯要敬侄女,感谢去年直播帮我卖山货赚了几千元。”大年初二,家住湖北宜昌鄂西山区五峰土家族自治县的曾春林,到舅舅家拜年,饭桌上舅舅对她连连致谢。...
02-04
今明两天(2月7日至8日),寒潮继续影响我国,中东部气温将陆续迎来这轮过程的最低点,并将大面积创今冬以来气温新低。同时,全国降水范围有所缩减,主要出现在东北地区、西南地区东部、...
02-07
返回

点击右上角微信好友

朋友圈

点击浏览器下方“”分享微信好友Safari浏览器请点击“”按钮

点击右上角QQ

点击浏览器下方“”分享QQ好友Safari浏览器请点击“”按钮