“北京造”大模型GLM-4.5开源 综合性能世界领先

10个月前 来源:千龙网 观看:147

7月28日晚,北京智谱华章科技股份有限公司(以下简称"智谱AI")发布其新一代旗舰大模型GLM-4.5,这是一款专为智能体应用打造的基础模型,在复杂推理、代码生成及智能体交互等通用能力上实现能力融合与技术突破,综合测试性能已跻身全球领先行列。9mX即热新闻——关注每天科技社会生活新变化gihot.com

图片19mX即热新闻——关注每天科技社会生活新变化gihot.com

这款新模型的发布,代表了AI迈向通用人工智能的一次重要转变。它不再满足于扮演一个被动回答问题的“聊天机器人”,而是要成为能够理解复杂目标、自主规划并执行多步骤任务的“全优生”。例如,模型能够胜任全栈开发任务,一键生成较为复杂的应用、游戏、交互网页。在实际例子中,用户通过z.ai使用该模型时,仅用一句简单的指令,就可让GLM-4.5独立开发出具备搜索功能的“谷歌”网站、可以发弹幕的“B站”,甚至直接上线一个完整的“Flappy Bird”小游戏。9mX即热新闻——关注每天科技社会生活新变化gihot.com

在性能评估中,GLM-4.5的表现展示了其架构优势。在涵盖研究生水平推理和复杂软件工程解题等12项全球公认的硬核测试中,其综合得分位列全球第三,在所有国产模型和开源模型中均排名第一。9mX即热新闻——关注每天科技社会生活新变化gihot.com

大型语言模型性能评估表,包含智能体、推理与编码基准测试数据(图源:智谱)9mX即热新闻——关注每天科技社会生活新变化gihot.com

该款旗舰大模型发布仅十小时,便引发全球外媒关注。价格因素同样是关注焦点,报道普遍聚焦该模型 “成本更低、性能更优” 的特性,部分媒体还对其参数进行了详细解析与同类对比。目前该系列模型API调用价格低至输入0.8元/百万tokens、输出2元/百万tokens,远低于市场主流价格。9mX即热新闻——关注每天科技社会生活新变化gihot.com

28日模型发布后不到两个小时,X平台就在首页推荐了这款中国大模型。CNBC在28日报道称:“中国企业正在研发的人工智能模型不仅智能化水平提升,使用成本也持续降低,这与深度求索(DeepSeek)当年震动市场的突破核心优势相呼应。” 路透社28日在报道中提到,作为中国 “AI 六小虎” 之一的智谱,自今年6月被OpenAI“点名”后便备受关注。彭博社表示,OpenAI的挑战者智谱AI发布开源模型,试图在这个蓬勃发展的行业中抢占制高点。另一家美国知名科技媒体VentureBeat则在文章中指出:“GLM-4.5的发布为企业团队提供了一个可行的、高性能的基础模型。对于平衡创新和运营限制的团队来说,这是一个令人信服的选择。”发布后不到12小时,GLM-4.5模型已经位列国际开源社区Hugging-Face榜单全球第二。《环球时报》针对于该款模型进行整版报道,受到国内外业界高度关注。9mX即热新闻——关注每天科技社会生活新变化gihot.com

美国科技网站Techi 认为,中国AI发展正清晰呈现 “易获取” 的趋势:“智谱努力与深度求索、OpenAI等行业巨头同台竞技。随着更多企业推出开源模型并压低价格,中国正逐步成为全球AI竞争的核心参与者,力争占据领先地位。未来几个月,这些快速变化将带来何种影响——是催生新的监管政策,还是推动新的技术创新,仍有待观察。”9mX即热新闻——关注每天科技社会生活新变化gihot.com

受到大模型关注的除了这款大模型的性能,还有一个最大亮点是这是首款原生融合模型,首次在单个模型中实现将推理、编码和智能体能力原生融合,以满足智能体应用的复杂需求。9mX即热新闻——关注每天科技社会生活新变化gihot.com

大语言模型的目标是在广泛领域达到人类认知水平。然而,现有模型仍然算不上真正的通用模型:有些擅长编程,有些精于数学,有些在推理方面表现出色,但没有一个能在所有任务上都达到最佳表现。GLM-4.5正是朝着统一各种能力这一目标努力,力求在一个模型中集成所有这些不同的能力。大模型的下一个范式,一定是把各种能力整合到一起,成为一个“全优生”。9mX即热新闻——关注每天科技社会生活新变化gihot.com

图片29mX即热新闻——关注每天科技社会生活新变化gihot.com

其次这款模型拥有更高的参数效率。GLM-4.5的参数量仅为一些主流模型的一半甚至三分之一,但在多项标准基准测试中表现得更为出色。在衡量模型代码能力的SWE-bench Verified 榜单上,GLM-4.5系列位于性能/参数比帕累托前沿,这表明在相同规模下,GLM-4.5系列实现了最佳性能。9mX即热新闻——关注每天科技社会生活新变化gihot.com

目前,这款集高性能、低成本和开源特性于一体的模型已在智谱开放平台上线。用户可通过智谱大模型开放平台使用该模型,其开源版本也将同步登陆Hugging Face与ModelScope平台。9mX即热新闻——关注每天科技社会生活新变化gihot.com

7月28日晚,北京智谱华章科技股份有限公司(以下简称"智谱AI")发布其新一代旗舰大模型GLM-4.5,这是一款专为智能体应用打造的基础模型,在复杂推理、代码生成及智能体交互等通用能力上实现能力融合与技术突破,综合测试性能已跻身全球领先行列。9mX即热新闻——关注每天科技社会生活新变化gihot.com

图片19mX即热新闻——关注每天科技社会生活新变化gihot.com

这款新模型的发布,代表了AI迈向通用人工智能的一次重要转变。它不再满足于扮演一个被动回答问题的“聊天机器人”,而是要成为能够理解复杂目标、自主规划并执行多步骤任务的“全优生”。例如,模型能够胜任全栈开发任务,一键生成较为复杂的应用、游戏、交互网页。在实际例子中,用户通过z.ai使用该模型时,仅用一句简单的指令,就可让GLM-4.5独立开发出具备搜索功能的“谷歌”网站、可以发弹幕的“B站”,甚至直接上线一个完整的“Flappy Bird”小游戏。9mX即热新闻——关注每天科技社会生活新变化gihot.com

在性能评估中,GLM-4.5的表现展示了其架构优势。在涵盖研究生水平推理和复杂软件工程解题等12项全球公认的硬核测试中,其综合得分位列全球第三,在所有国产模型和开源模型中均排名第一。9mX即热新闻——关注每天科技社会生活新变化gihot.com

大型语言模型性能评估表,包含智能体、推理与编码基准测试数据(图源:智谱)9mX即热新闻——关注每天科技社会生活新变化gihot.com

该款旗舰大模型发布仅十小时,便引发全球外媒关注。价格因素同样是关注焦点,报道普遍聚焦该模型 “成本更低、性能更优” 的特性,部分媒体还对其参数进行了详细解析与同类对比。目前该系列模型API调用价格低至输入0.8元/百万tokens、输出2元/百万tokens,远低于市场主流价格。9mX即热新闻——关注每天科技社会生活新变化gihot.com

28日模型发布后不到两个小时,X平台就在首页推荐了这款中国大模型。CNBC在28日报道称:“中国企业正在研发的人工智能模型不仅智能化水平提升,使用成本也持续降低,这与深度求索(DeepSeek)当年震动市场的突破核心优势相呼应。” 路透社28日在报道中提到,作为中国 “AI 六小虎” 之一的智谱,自今年6月被OpenAI“点名”后便备受关注。彭博社表示,OpenAI的挑战者智谱AI发布开源模型,试图在这个蓬勃发展的行业中抢占制高点。另一家美国知名科技媒体VentureBeat则在文章中指出:“GLM-4.5的发布为企业团队提供了一个可行的、高性能的基础模型。对于平衡创新和运营限制的团队来说,这是一个令人信服的选择。”发布后不到12小时,GLM-4.5模型已经位列国际开源社区Hugging-Face榜单全球第二。《环球时报》针对于该款模型进行整版报道,受到国内外业界高度关注。9mX即热新闻——关注每天科技社会生活新变化gihot.com

美国科技网站Techi 认为,中国AI发展正清晰呈现 “易获取” 的趋势:“智谱努力与深度求索、OpenAI等行业巨头同台竞技。随着更多企业推出开源模型并压低价格,中国正逐步成为全球AI竞争的核心参与者,力争占据领先地位。未来几个月,这些快速变化将带来何种影响——是催生新的监管政策,还是推动新的技术创新,仍有待观察。”9mX即热新闻——关注每天科技社会生活新变化gihot.com

受到大模型关注的除了这款大模型的性能,还有一个最大亮点是这是首款原生融合模型,首次在单个模型中实现将推理、编码和智能体能力原生融合,以满足智能体应用的复杂需求。9mX即热新闻——关注每天科技社会生活新变化gihot.com

大语言模型的目标是在广泛领域达到人类认知水平。然而,现有模型仍然算不上真正的通用模型:有些擅长编程,有些精于数学,有些在推理方面表现出色,但没有一个能在所有任务上都达到最佳表现。GLM-4.5正是朝着统一各种能力这一目标努力,力求在一个模型中集成所有这些不同的能力。大模型的下一个范式,一定是把各种能力整合到一起,成为一个“全优生”。9mX即热新闻——关注每天科技社会生活新变化gihot.com

图片29mX即热新闻——关注每天科技社会生活新变化gihot.com

其次这款模型拥有更高的参数效率。GLM-4.5的参数量仅为一些主流模型的一半甚至三分之一,但在多项标准基准测试中表现得更为出色。在衡量模型代码能力的SWE-bench Verified 榜单上,GLM-4.5系列位于性能/参数比帕累托前沿,这表明在相同规模下,GLM-4.5系列实现了最佳性能。9mX即热新闻——关注每天科技社会生活新变化gihot.com

目前,这款集高性能、低成本和开源特性于一体的模型已在智谱开放平台上线。用户可通过智谱大模型开放平台使用该模型,其开源版本也将同步登陆Hugging Face与ModelScope平台。9mX即热新闻——关注每天科技社会生活新变化gihot.com

本文链接:http://www.gihot.com/news-2-3187-0.html“北京造”大模型GLM-4.5开源 综合性能世界领先

声明:本网页内容由互联网博主自发贡献,不代表本站观点,本站不承担任何法律责任。天上不会到馅饼,请大家谨防诈骗!若有侵权等问题请及时与本网联系,我们将在第一时间删除处理。

上一篇:调查|外骨骼机器人火了!能干啥?哪儿能买?贵不贵?

下一篇:清华突破软体机器人操控难题 磁性机器人像“液滴”般移动

为你推荐
核电站是将核能转化为电能的场所但是你知道吗?核电站现在还能有个副业那就是,产珍珠!又大又白的珍珠就是我国海南昌江核电站培育出来的昌江核电站不仅...
01-22
美国马里兰大学医学院外科团队在异种移植领域取得一项重要进展,他们在最新一期《自然·医学》杂志上发布了关于第二例基因编辑猪心脏移植案例...
01-24
  被T台十足宠幸的大廓形配饰近年来越来越多走上街头,成为时髦精的造型日常,尤在简约风愈发流行...
01-27
  2月6日,记者从省气象局获悉,1月全省平均降水量13.1毫米,比常年同期偏多2.2倍,为1961年以来历史同期第四...
02-07
  今年春运,从出行占比来说,公路客流量最大,自驾出行占比达到80%。如果说铁路出行大家最关注火车票,那么,公路出行大家更关心路上堵不堵、高速公路免费时限和电动车充电保障...
01-21
  中新经纬1月17日电 题:外贸“三量”齐升下有哪些商机?  作者 张建平 商务部国际贸易经济合作研究院学术委员会副主任  2024年,我国外贸实现了总量、增量、质量的“三量...
01-21
1 月 26 日消息,据韩联社报道,比亚迪韩国公司 24 日透露,截至 23 日,旗下纯电 SUV 车型“ATTO 3”(元 PLUS)在韩预售量突破 1000 辆关口。这距离比亚迪本月 16 日在韩国市...
01-27
2 月 2 日消息,比亚迪今日公布 1 月销售新车300538 辆,乘用车销售 296446 辆同比增长 47.5%。随后博主 @小迪快报 带来了具体销量明细。汇总各车型销量信息如下:王朝网...
02-03
《六姊妹》有几个女婿‌《六姊妹》中有9个女婿‌。这九个女婿分别是:‌张建国‌:何家丽的大女婿,出身军人,孤儿身份,被何家当家人何常胜看中,成为何家丽的伴侣‌...
02-20
最近,由几位优秀演员出演的电视剧《仙台有树》播出后,收视率和热度表现不俗。剧情紧凑,人物塑造生动,受到观众好评。剧中,在仙山之巅,薛冉冉成功筑基。然而,她遭遇...
02-21
21世纪经济报道记者 李佳英 广州报道近期,宁夏纪委监委反腐专题片《为了人民的利益》、贵州纪委监委专题片《纵深推进——贵州正风肃纪反腐...
01-21
  广州日报讯(全媒体记者张青梅通讯员吴丽婷、魏星)七岁的小李正处于身心快速发展的关键时期...
01-21
  大众网记者 隋宜笑 报道  为培养适应新时代需求的全媒体新闻人才搭建更为广阔、坚实的平台,进一步深化校企合作,12 月 17 日,山东传媒职业学院新闻传播系于产教中心报...
01-21
  大众网记者 司心鹏 报道  2024年,菏泽医学专科学校护理系坚持以立德树人为根本任务,全面落实“护教协同、岗课赛证”综合育人模式,构建了以校内竞赛为驱动、省级大赛...
01-21
  经济日报记者 武亚东  近年来,我国董责险市场呈现出快速增长的趋势。董责险是董事、监事及...
02-07
  原标题:1月份信托产品发行规模超300亿,基础产业类及金融类非标信托产品热度提升  财联社2月...
02-11
天蝎男是一个内敛而神秘的星座,他们往往不会轻易表露自己的感情。当他们暗恋一个人时,常...
01-22
狮子座的男生通常自信、热情和有领导力,因此要打动他们的心并不容易。然而,只要你掌握了...
01-22
绚丽星光:探索那些闪耀的女明星背后的故事在荧幕前,她们是令人倾倒的女明星,宛如璀璨的星星,照亮了无数人的生活。然而,在繁华的背后,这些女性经历了怎样的奋斗与变迁呢?作为一个长...
02-12
大家一般都喜欢什么潮流服饰品牌啊?大家一般都喜欢什么潮流服饰品牌啊?kenzo最近迷上这个牌子的衣服,虎头衬衫超级好看的。KENZO是由高田贤三在法国创立的品牌,结合了东方文化的...
02-12
2月9日消息,阿里云百炼全面上线DeepSeek-V3、DeepSeek-R1、DeepSeek-R1-Distill-Qwen-32B等6款模型,即日起所有用户可直接使用。DeepSeek-V3、DeepSeek-R1满血版可享各100万免...
02-09
无论是在忙碌的清晨,还是静谧的夜晚,一张面膜总能给疲惫的肌肤带来片刻慰藉。可是,看似普通的面膜,安全性却有天壤之别。毕竟,一旦面膜...
02-26
2月27日,九号公司(689009.SH)发布2024 年年度业绩快报。报告期内,该公司营业总收入为141.71亿元,同比增长38.63%;归母净利润10.88亿元,同...
03-01
全球性金融券商集团英国EBC Group平台始终致力于以领先生态,与全球交易者共塑交易的未来。 自第一届交易大赛起,为赤忱的热爱和卓越的才华提供舞台,在全球内寻找交易好手以赋能...
01-24
全球性金融券商集团英国EBC Group平台始终致力于以领先生态,与全球交易者共塑交易的未来。 自第一届交易大赛起,为赤忱的热爱和卓越的才华提供舞台,在全球内寻找交易好手以赋能...
02-09
近日,由国产人工智能初创公司杭州深度求索(DeepSeek)开发的大语言模型DeepSeek-R1引发了全球科技界的广泛关注。尤其是在中国与美国的技术竞争日益激烈的背景下,De...
01-29
育碧发布了截至2024 年 12 月 31 日的九个月财务报告,这家法国开发商和发行商重点介绍了即将推出的《刺客信条》游戏以及正在进行的成本削减计划,该计划已经导致...
02-15
极目新闻通讯员 李璐“太感谢你们了!这么短的时间,就帮我找回了背包,为我解决了大麻烦!”1月31日上午,张先生来到湖北枣阳市公安局北城派出所领回自己失而复得的背包,紧紧握住民警...
02-02
今天(2月3日)上午第九届亚洲冬季运动会火炬传递仪式在黑龙江哈尔滨启动火炬传递时间为1天传递总路线长约11公里火炬传递起点定在哈尔滨市道外区中华巴洛克街区这里是哈尔滨城...
02-03
返回

点击右上角微信好友

朋友圈

点击浏览器下方“”分享微信好友Safari浏览器请点击“”按钮

点击右上角QQ

点击浏览器下方“”分享QQ好友Safari浏览器请点击“”按钮