“北京造”大模型GLM-4.5开源 综合性能世界领先

9个月前 来源:千龙网 观看:140

7月28日晚,北京智谱华章科技股份有限公司(以下简称"智谱AI")发布其新一代旗舰大模型GLM-4.5,这是一款专为智能体应用打造的基础模型,在复杂推理、代码生成及智能体交互等通用能力上实现能力融合与技术突破,综合测试性能已跻身全球领先行列。mIp即热新闻——关注每天科技社会生活新变化gihot.com

图片1mIp即热新闻——关注每天科技社会生活新变化gihot.com

这款新模型的发布,代表了AI迈向通用人工智能的一次重要转变。它不再满足于扮演一个被动回答问题的“聊天机器人”,而是要成为能够理解复杂目标、自主规划并执行多步骤任务的“全优生”。例如,模型能够胜任全栈开发任务,一键生成较为复杂的应用、游戏、交互网页。在实际例子中,用户通过z.ai使用该模型时,仅用一句简单的指令,就可让GLM-4.5独立开发出具备搜索功能的“谷歌”网站、可以发弹幕的“B站”,甚至直接上线一个完整的“Flappy Bird”小游戏。mIp即热新闻——关注每天科技社会生活新变化gihot.com

在性能评估中,GLM-4.5的表现展示了其架构优势。在涵盖研究生水平推理和复杂软件工程解题等12项全球公认的硬核测试中,其综合得分位列全球第三,在所有国产模型和开源模型中均排名第一。mIp即热新闻——关注每天科技社会生活新变化gihot.com

大型语言模型性能评估表,包含智能体、推理与编码基准测试数据(图源:智谱)mIp即热新闻——关注每天科技社会生活新变化gihot.com

该款旗舰大模型发布仅十小时,便引发全球外媒关注。价格因素同样是关注焦点,报道普遍聚焦该模型 “成本更低、性能更优” 的特性,部分媒体还对其参数进行了详细解析与同类对比。目前该系列模型API调用价格低至输入0.8元/百万tokens、输出2元/百万tokens,远低于市场主流价格。mIp即热新闻——关注每天科技社会生活新变化gihot.com

28日模型发布后不到两个小时,X平台就在首页推荐了这款中国大模型。CNBC在28日报道称:“中国企业正在研发的人工智能模型不仅智能化水平提升,使用成本也持续降低,这与深度求索(DeepSeek)当年震动市场的突破核心优势相呼应。” 路透社28日在报道中提到,作为中国 “AI 六小虎” 之一的智谱,自今年6月被OpenAI“点名”后便备受关注。彭博社表示,OpenAI的挑战者智谱AI发布开源模型,试图在这个蓬勃发展的行业中抢占制高点。另一家美国知名科技媒体VentureBeat则在文章中指出:“GLM-4.5的发布为企业团队提供了一个可行的、高性能的基础模型。对于平衡创新和运营限制的团队来说,这是一个令人信服的选择。”发布后不到12小时,GLM-4.5模型已经位列国际开源社区Hugging-Face榜单全球第二。《环球时报》针对于该款模型进行整版报道,受到国内外业界高度关注。mIp即热新闻——关注每天科技社会生活新变化gihot.com

美国科技网站Techi 认为,中国AI发展正清晰呈现 “易获取” 的趋势:“智谱努力与深度求索、OpenAI等行业巨头同台竞技。随着更多企业推出开源模型并压低价格,中国正逐步成为全球AI竞争的核心参与者,力争占据领先地位。未来几个月,这些快速变化将带来何种影响——是催生新的监管政策,还是推动新的技术创新,仍有待观察。”mIp即热新闻——关注每天科技社会生活新变化gihot.com

受到大模型关注的除了这款大模型的性能,还有一个最大亮点是这是首款原生融合模型,首次在单个模型中实现将推理、编码和智能体能力原生融合,以满足智能体应用的复杂需求。mIp即热新闻——关注每天科技社会生活新变化gihot.com

大语言模型的目标是在广泛领域达到人类认知水平。然而,现有模型仍然算不上真正的通用模型:有些擅长编程,有些精于数学,有些在推理方面表现出色,但没有一个能在所有任务上都达到最佳表现。GLM-4.5正是朝着统一各种能力这一目标努力,力求在一个模型中集成所有这些不同的能力。大模型的下一个范式,一定是把各种能力整合到一起,成为一个“全优生”。mIp即热新闻——关注每天科技社会生活新变化gihot.com

图片2mIp即热新闻——关注每天科技社会生活新变化gihot.com

其次这款模型拥有更高的参数效率。GLM-4.5的参数量仅为一些主流模型的一半甚至三分之一,但在多项标准基准测试中表现得更为出色。在衡量模型代码能力的SWE-bench Verified 榜单上,GLM-4.5系列位于性能/参数比帕累托前沿,这表明在相同规模下,GLM-4.5系列实现了最佳性能。mIp即热新闻——关注每天科技社会生活新变化gihot.com

目前,这款集高性能、低成本和开源特性于一体的模型已在智谱开放平台上线。用户可通过智谱大模型开放平台使用该模型,其开源版本也将同步登陆Hugging Face与ModelScope平台。mIp即热新闻——关注每天科技社会生活新变化gihot.com

7月28日晚,北京智谱华章科技股份有限公司(以下简称"智谱AI")发布其新一代旗舰大模型GLM-4.5,这是一款专为智能体应用打造的基础模型,在复杂推理、代码生成及智能体交互等通用能力上实现能力融合与技术突破,综合测试性能已跻身全球领先行列。mIp即热新闻——关注每天科技社会生活新变化gihot.com

图片1mIp即热新闻——关注每天科技社会生活新变化gihot.com

这款新模型的发布,代表了AI迈向通用人工智能的一次重要转变。它不再满足于扮演一个被动回答问题的“聊天机器人”,而是要成为能够理解复杂目标、自主规划并执行多步骤任务的“全优生”。例如,模型能够胜任全栈开发任务,一键生成较为复杂的应用、游戏、交互网页。在实际例子中,用户通过z.ai使用该模型时,仅用一句简单的指令,就可让GLM-4.5独立开发出具备搜索功能的“谷歌”网站、可以发弹幕的“B站”,甚至直接上线一个完整的“Flappy Bird”小游戏。mIp即热新闻——关注每天科技社会生活新变化gihot.com

在性能评估中,GLM-4.5的表现展示了其架构优势。在涵盖研究生水平推理和复杂软件工程解题等12项全球公认的硬核测试中,其综合得分位列全球第三,在所有国产模型和开源模型中均排名第一。mIp即热新闻——关注每天科技社会生活新变化gihot.com

大型语言模型性能评估表,包含智能体、推理与编码基准测试数据(图源:智谱)mIp即热新闻——关注每天科技社会生活新变化gihot.com

该款旗舰大模型发布仅十小时,便引发全球外媒关注。价格因素同样是关注焦点,报道普遍聚焦该模型 “成本更低、性能更优” 的特性,部分媒体还对其参数进行了详细解析与同类对比。目前该系列模型API调用价格低至输入0.8元/百万tokens、输出2元/百万tokens,远低于市场主流价格。mIp即热新闻——关注每天科技社会生活新变化gihot.com

28日模型发布后不到两个小时,X平台就在首页推荐了这款中国大模型。CNBC在28日报道称:“中国企业正在研发的人工智能模型不仅智能化水平提升,使用成本也持续降低,这与深度求索(DeepSeek)当年震动市场的突破核心优势相呼应。” 路透社28日在报道中提到,作为中国 “AI 六小虎” 之一的智谱,自今年6月被OpenAI“点名”后便备受关注。彭博社表示,OpenAI的挑战者智谱AI发布开源模型,试图在这个蓬勃发展的行业中抢占制高点。另一家美国知名科技媒体VentureBeat则在文章中指出:“GLM-4.5的发布为企业团队提供了一个可行的、高性能的基础模型。对于平衡创新和运营限制的团队来说,这是一个令人信服的选择。”发布后不到12小时,GLM-4.5模型已经位列国际开源社区Hugging-Face榜单全球第二。《环球时报》针对于该款模型进行整版报道,受到国内外业界高度关注。mIp即热新闻——关注每天科技社会生活新变化gihot.com

美国科技网站Techi 认为,中国AI发展正清晰呈现 “易获取” 的趋势:“智谱努力与深度求索、OpenAI等行业巨头同台竞技。随着更多企业推出开源模型并压低价格,中国正逐步成为全球AI竞争的核心参与者,力争占据领先地位。未来几个月,这些快速变化将带来何种影响——是催生新的监管政策,还是推动新的技术创新,仍有待观察。”mIp即热新闻——关注每天科技社会生活新变化gihot.com

受到大模型关注的除了这款大模型的性能,还有一个最大亮点是这是首款原生融合模型,首次在单个模型中实现将推理、编码和智能体能力原生融合,以满足智能体应用的复杂需求。mIp即热新闻——关注每天科技社会生活新变化gihot.com

大语言模型的目标是在广泛领域达到人类认知水平。然而,现有模型仍然算不上真正的通用模型:有些擅长编程,有些精于数学,有些在推理方面表现出色,但没有一个能在所有任务上都达到最佳表现。GLM-4.5正是朝着统一各种能力这一目标努力,力求在一个模型中集成所有这些不同的能力。大模型的下一个范式,一定是把各种能力整合到一起,成为一个“全优生”。mIp即热新闻——关注每天科技社会生活新变化gihot.com

图片2mIp即热新闻——关注每天科技社会生活新变化gihot.com

其次这款模型拥有更高的参数效率。GLM-4.5的参数量仅为一些主流模型的一半甚至三分之一,但在多项标准基准测试中表现得更为出色。在衡量模型代码能力的SWE-bench Verified 榜单上,GLM-4.5系列位于性能/参数比帕累托前沿,这表明在相同规模下,GLM-4.5系列实现了最佳性能。mIp即热新闻——关注每天科技社会生活新变化gihot.com

目前,这款集高性能、低成本和开源特性于一体的模型已在智谱开放平台上线。用户可通过智谱大模型开放平台使用该模型,其开源版本也将同步登陆Hugging Face与ModelScope平台。mIp即热新闻——关注每天科技社会生活新变化gihot.com

本文链接:http://www.gihot.com/news-2-3187-0.html“北京造”大模型GLM-4.5开源 综合性能世界领先

声明:本网页内容由互联网博主自发贡献,不代表本站观点,本站不承担任何法律责任。天上不会到馅饼,请大家谨防诈骗!若有侵权等问题请及时与本网联系,我们将在第一时间删除处理。

上一篇:调查|外骨骼机器人火了!能干啥?哪儿能买?贵不贵?

下一篇:清华突破软体机器人操控难题 磁性机器人像“液滴”般移动

为你推荐
从“缴纳猫税”(海外用户发布宠物照片)到互相请教数学/英语,再到对工作时间、生活方式的提问,小红书无疑是国内外这几天最受关注的几...
01-21
  作者:本报记者鲁元珍《光明日报》(2025年02月06日15版)  到北方冰雪世界感受银装素裹的美景,...
02-07
  辽宁省气象台2月10日16时发布大风蓝色预警:  预计11日白天,沈阳、大连、鞍山北部、抚顺、锦州、阜...
02-11
新闻记者 康旭阳实习生 何世银通讯员 沈商轩1月21日,由商务部、中央广播电视总台、湖北省人民政府主办,湖北省商务厅、央视总台湖北总站、湖北省文旅厅、湖北省体育局、武汉市...
01-21
河南省会,在2024年特别拼。最能体现的数据是汽车产量。根据日前郑州公布的消息,2024年1-11月,郑州新能源汽车实际下线52.9万辆、增速...
01-21
1 月 21 日消息,小米集团董事长兼 CEO 雷军转发小米汽车副总裁李肖爽的微博,并称小米 SU7 上个月(2024年12月)交付量(25,815 辆)超过特斯拉 Model 3(21,046 辆)。李肖爽贴出...
01-21
1 月 23 日消息,鸿蒙智行昨日宣布推出“新春出行保障”服务,活动时间为 1 月 22 日(小年)-2 月 5 日(初八),活动对象为鸿蒙智行问界、智界、享界全系车主。整理活动内容如...
01-23
电视剧《余烬之上》中已死的角色有很多,以下是一些主要角色:廖知白:在剧中为了揭露真相、报仇雪恨,历经艰难险阻,最后和戚美华同归于尽。莱拉:为给闺蜜彩娜报仇,按...
02-21
电视剧《难哄》中的钟思乔职业成为了近期热门话题。该剧开拍前就吸引了大量粉丝,随着剧集播出,更多观众加入粉丝群体,对剧情充满期待,并对钟思乔的职业感到好奇...
02-22
21世纪经济报道记者季媛媛 上海报道 HPV是一种易感染人体表皮和黏膜鳞状上皮的病毒,已被发现有两百多种型别,根据致癌性的不同分为高危型别...
01-21
21世纪经济报道记者 韩利明 上海报道春节前,王晨(化名)家中未满一岁的幼儿突发咳嗽、流涕等症状。尽管卫生院就在隔壁,王晨还是选择驱车前往县...
02-02
SQL Error: select * from ***_ecms_news7 where id in(,162) limit 2
  摘要  【氧化铝大涨又大跌后市怎么走?】氧化铝价格大跌后反弹,此前一月内现货报价下跌1400...
01-21
广东省人民政府1月21日印发的《关于高质量发展资本市场助力广东现代化建设的若干措施》(下称《措...
01-23
当双鱼男第一次见到巨蟹女时,他会展现出一系列特定的表现。这些表现可以帮助我们更好地...
01-22
双子座的男生天性活泼开朗,善于交际,他们通常是聚会中最引人注目的人物。然而,有时候双子...
01-22
那些女明星背后的真实故事和不为人知的辛酸提到女明星,很多人脑海中浮现的都是她们在舞台上光鲜亮丽的模样。然而,在闪耀的灯光和聚光灯下,她们是否也有让人意想不到的经历和内...
02-07
揭秘女明星的私生活:光鲜背后隐藏的故事提到女明星,大家的第一反应可能是舞台上璀璨夺目的光环,以及那些充满魅力的红毯瞬间。可是,在这华丽的表象下,她们的私生活到底隐藏着哪些...
02-12
2月7日消息,东方甄选在微博发文称,近日,北京互联网法院就抖音用户崔某网络侵权案作出判决,认定被告发布言论不实,侵害了东方甄选名誉权,要求被告在抖音账号置顶道歉声明,并赔偿东方...
02-08
2月9日消息,齐心集团数字化运营平台近日接入DeepSeek大模型,推动AI大模型在数字化采购场景中的深度应用,为客户提供更全面、高效、完善的数智化解决方案。在DeepSeek技术的加持...
02-09
在中国制造的广阔市场里,许多传统工厂正经历着一场前所未有的转型。而其中的“厂二代”,成为这股变革的核心力量。“98年女老板” ...
02-11
3月5日消息,上海小方制药股份有限公司董事长方之光一行近日赴药易购参观交流,药易购董事长李燕飞陪同参观并出席战略合作洽谈会。双方就BC端融合共生、品牌价值共建、产业生态...
03-09
自去年底开始,黄金多头优势逐渐退却,国际现货黄金价格经历几次大跌后一度跌下2700关口,多空进入漫长的震荡周期,多头始终无法找到再度冲高的时机。  北京时间1月21日,国际现货...
01-24
近日,华力创科学宣布完成数千万元A+轮融资,本轮融资由金属3D打印领域头部上市公司铂力特独家投资。据披露,本轮融资所募集的资金将专注于深挖高性能光学多模态感知技术,结合金属...
01-24
近日,万代南梦宫为《深渊传说》注册了新商标,申请日期2025年为1月16日,公开日期为2025年1月24日。此前,在《传说》系列30周年纪念期间,万代南梦宫曾表示过除了《圣...
01-28
环球影业刚刚发布了《侏罗纪世界:重生》首支预告片,传奇动作巨星斯嘉丽·约翰逊领衔主演、突破性实力演员乔纳森·贝利与两届奥斯卡得主马赫沙拉·阿里倾情加盟,...
02-06
极目新闻通讯员 凌丽万“巳”大“集”闹新春,非遗技艺过大年。2月3日,正月初六,又恰逢二十四节气之首“立春”,为庆祝首个“非遗版”春节,弘扬中华优秀传统文化,寄托岁首美好期盼,...
02-04
南部战区海军航空兵某团组织多架固定翼反潜巡逻机开展跨昼夜飞行训练,锤炼部队全时、全域航空反潜作战能力。(央广网·军事频道作者:秦钱江)...
02-06
返回

点击右上角微信好友

朋友圈

点击浏览器下方“”分享微信好友Safari浏览器请点击“”按钮

点击右上角QQ

点击浏览器下方“”分享QQ好友Safari浏览器请点击“”按钮