解决传统架构记忆瓶颈 MiniMax发布新一代模型

1年前 来源:新京报 观看:327

1月15日,“AI六小虎”之一的MiniMax发布并开源了新一代01系列模型,包含基础语言大模型MiniMax-Text-01和视觉多模态大模型MiniMax-VL-01。该系列模型使用多项突破性创新,以大规模应用线性注意力机制打破了Transformer传统架构的记忆瓶颈。X2h即热新闻——关注每天科技社会生活新变化gihot.com

未来,AI智能体有望成为最重要的产品形态,由于智能体处理的任务变得越来越复杂,涉及的数据量也越来越大,单个智能体的记忆以及多个智能体协作间的上下文都会变得越来越长。因此,长上下文能力与多模态处理能力的提升至关重要。X2h即热新闻——关注每天科技社会生活新变化gihot.com

技术上,MiniMax-01系列模型首次将线性注意力机制扩展到商用模型的级别,受益于此次架构创新,该系列模型在处理长输入的时候具有非常高的效率,接近线性复杂度。从规模效应、结构设计、训练优化和推理优化等层面综合考虑,MiniMax选择模型参数量为4560亿,其中每次激活459亿,能够高效处理400万token的上下文,将有效替代Transformer传统架构并开启超长文本输入时代。相较于Gemini等一众全球顶级模型,MiniMax-01随着输入长度变长,性能衰减最慢。X2h即热新闻——关注每天科技社会生活新变化gihot.com

值得注意的是,MiniMax还开源了Text-01模型、VL-01模型的完整权重,以便于更多开发者做有价值、突破性的研究。MiniMax方面表示,“我们认为这有可能启发更多长上下文的研究和应用,从而更快促进Agent时代的到来,二是开源也能促使我们努力做更多创新,更高质量地开展后续的模型研发工作。”X2h即热新闻——关注每天科技社会生活新变化gihot.com

1月15日,“AI六小虎”之一的MiniMax发布并开源了新一代01系列模型,包含基础语言大模型MiniMax-Text-01和视觉多模态大模型MiniMax-VL-01。该系列模型使用多项突破性创新,以大规模应用线性注意力机制打破了Transformer传统架构的记忆瓶颈。X2h即热新闻——关注每天科技社会生活新变化gihot.com

未来,AI智能体有望成为最重要的产品形态,由于智能体处理的任务变得越来越复杂,涉及的数据量也越来越大,单个智能体的记忆以及多个智能体协作间的上下文都会变得越来越长。因此,长上下文能力与多模态处理能力的提升至关重要。X2h即热新闻——关注每天科技社会生活新变化gihot.com

技术上,MiniMax-01系列模型首次将线性注意力机制扩展到商用模型的级别,受益于此次架构创新,该系列模型在处理长输入的时候具有非常高的效率,接近线性复杂度。从规模效应、结构设计、训练优化和推理优化等层面综合考虑,MiniMax选择模型参数量为4560亿,其中每次激活459亿,能够高效处理400万token的上下文,将有效替代Transformer传统架构并开启超长文本输入时代。相较于Gemini等一众全球顶级模型,MiniMax-01随着输入长度变长,性能衰减最慢。X2h即热新闻——关注每天科技社会生活新变化gihot.com

值得注意的是,MiniMax还开源了Text-01模型、VL-01模型的完整权重,以便于更多开发者做有价值、突破性的研究。MiniMax方面表示,“我们认为这有可能启发更多长上下文的研究和应用,从而更快促进Agent时代的到来,二是开源也能促使我们努力做更多创新,更高质量地开展后续的模型研发工作。”X2h即热新闻——关注每天科技社会生活新变化gihot.com

本文链接:http://www.gihot.com/news-2-195-0.html解决传统架构记忆瓶颈 MiniMax发布新一代模型

声明:本网页内容由互联网博主自发贡献,不代表本站观点,本站不承担任何法律责任。天上不会到馅饼,请大家谨防诈骗!若有侵权等问题请及时与本网联系,我们将在第一时间删除处理。

上一篇:深瞳丨AI为药物研发按下“快进键”

下一篇:丝巾变色、火柴变玫瑰 年货节期间淘宝魔术道具销量大增174%

为你推荐
2025年1月16日,华为车BU业务“继承者”引望迎来了成立的第一周年。引望全名为深圳引望智能技术有限公司,成立于2024年1月16日,彼时为...
01-21
1月13日,科技日报记者来到河北省唐山市220千伏君瑞变电站设备间,看到一只智能巡检“机器狗”正在一台变电设备前执行任务,不时伸出背上的伸缩臂探视设...
01-22
  1月26日起,我省迎来强降雪寒潮大风天气。省住房城乡建设厅根据气象部门预报信息,提前印发通知,要求各...
01-28
近日我省这些事业单位发布招聘公告一起来看看1中国医科大学及附属医院  招聘岗位:本次公开招聘3个岗位...
02-18
  (央视财经《经济信息联播》)春节临近,很多养宠物的人也着手准备,给宠物洗澡护理穿新衣,让它们精精神神、干干净净过年。  在云南昆明的不少宠物门店里,给宠物做洗护美容...
01-22
  中新经纬1月19日电 (薛宇飞)换了一部新手机,之前的旧手机怎么办?在消费补贴落地后,手机等数码产品市场出现什么变化?  近日,中新经纬走进二手闲置交易平台转转位于北京市朝...
01-21
[本站 资讯] 日前,我们从官方获悉,捷达VA7将会在明日(1月12日)正式上市,车辆定位国民家轿,是一款紧凑型车,使用1.4T动力,此前预售价为11.8777万元起。在上个月,捷达VA7就完成...
01-21
2 月 2 日消息,继昨日多位博主分享了蔚来 5 年 0 息购车优惠海报后,蔚来官方公布了限时金融优惠更多细节:用户 2025 年 2 月 1 日至 2 月 28 日期间支付定金购买蔚来,可...
02-02
《难哄》向朗喜欢钟思乔吗?向朗和钟思乔什么关系?在《难哄》中,向朗不喜欢钟思乔。向朗是温以凡和钟思乔的发小,他与钟思乔只是朋友关系,没有爱情方面的感情。向...
02-19
在《六姊妹》中,汤为民的腿断了。‌汤为民是汤家的长子,他与何家丽是青梅竹马,两人感情深厚,但由于汤家与何家之间的恩怨,汤为民被迫与何家丽分开,最终在家庭的安...
02-20
编者按:一个人工智能(AI)机器人,在短短8天内独立完成了668项实验,合成了668种化合物,并成功研发出一种全新的化学催化剂。这一壮举令人赞叹。AI...
02-11
21世纪经济报道记者季媛媛 上海报道 2025年,DeepSeek火爆出圈。借力DeepSeek技术的加持,人工智能(AI)技术正深度重塑医药健康行业格局。当下,...
02-18
小朋友们走进小区消防监控中心参观  每逢假期,“谁来带娃”“怎么带娃”,让不少家长犯愁。近日,全国妇联、教育部等16部门联合印发通知,要求各地有关部门创新活动载体、挖掘...
01-21
  新华财经北京1月21日电(郭洲洋、吴郑思)国内商品期货市场1月21日涨跌互现,其中集运欧线主力合...
01-23
  春节的“脚步”越来越近!近两日,上期所、郑商所、大商所、广期所陆续发布通知,对2025年春节期...
01-24
摩羯座的男生一向以稳重、务实和有责任感而著称。他们通常不会轻易被外界的诱惑所动摇...
01-22
天蝎座的男生在感情中常常表现得非常专注和执着,一旦爱上一个人,很难忘记。因此,有时候我...
01-22
童装搭配技巧? 童装搭配文案?一、童装搭配技巧?童装怎么样搭配!1,首先是看儿童的肤色选择深浅,2,儿童的胖瘦选择衣服,3,儿童的喜爱选择,4颜色深浅错开搭配,5舒适宽松二、童装搭配文案?1....
02-07
粉色领带搭配什么颜色衬衫?斜纹蓝色一、西装、衬衫、领带巧搭配 ①黑色西服,穿以白色为主的衬衫和浅色衬衫,配灰、蓝、绿等与衬衫色彩协调的领带。 ②灰西服,可配灰、绿、黄和...
02-07
2月7日消息,秦皇岛津峰线缆制造有限公司(以下简称:津峰线缆)董事长韩金良一行日前到访涂多多。现场,涂多多副总裁、跨境产发部常务副总经理郑德莲与津峰线缆副总经理韩冬共同签署...
02-07
2月8日消息,全国企业破产重整案件信息网日前发布苏宁电器集团有限公司、苏宁控股集团有限公司以及苏宁置业集团有限公司的破产重整案件信息与一债会公告。三家公司已于2025年...
02-09
今年1、2月分别有春节和情人节两个节日,不少消费者会趁着节日,给亲友、恋人送上精心准备的黄金饰品。周大福、周六福、金大福、金六...
02-07
2月27日消息,《饿了么2024社会责任报告》今日正式发布。报告显示,在AI技术的助力下,饿了么“互联网 +明厨亮灶”识别能力已覆盖超过20万家商户,累计预警2,000余次食品安全隐患;20...
03-01
岁聿云暮,一元复始。过去一年里,金融机构始终聚焦主业,践行社会担当,服务国家战略,发挥“金融+慈善”合力,让温暖得到传递。2025年1月13日至1月16日,由中国银河证券主办的“星善之...
01-23
自去年底开始,黄金多头优势逐渐退却,国际现货黄金价格经历几次大跌后一度跌下2700关口,多空进入漫长的震荡周期,多头始终无法找到再度冲高的时机。  北京时间1月21日,国际现货...
01-24
大家都讨厌视频里的广告,但YouTube还在一个劲儿地塞广告。原因很简单:那些遭人厌恶的YouTube广告能让平台赚得盆满钵满。 Alphabet公司第四季度财报显示,YouTube...
02-10
根据SE的最新财报显示,《勇者斗恶龙3:HD-2D重制版》的销量超过了公司预期,该作的成功也推动了SE游戏部门的营收增长,净销售额总计高达600亿日元,营业利润为46亿日元...
02-10
据央视新闻报道,当地时间2月1日,美国联邦选举委员会年底的备案文件显示,埃隆·马斯克在2024年美国大选中的花费超过了2.9亿美元。马斯克 资料图(来源:环球网)文件表明,马斯克在年末...
02-02
极目新闻记者 潘锡珩4日,极目新闻记者从武汉地铁了解到,为保障铁路夜间到达乘客出行需求,今日(2月4日),武汉轨道交通2号线汉口火车站往佛祖岭方向末班车延时至24:00,4号线武汉火车站...
02-04
返回

点击右上角微信好友

朋友圈

点击浏览器下方“”分享微信好友Safari浏览器请点击“”按钮

点击右上角QQ

点击浏览器下方“”分享QQ好友Safari浏览器请点击“”按钮