解决传统架构记忆瓶颈 MiniMax发布新一代模型

11个月前 来源:新京报 观看:214

1月15日,“AI六小虎”之一的MiniMax发布并开源了新一代01系列模型,包含基础语言大模型MiniMax-Text-01和视觉多模态大模型MiniMax-VL-01。该系列模型使用多项突破性创新,以大规模应用线性注意力机制打破了Transformer传统架构的记忆瓶颈。2pd即热新闻——关注每天科技社会生活新变化gihot.com

未来,AI智能体有望成为最重要的产品形态,由于智能体处理的任务变得越来越复杂,涉及的数据量也越来越大,单个智能体的记忆以及多个智能体协作间的上下文都会变得越来越长。因此,长上下文能力与多模态处理能力的提升至关重要。2pd即热新闻——关注每天科技社会生活新变化gihot.com

技术上,MiniMax-01系列模型首次将线性注意力机制扩展到商用模型的级别,受益于此次架构创新,该系列模型在处理长输入的时候具有非常高的效率,接近线性复杂度。从规模效应、结构设计、训练优化和推理优化等层面综合考虑,MiniMax选择模型参数量为4560亿,其中每次激活459亿,能够高效处理400万token的上下文,将有效替代Transformer传统架构并开启超长文本输入时代。相较于Gemini等一众全球顶级模型,MiniMax-01随着输入长度变长,性能衰减最慢。2pd即热新闻——关注每天科技社会生活新变化gihot.com

值得注意的是,MiniMax还开源了Text-01模型、VL-01模型的完整权重,以便于更多开发者做有价值、突破性的研究。MiniMax方面表示,“我们认为这有可能启发更多长上下文的研究和应用,从而更快促进Agent时代的到来,二是开源也能促使我们努力做更多创新,更高质量地开展后续的模型研发工作。”2pd即热新闻——关注每天科技社会生活新变化gihot.com

1月15日,“AI六小虎”之一的MiniMax发布并开源了新一代01系列模型,包含基础语言大模型MiniMax-Text-01和视觉多模态大模型MiniMax-VL-01。该系列模型使用多项突破性创新,以大规模应用线性注意力机制打破了Transformer传统架构的记忆瓶颈。2pd即热新闻——关注每天科技社会生活新变化gihot.com

未来,AI智能体有望成为最重要的产品形态,由于智能体处理的任务变得越来越复杂,涉及的数据量也越来越大,单个智能体的记忆以及多个智能体协作间的上下文都会变得越来越长。因此,长上下文能力与多模态处理能力的提升至关重要。2pd即热新闻——关注每天科技社会生活新变化gihot.com

技术上,MiniMax-01系列模型首次将线性注意力机制扩展到商用模型的级别,受益于此次架构创新,该系列模型在处理长输入的时候具有非常高的效率,接近线性复杂度。从规模效应、结构设计、训练优化和推理优化等层面综合考虑,MiniMax选择模型参数量为4560亿,其中每次激活459亿,能够高效处理400万token的上下文,将有效替代Transformer传统架构并开启超长文本输入时代。相较于Gemini等一众全球顶级模型,MiniMax-01随着输入长度变长,性能衰减最慢。2pd即热新闻——关注每天科技社会生活新变化gihot.com

值得注意的是,MiniMax还开源了Text-01模型、VL-01模型的完整权重,以便于更多开发者做有价值、突破性的研究。MiniMax方面表示,“我们认为这有可能启发更多长上下文的研究和应用,从而更快促进Agent时代的到来,二是开源也能促使我们努力做更多创新,更高质量地开展后续的模型研发工作。”2pd即热新闻——关注每天科技社会生活新变化gihot.com

本文链接:http://www.gihot.com/news-2-195-0.html解决传统架构记忆瓶颈 MiniMax发布新一代模型

声明:本网页内容由互联网博主自发贡献,不代表本站观点,本站不承担任何法律责任。天上不会到馅饼,请大家谨防诈骗!若有侵权等问题请及时与本网联系,我们将在第一时间删除处理。

上一篇:深瞳丨AI为药物研发按下“快进键”

下一篇:丝巾变色、火柴变玫瑰 年货节期间淘宝魔术道具销量大增174%

为你推荐
1月20日,我国首款起飞重量5.25吨、最大载重1.9吨的大型无人机鸿雁(HY100)在新疆石河子市天域航通石河子生产基地成功实现量产下线,其中3架顺利向客户完...
01-21
记者从中国载人航天工程办公室获悉,我国2025年计划发射神舟二十号、神舟二十一号两艘载人飞船和天舟九号货运飞船。1月20日,三次飞行任务的任务标识...
01-21
  1月27日夜间,纷纷扬扬的大雪已下了一整天,白雪覆红灯让年味愈发浓厚。在沈阳街头,环卫工人们挥舞铁锹...
01-28
2025年春节假期已接近尾声辽宁多条高速迎来返程高峰出行的小伙伴们这份返程提示请务必查收经综合研判,春...
02-04
  海报新闻记者 孙佃潇 北京报道  大学教授、收藏家、作家、阿里巴巴荣誉合伙人……如果细写,王帅的身份可能一张A4纸都写不完。1月18日晚,王帅作为一位分享者,携新书《...
01-21
  编者按:年关将近,在外打拼一年的你,返乡的心情是否雀跃不已?家中的亲人,想必也是如此。今年回家,你给家人准备了什么礼物?他们会有怎样的期待?海报新闻记者在北京、上海、济...
01-22
  近期,国家发展改革委和财政部发布了《关于2025年加力扩围实施大规模设备更新和消费品以旧换...
01-24
摘要【商务部等8部门印发关于开展汽车流通消费改革试点工作的通知】力争到2027年,在汽车流通消费...
01-27
  《难哄》温以凡明明是喜欢桑延的,却在高考后背弃了跟桑延的约定,还用言不由衷的借口拒绝了桑延。《难哄》温以凡到底经历了什么?她为什么要拒绝桑延?   温以凡本来跟桑延...
02-18
  1、《难哄》桑延在小说中是在第63章知道真相,他知道温以凡当初改志愿拒绝自己的真正原因了。  2、知道真相的那一刻,桑延十分懊悔又心痛,他自责为什么当初没能察觉到温...
02-20
21世纪经济报道记者李佳英 广州报道春节之际,不少老年在保健品消费上“一掷千金”,然而保健品类别纷繁复杂、售卖中不乏陷阱与骗局。例如,北...
01-30
2月3日,小S(徐熙娣)经纪人向媒体证实,中国台湾知名女演员大S(徐熙媛)在日本旅游期间因患流感并发肺炎不幸离世。据报道,由于大S家人都在日本,因此...
02-04
  大众网记者 张明明 报道  8月26日至30日,第七届全国高校青年教师教学竞赛决赛在上海交通大学举行。山东第一医科大学附属省立医院青年教师李毅荣获医科组二等奖,在31...
01-21
2025年辽宁省普通高等学校艺术类专业招生简章  一、艺术类考生高考报名  艺术类考生高考报名工作按...
01-21
  新华财经北京1月21日电(郭洲洋、吴郑思)国内商品期货市场1月21日涨跌互现,其中集运欧线主力合...
01-23
  财联社1月26日讯(记者 邹俊涛)宜宾银行(2596.HK)近3.52%股权流拍,超千次围观却无人出价。  1月...
01-28
金牛座的男生通常被认为是稳重、务实和可靠的人。他们对于过日子非常重视,因此选择伴侣...
01-22
巨蟹座的男生通常是非常专一和忠诚的,但当他们遇到新欢时,总会有一些迹象透露出来。焖鸡...
01-22
饰品创业计划书模板:轻松开启你的创业之旅在当今的市场环境中,饰品行业因其产品多样性和高利润率吸引了众多创业者的关注。如果你也想要在这个领域展开自己的创业冒险,撰写一份...
02-07
揭秘女明星的私生活:光鲜背后隐藏的故事提到女明星,大家的第一反应可能是舞台上璀璨夺目的光环,以及那些充满魅力的红毯瞬间。可是,在这华丽的表象下,她们的私生活到底隐藏着哪些...
02-12
2月7日消息,中国商业联合会今日发布2月份中国零售业景气指数(CRPI)。2月份,中国零售业景气指数(CRPI)为50.1%,环比下降1.0个百分点。分析认为,今年春节的大宗年货消费集中在1月份,CRP...
02-07
2月9日消息,2025年春节假期落下帷幕,天猫数据显示,蛇年春节消费市场中,电子年货、非遗商品、黄金珠宝、户外运动装备等纷纷成为今年春节消费新潮中的热销爆款。国家补贴政策加力...
02-09
进入2025年,大部分打工人的精神状态都是:人坐在工位上,鼻子却闻到了家中年夜饭的香。在年味不断被稀释,大部分春节习俗已绝迹的今天,对...
02-07
3月6日消息,饿了么推出“骑手权益月恳谈会”创新机制,通过定期举办骑手、商家、用户、专家等沟通互动,进行算法公开和主题调研,听取各方反馈,持续完善相关建议。为了进一步推动算...
03-09
【#国家能源集团等在安徽成立新公司# 注册资本2.1亿】天眼查App显示,近日,国能(太湖)新能源有限责任公司成立,法定代表人为赵冠永,注册资本2.1亿人民币,经营范围含太阳能发电技术服...
01-21
全球性金融券商集团英国EBC Group平台始终致力于以领先生态,与全球交易者共塑交易的未来。 自第一届交易大赛起,为赤忱的热爱和卓越的才华提供舞台,在全球内寻找交易好手以赋能...
01-24
由AlterEyes打造的像素风3D休闲涂色游戏《彩色立方体(Color-A-Cube)》,现已在Steam平台推出试玩Demo。 本作中玩家将有着身临其境的着色体验,让您可以探索体素世...
02-05
由黑曜石娱乐开发制作的经典TRPG游戏《龙与地下城:无冬之夜2》,是一款基于《龙与地下城》(可简称为D&D)3版规则的改编电子游戏,最初发售于2006年。 近日知名爆料推...
02-13
极目新闻记者 柯称 李碗容 张屏 庞正 马鑫人勤春来早对于人形机器人来说也许也是这样大年初八新春开工首日湖北10个型号的“楚才”系列人形机器人在洪山礼堂前集中亮相这是...
02-05
2月5日傍晚,小米创始人雷军在社交媒体上发文:这是金的。转发的视频里有人介绍,小米SU7 Ultra车标变成了碳纤维+金色,兄弟们这个如何?来源:当事人社交账号今日上午,雷军又连发多条微...
02-06
返回

点击右上角微信好友

朋友圈

点击浏览器下方“”分享微信好友Safari浏览器请点击“”按钮

点击右上角QQ

点击浏览器下方“”分享QQ好友Safari浏览器请点击“”按钮