解决传统架构记忆瓶颈 MiniMax发布新一代模型

1年前 来源:新京报 观看:362

1月15日,“AI六小虎”之一的MiniMax发布并开源了新一代01系列模型,包含基础语言大模型MiniMax-Text-01和视觉多模态大模型MiniMax-VL-01。该系列模型使用多项突破性创新,以大规模应用线性注意力机制打破了Transformer传统架构的记忆瓶颈。jUO即热新闻——关注每天科技社会生活新变化gihot.com

未来,AI智能体有望成为最重要的产品形态,由于智能体处理的任务变得越来越复杂,涉及的数据量也越来越大,单个智能体的记忆以及多个智能体协作间的上下文都会变得越来越长。因此,长上下文能力与多模态处理能力的提升至关重要。jUO即热新闻——关注每天科技社会生活新变化gihot.com

技术上,MiniMax-01系列模型首次将线性注意力机制扩展到商用模型的级别,受益于此次架构创新,该系列模型在处理长输入的时候具有非常高的效率,接近线性复杂度。从规模效应、结构设计、训练优化和推理优化等层面综合考虑,MiniMax选择模型参数量为4560亿,其中每次激活459亿,能够高效处理400万token的上下文,将有效替代Transformer传统架构并开启超长文本输入时代。相较于Gemini等一众全球顶级模型,MiniMax-01随着输入长度变长,性能衰减最慢。jUO即热新闻——关注每天科技社会生活新变化gihot.com

值得注意的是,MiniMax还开源了Text-01模型、VL-01模型的完整权重,以便于更多开发者做有价值、突破性的研究。MiniMax方面表示,“我们认为这有可能启发更多长上下文的研究和应用,从而更快促进Agent时代的到来,二是开源也能促使我们努力做更多创新,更高质量地开展后续的模型研发工作。”jUO即热新闻——关注每天科技社会生活新变化gihot.com

1月15日,“AI六小虎”之一的MiniMax发布并开源了新一代01系列模型,包含基础语言大模型MiniMax-Text-01和视觉多模态大模型MiniMax-VL-01。该系列模型使用多项突破性创新,以大规模应用线性注意力机制打破了Transformer传统架构的记忆瓶颈。jUO即热新闻——关注每天科技社会生活新变化gihot.com

未来,AI智能体有望成为最重要的产品形态,由于智能体处理的任务变得越来越复杂,涉及的数据量也越来越大,单个智能体的记忆以及多个智能体协作间的上下文都会变得越来越长。因此,长上下文能力与多模态处理能力的提升至关重要。jUO即热新闻——关注每天科技社会生活新变化gihot.com

技术上,MiniMax-01系列模型首次将线性注意力机制扩展到商用模型的级别,受益于此次架构创新,该系列模型在处理长输入的时候具有非常高的效率,接近线性复杂度。从规模效应、结构设计、训练优化和推理优化等层面综合考虑,MiniMax选择模型参数量为4560亿,其中每次激活459亿,能够高效处理400万token的上下文,将有效替代Transformer传统架构并开启超长文本输入时代。相较于Gemini等一众全球顶级模型,MiniMax-01随着输入长度变长,性能衰减最慢。jUO即热新闻——关注每天科技社会生活新变化gihot.com

值得注意的是,MiniMax还开源了Text-01模型、VL-01模型的完整权重,以便于更多开发者做有价值、突破性的研究。MiniMax方面表示,“我们认为这有可能启发更多长上下文的研究和应用,从而更快促进Agent时代的到来,二是开源也能促使我们努力做更多创新,更高质量地开展后续的模型研发工作。”jUO即热新闻——关注每天科技社会生活新变化gihot.com

本文链接:http://www.gihot.com/news-2-195-0.html解决传统架构记忆瓶颈 MiniMax发布新一代模型

声明:本网页内容由互联网博主自发贡献,不代表本站观点,本站不承担任何法律责任。天上不会到馅饼,请大家谨防诈骗!若有侵权等问题请及时与本网联系,我们将在第一时间删除处理。

上一篇:深瞳丨AI为药物研发按下“快进键”

下一篇:丝巾变色、火柴变玫瑰 年货节期间淘宝魔术道具销量大增174%

为你推荐
荷兰特文特大学科学家开发出一种新工艺,能在室温下制造出晶体结构高度有序的半导体材料。他们表示,通过精准控制这种半导体材料的晶体结构,大幅降低了...
01-21
美国马里兰大学医学院外科团队在异种移植领域取得一项重要进展,他们在最新一期《自然·医学》杂志上发布了关于第二例基因编辑猪心脏移植案例...
01-24
主要指标持续跑赢全国攻坚之战实现连战连胜——2024年全省经济运行情况  2024年,全省上下坚持以习近平...
01-21
  今天(1月23日)至27日,今年首场寒潮将携大范围雨雪来袭,西北地区东部、华北、东北等地有较强降雪...
01-24
▲超市购物。图/IC photo据报道,春节将至,有市民在采购年货时留意到,市面上那些内含独立小包装的食品,不少独立包装上没有标注生产日期或保质期等信息,其中有的会注明“单片/单个...
01-21
  中新经纬1月20日电 文化和旅游部官方微信号20日发布春节假期出游提示称,选择有经营资质的旅行社,不前往未开发开放、缺乏安全保障的区域。  2025年春节假期即将来临,文化...
01-21
1 月 24 日消息,据“特斯拉”官方新闻稿,特斯拉宣布旗下首批V4超级充电站将于国内落地,相应充电站也将支持第三方汽车充电。▲ 特斯拉 V4 充电桩V4 超级充电桩号称特斯...
01-25
2 月 7 日消息,在福特 2024 年财报电话会议上,首席执行官吉姆・法利向媒体坦言,全尺寸电动或增程电动汽车并不是拖车的理想选择。他说:“它并不完美。如果你需要拖车,这...
02-07
随着电视剧的热播,“难哄桑延和温以凡为什么分手”也逐渐引起了广大粉丝的关注。该剧播出后,凭借精彩的剧情、精良的制作和精心的演绎,受到了观众的一致好评,拿...
02-20
《余烬之上》廖知白被谁杀了?廖知白最后真的死了嘛?在《余烬之上》中,廖知白并非被他人所杀,而是自己策划了死亡。廖知白为了揪出幕后黑手,将自己尸体公之于众,引...
02-21
编者按:一个人工智能(AI)机器人,在短短8天内独立完成了668项实验,合成了668种化合物,并成功研发出一种全新的化学催化剂。这一壮举令人赞叹。AI...
02-11
21世纪经济报道记者林昀肖 北京报道 近日,全国中成药联合采购办公室发布第三批全国中成药采购联盟集中采购中选结果。此次中成药集采由湖...
02-13
  大家好,我是童学会小记者王馨涵。  当流星划过夜空,除了赞叹他的美丽之外,你是否想过它背后的故事?带着这个好奇心,4月14日,我们来到了九紫宝藏陨石博物馆,探索陨石奥秘。...
01-21
研考是重要的国家教育考试,关系教育公平和广大考生切身利益。为积极营造清朗健康的全国研考网络环境,根据...
01-21
  摘要  临近春节,聚酯产业链进入交货“扫尾期”,也出现了一些新情况。  炒股第一步,先开个...
01-21
  车险作为财险业的第一大险种,其保费情况备受市场关注。随着险企2024年四季度偿付能力报告陆...
02-13
双鱼座的男生通常是浪漫而敏感的,他们善于表达情感,但有时也会因为过于理想化而迷失自己...
01-22
摩羯座男性通常被认为是踏实、稳重、有责任感的人。要抓住他们的心并让他们对你产生好...
01-22
日系穿搭特点?一、日系穿搭的特点在穿搭方面日系风简直把休闲做到了极致,要说亚洲潮流文化发祥地,原宿绝对是一大圣地这里除了有常见的时尚大牌,还有亲民的牌子,日系穿搭的主要特...
02-07
中国服饰品牌历史? 中国男装之都?中国服饰品牌历史?中国服饰文化源远流长、独具特色,古时也一直以“衣冠上国”和“礼仪之邦”著称于世。服饰是文化的一部分,在中华民族上下五千...
02-17
2月4日消息,春节假期,京东联合联通数智智慧足迹,对全国31个城市的线下商圈客流量及消费数据进行了实时动态统计,反映消费者在春节线上线下各场景中的消费趋势。观察显示,西安、哈...
02-07
1月26日消息,欧冶云商与宝武清能近日在上海签署技术合作协议,标志着双方正式开启在碳资产系统建设的深度合作。根据合作协议,双方将聚焦宝武碳资产服务平台的建设与升级,共同推...
02-07
2月23日消息,小马智行近日开通广州自动驾驶示范运营专线,用户可搭乘自动驾驶车,从广州市中心相应地点往返广州白云机场和广州南站。图源: Pony.ai小马智行公众号据了解,小马智行...
02-24
大清洗来临。1.抖音生服重拳出击,违规商家被处理在抖音,每天都有近200万条探店视频涌向6亿消费者。有人被种草了一碗麻辣烫,有人下单了人生第一次医美,但也有人掉进“9.9元低价...
03-01
1月2日,产业级AI应用服务商——明心数智宣布获得近两亿元B轮融资。本轮由柏睿资本领投,国方创新、狮城资本和老股东鼎晖VGC跟投。明心数智成立于202...
02-07
全球性金融券商集团英国EBC Group平台始终致力于以领先生态,与全球交易者共塑交易的未来。 自第一届交易大赛起,为赤忱的热爱和卓越的才华提供舞台,在全球内寻找交易好手以赋能...
01-24
由战马工作室(Warhorse Studios)打造的中世纪背景RPG游戏《天国:拯救2》,在近日正式发售后迅速获得了100万份的销量,并且Steam平台上的总体评价也来到92%好评率的特...
02-06
Take-Two Interactive 首席执行官 Strauss Zelnick 最近分享了一些对于 AI 人工智能的看法,称“人工智能”这个概念实际上就是一个“矛盾修辞”。 在接受 GI.b...
02-10
中国贸促会新闻发言人就美方宣布对中国输美产品加征10%关税发表谈话美国东部时间2月1日,美方以芬太尼等问题为由,对中国输美产品加征10%关税。中国工商界对此深表遗憾、坚决反...
02-02
2025年综合运输春运工作专班数据显示,预计2025年2月9日(春运第27日,农历正月十二),全社会跨区域人员流动量20629万人次,其中,铁路客运量1330万人次,公路人员流动量18983万人次(高速公...
02-09
返回

点击右上角微信好友

朋友圈

点击浏览器下方“”分享微信好友Safari浏览器请点击“”按钮

点击右上角QQ

点击浏览器下方“”分享QQ好友Safari浏览器请点击“”按钮