中国智算如何实现“DeepSeek式突围”

6个月前 来源:科技日报 观看:78

晶上生成式变结构计算可为我国打破算力芯片“制程工艺茧房”开辟新路径,走出一条用“三流材料、二流工艺”达成“一流能力”的系统工程级创新路线。a60即热新闻——关注每天科技社会生活新变化gihot.com

今年以来,我国以DeepSeek为代表的大模型企业通过算法优化、有针对性的训练和开源生态协作,在使用“缩水版”GPU芯片的情况下,将千亿参数模型训练成本压缩至同类模型的1/10,走出了一条从粗放式算力堆砌向内生式效能提升的新路径。a60即热新闻——关注每天科技社会生活新变化gihot.com

在全球惊叹中国非对称创新奇迹的同时,也要清醒看到,就人工智能(AI)技术和产业自主可持续发展而言,我国仍未摆脱对高端乃至“缩水版”智算芯片等物理器件的依赖。在可以预见的未来,外部环境可能更趋恶劣,封锁遏制常态化、供应链不确定性等挑战难以回避。我国亟需在智能算力层面实现“DeepSeek式突围”,用超限创新解耦当前硬件算力提升与制程工艺进步强绑定的关系。a60即热新闻——关注每天科技社会生活新变化gihot.com

换言之,我国要在AI领域获得与竞争对手可博弈的能力,不仅要在算法层面继续革命、突破“算力茧房”,而且要在算法与物理层面深度融合上实现换道超车,破解“制程工艺茧房”。以生成式变结构计算、软件定义晶上系统(Software defined System on Wafer,SDSoW)为主要内容的晶上生成式体系架构,为解决算法模型与算力载体失配难题、增强软硬件协同算力可持续发展提供了新的技术路径。a60即热新闻——关注每天科技社会生活新变化gihot.com

让计算架构的“鞋”适应算法的“脚”a60即热新闻——关注每天科技社会生活新变化gihot.com

先进的芯片制程工艺能够提供更高的晶体管密度,提升芯片单位面积计算能力,为大模型训练和推理提供更强大的计算资源支持。然而,基于还原论的工程设计范式,芯片制程工艺艰辛迭代获得的物理算力提升,很难被大规模分布式物理系统上运行的软件算法有效利用。芯片峰值计算能力与算法系统性收益存在结构性错位,加之分布式系统在技术体制上受“大规模、低时延、高带宽”不可能三角问题制约,靠简单堆砌千张、万张乃至十万张以上GPU卡的方式,难以满足“规模定律-Scaling low”驱动的大模型训练之非线性算力增长需求。a60即热新闻——关注每天科技社会生活新变化gihot.com

简而言之,由于存算分离体制的冯·诺依曼计算架构,硬件系统设计(如芯片制程、内存带宽、并发单元等)与算法模型的运算特征(如计算密度、数据流模式、精度需求等)之间存在系统性错位。即便芯片制程工艺有所进步,带来了性能增益,也会由于“逐级插损”的系统工程范式大打折扣。a60即热新闻——关注每天科技社会生活新变化gihot.com

突破“制程工艺茧房”,在更高维度上寻求问题的解空间,需要变革传统刚性计算架构及技术物理实现范式。a60即热新闻——关注每天科技社会生活新变化gihot.com

近80年来,传统计算架构一直沿用运算器、控制器、内存储器、输入输出设备几大件组成的冯·诺依曼计算架构。无论是复杂的AI算法,还是简单的数据处理任务,都被“硬塞”进刚性的计算架构之中,奢望“一劳永逸”地处理千变万化的应用。这就好比不管你脚多大,都必须穿37码的鞋才能走路。然而,鞋不合脚就走不快:小脚穿大鞋会绊脚;大脚穿小鞋则会感到疼,结局往往是“削足适履”。a60即热新闻——关注每天科技社会生活新变化gihot.com

化解刚性架构算力与多样化算法间结构性矛盾,需要借助物理学增维求解法则,导入自适应计算架构新机理。a60即热新闻——关注每天科技社会生活新变化gihot.com

2009年,受“自然界伪装大师”拟态章鱼启发,中国科学家在世界上首次提出领域专用软硬件协同变结构计算——拟态计算。如同拟态章鱼,可“随机应变”地隐匿在沙质海底或珊瑚礁等环境之中,拟态计算能让“鞋子”更好地适配穿着它走路的“脚板”。a60即热新闻——关注每天科技社会生活新变化gihot.com

2018年,计算机体系结构大师、图灵奖得主大卫·帕特森和约翰·轩尼诗预言,基于软硬件协同计算语言的领域专用软硬件协同计算架构,将成为今后十年计算机体系架构黄金发展期的主流发展方向之一。前不久,特斯拉Dojo超算公布了其计算范式变革的解决方案,提出硬件架构像变形金刚般随任务变形,实现从“算法适应硬件”到“算法定义硬件”的范式转换。a60即热新闻——关注每天科技社会生活新变化gihot.com

用二流零部件构建一流系统a60即热新闻——关注每天科技社会生活新变化gihot.com

生成式变结构计算的核心在于按算法需求动态重构计算架构,要求算力的硬件载体能够实现以软件驱动物理结构变化,大幅度提升特定计算结构对特定算法的执行效能。SDSoW就是要推动计算架构从“刚性流水线”向“软件可塑形”跃迁,打通生成式变结构计算从理论到技术物理实现的闭环,使得基于二流器件或部件构建一流系统成为可能。a60即热新闻——关注每天科技社会生活新变化gihot.com

具体来说,SDSoW具备五大能力。a60即热新闻——关注每天科技社会生活新变化gihot.com

一是系统破局能力。SDSoW摆脱“核心器件决定论”思维,改变“芯粒、芯片、模组、机匣、机架、系统”的逐级堆砌、逐级插损式工程技术路线,通过晶圆级异构集成实现功能解构—晶上重组,达成功能等价、系统最优的目标,将制程工艺短板通过系统工程方法转化为非主要矛盾。a60即热新闻——关注每天科技社会生活新变化gihot.com

二是整体增效能力。借助晶圆级高密度互连、超短距离、异质异构封装,获得高带宽、低延迟、低功耗的系统增益,SDSoW系统的带宽可提升一个数量级,时延可缩小一个数量级,功耗可降低一个数量级,系统效能可提升三个量级。a60即热新闻——关注每天科技社会生活新变化gihot.com

三是通专融合能力。基于晶圆级系统硬件可编程/重定义架构,可通过软件实时配置或由AI大模型生成SDSoW功能和性能。在同一物理载体上,能根据不同应用需求或使用场景,实现“一平台、多样性”生成式变结构计算,既可满足专用场景特殊算力需求,又能兼顾领域内相对灵活的通用算力要求。a60即热新闻——关注每天科技社会生活新变化gihot.com

四是开源协同能力。通过建立SDSoW开源社区,发布基础互连协议、动态控制器及生成式变结构计算工具链等,SDSoW可构建“中国引领、全球参与”的生态环境,以开放破垄断,形成相对Chiplet(小芯片)路线的比较优势。a60即热新闻——关注每天科技社会生活新变化gihot.com

五是内生安全能力。SDSoW可从源头上应对开放生态带来的新域新质安全挑战,通过引入内生安全架构实现开放可控,即便供应链欠安全,仍能保证开放条件下该系统具有“开箱即用、默认安全”的网络弹性。a60即热新闻——关注每天科技社会生活新变化gihot.com

总之,晶上生成式变结构计算可为我国打破算力芯片“制程工艺茧房”开辟新路径,走出一条用“三流材料、二流工艺”达成“一流能力”的系统工程级创新路线。通过应用与设计、算法与算力的垂直整合,解耦当前我国算力基础设施产品对芯片先进制程工艺的强依赖关系,最大程度获取体系结构与工艺进步的综合增益。晶上生成式变结构计算也能为全球智算普惠提供中国方案。a60即热新闻——关注每天科技社会生活新变化gihot.com

基于晶圆级集成/封装的生成式变结构计算,开辟了算法架构突破与物理载体革命、算法工程实现与计算范式创新深度耦合的新方向。目前,应尽快推动根理论突破,重点攻关晶上热力学、异构集成理论、可重构架构数学描述等底层理论;持续加强根技术攻坚,突破晶圆级键合、3D互连、晶圆级操作系统、生成式结构计算语言/编译器等关键技术,实现从架构设计、物理实现到技术应用自主生态;多维推进根产业培育,以智能驾驶、具身智能、工业数字孪生、AI一体机等新兴市场需求为牵引,通过“场景开放+体系创新+生态聚合”三位一体模式,以超限创新、超常规举措突破“小院高墙”“遏制封锁”,蹚出一条中国特色技术平权和产业可持续发展之路。a60即热新闻——关注每天科技社会生活新变化gihot.com

晶上生成式变结构计算可为我国打破算力芯片“制程工艺茧房”开辟新路径,走出一条用“三流材料、二流工艺”达成“一流能力”的系统工程级创新路线。a60即热新闻——关注每天科技社会生活新变化gihot.com

今年以来,我国以DeepSeek为代表的大模型企业通过算法优化、有针对性的训练和开源生态协作,在使用“缩水版”GPU芯片的情况下,将千亿参数模型训练成本压缩至同类模型的1/10,走出了一条从粗放式算力堆砌向内生式效能提升的新路径。a60即热新闻——关注每天科技社会生活新变化gihot.com

在全球惊叹中国非对称创新奇迹的同时,也要清醒看到,就人工智能(AI)技术和产业自主可持续发展而言,我国仍未摆脱对高端乃至“缩水版”智算芯片等物理器件的依赖。在可以预见的未来,外部环境可能更趋恶劣,封锁遏制常态化、供应链不确定性等挑战难以回避。我国亟需在智能算力层面实现“DeepSeek式突围”,用超限创新解耦当前硬件算力提升与制程工艺进步强绑定的关系。a60即热新闻——关注每天科技社会生活新变化gihot.com

换言之,我国要在AI领域获得与竞争对手可博弈的能力,不仅要在算法层面继续革命、突破“算力茧房”,而且要在算法与物理层面深度融合上实现换道超车,破解“制程工艺茧房”。以生成式变结构计算、软件定义晶上系统(Software defined System on Wafer,SDSoW)为主要内容的晶上生成式体系架构,为解决算法模型与算力载体失配难题、增强软硬件协同算力可持续发展提供了新的技术路径。a60即热新闻——关注每天科技社会生活新变化gihot.com

让计算架构的“鞋”适应算法的“脚”a60即热新闻——关注每天科技社会生活新变化gihot.com

先进的芯片制程工艺能够提供更高的晶体管密度,提升芯片单位面积计算能力,为大模型训练和推理提供更强大的计算资源支持。然而,基于还原论的工程设计范式,芯片制程工艺艰辛迭代获得的物理算力提升,很难被大规模分布式物理系统上运行的软件算法有效利用。芯片峰值计算能力与算法系统性收益存在结构性错位,加之分布式系统在技术体制上受“大规模、低时延、高带宽”不可能三角问题制约,靠简单堆砌千张、万张乃至十万张以上GPU卡的方式,难以满足“规模定律-Scaling low”驱动的大模型训练之非线性算力增长需求。a60即热新闻——关注每天科技社会生活新变化gihot.com

简而言之,由于存算分离体制的冯·诺依曼计算架构,硬件系统设计(如芯片制程、内存带宽、并发单元等)与算法模型的运算特征(如计算密度、数据流模式、精度需求等)之间存在系统性错位。即便芯片制程工艺有所进步,带来了性能增益,也会由于“逐级插损”的系统工程范式大打折扣。a60即热新闻——关注每天科技社会生活新变化gihot.com

突破“制程工艺茧房”,在更高维度上寻求问题的解空间,需要变革传统刚性计算架构及技术物理实现范式。a60即热新闻——关注每天科技社会生活新变化gihot.com

近80年来,传统计算架构一直沿用运算器、控制器、内存储器、输入输出设备几大件组成的冯·诺依曼计算架构。无论是复杂的AI算法,还是简单的数据处理任务,都被“硬塞”进刚性的计算架构之中,奢望“一劳永逸”地处理千变万化的应用。这就好比不管你脚多大,都必须穿37码的鞋才能走路。然而,鞋不合脚就走不快:小脚穿大鞋会绊脚;大脚穿小鞋则会感到疼,结局往往是“削足适履”。a60即热新闻——关注每天科技社会生活新变化gihot.com

化解刚性架构算力与多样化算法间结构性矛盾,需要借助物理学增维求解法则,导入自适应计算架构新机理。a60即热新闻——关注每天科技社会生活新变化gihot.com

2009年,受“自然界伪装大师”拟态章鱼启发,中国科学家在世界上首次提出领域专用软硬件协同变结构计算——拟态计算。如同拟态章鱼,可“随机应变”地隐匿在沙质海底或珊瑚礁等环境之中,拟态计算能让“鞋子”更好地适配穿着它走路的“脚板”。a60即热新闻——关注每天科技社会生活新变化gihot.com

2018年,计算机体系结构大师、图灵奖得主大卫·帕特森和约翰·轩尼诗预言,基于软硬件协同计算语言的领域专用软硬件协同计算架构,将成为今后十年计算机体系架构黄金发展期的主流发展方向之一。前不久,特斯拉Dojo超算公布了其计算范式变革的解决方案,提出硬件架构像变形金刚般随任务变形,实现从“算法适应硬件”到“算法定义硬件”的范式转换。a60即热新闻——关注每天科技社会生活新变化gihot.com

用二流零部件构建一流系统a60即热新闻——关注每天科技社会生活新变化gihot.com

生成式变结构计算的核心在于按算法需求动态重构计算架构,要求算力的硬件载体能够实现以软件驱动物理结构变化,大幅度提升特定计算结构对特定算法的执行效能。SDSoW就是要推动计算架构从“刚性流水线”向“软件可塑形”跃迁,打通生成式变结构计算从理论到技术物理实现的闭环,使得基于二流器件或部件构建一流系统成为可能。a60即热新闻——关注每天科技社会生活新变化gihot.com

具体来说,SDSoW具备五大能力。a60即热新闻——关注每天科技社会生活新变化gihot.com

一是系统破局能力。SDSoW摆脱“核心器件决定论”思维,改变“芯粒、芯片、模组、机匣、机架、系统”的逐级堆砌、逐级插损式工程技术路线,通过晶圆级异构集成实现功能解构—晶上重组,达成功能等价、系统最优的目标,将制程工艺短板通过系统工程方法转化为非主要矛盾。a60即热新闻——关注每天科技社会生活新变化gihot.com

二是整体增效能力。借助晶圆级高密度互连、超短距离、异质异构封装,获得高带宽、低延迟、低功耗的系统增益,SDSoW系统的带宽可提升一个数量级,时延可缩小一个数量级,功耗可降低一个数量级,系统效能可提升三个量级。a60即热新闻——关注每天科技社会生活新变化gihot.com

三是通专融合能力。基于晶圆级系统硬件可编程/重定义架构,可通过软件实时配置或由AI大模型生成SDSoW功能和性能。在同一物理载体上,能根据不同应用需求或使用场景,实现“一平台、多样性”生成式变结构计算,既可满足专用场景特殊算力需求,又能兼顾领域内相对灵活的通用算力要求。a60即热新闻——关注每天科技社会生活新变化gihot.com

四是开源协同能力。通过建立SDSoW开源社区,发布基础互连协议、动态控制器及生成式变结构计算工具链等,SDSoW可构建“中国引领、全球参与”的生态环境,以开放破垄断,形成相对Chiplet(小芯片)路线的比较优势。a60即热新闻——关注每天科技社会生活新变化gihot.com

五是内生安全能力。SDSoW可从源头上应对开放生态带来的新域新质安全挑战,通过引入内生安全架构实现开放可控,即便供应链欠安全,仍能保证开放条件下该系统具有“开箱即用、默认安全”的网络弹性。a60即热新闻——关注每天科技社会生活新变化gihot.com

总之,晶上生成式变结构计算可为我国打破算力芯片“制程工艺茧房”开辟新路径,走出一条用“三流材料、二流工艺”达成“一流能力”的系统工程级创新路线。通过应用与设计、算法与算力的垂直整合,解耦当前我国算力基础设施产品对芯片先进制程工艺的强依赖关系,最大程度获取体系结构与工艺进步的综合增益。晶上生成式变结构计算也能为全球智算普惠提供中国方案。a60即热新闻——关注每天科技社会生活新变化gihot.com

基于晶圆级集成/封装的生成式变结构计算,开辟了算法架构突破与物理载体革命、算法工程实现与计算范式创新深度耦合的新方向。目前,应尽快推动根理论突破,重点攻关晶上热力学、异构集成理论、可重构架构数学描述等底层理论;持续加强根技术攻坚,突破晶圆级键合、3D互连、晶圆级操作系统、生成式结构计算语言/编译器等关键技术,实现从架构设计、物理实现到技术应用自主生态;多维推进根产业培育,以智能驾驶、具身智能、工业数字孪生、AI一体机等新兴市场需求为牵引,通过“场景开放+体系创新+生态聚合”三位一体模式,以超限创新、超常规举措突破“小院高墙”“遏制封锁”,蹚出一条中国特色技术平权和产业可持续发展之路。a60即热新闻——关注每天科技社会生活新变化gihot.com

本文链接:http://www.gihot.com/news-2-1526-0.html中国智算如何实现“DeepSeek式突围”

声明:本网页内容由互联网博主自发贡献,不代表本站观点,本站不承担任何法律责任。天上不会到馅饼,请大家谨防诈骗!若有侵权等问题请及时与本网联系,我们将在第一时间删除处理。

上一篇:全球首个通用智能人“通通”迭代升级

下一篇:微型磁控机器人可模拟外科医生灵巧动作

为你推荐
1月16日,记者从宁波华仪宁创智能科技有限公司获悉,该公司研制的单细胞代谢物分析质谱仪近日入选浙江省经济和信息化厅、浙江省财政厅印发的《2024年...
01-21
多年来,大量临床经验显示,β-胡萝卜素可预防口腔癌前病变、抑制口腔癌发展。很多口腔科医生也会建议相关患者,多摄入β-胡萝卜素以减缓癌变进...
01-24
  本报记者朱金宜《人民日报海外版》(2025年01月15日第12版)  冬日里,四川贡嘎山“日照金山”...
01-21
  据气象部门监测,预计1月26日至27日我省将有一次强降雪、寒潮、大风天气过程,东部地区有大雪(5~10毫米...
01-23
  如何避免“每逢佳节胖三斤”  ◎本报记者 张佳星  不少人都有“每逢佳节胖三斤”的经历。传统佳节将至,亲友聚会增多,外出餐饮频繁,如何在过好节日的同时保持健康体...
01-21
  低空经济如何发展?专家呼吁形成“全国一张网”  中新网北京1月21日电(中新财经记者 宋宇晟)2024年被认为是“低空经济元年”。步入2025年,中国低空经济将如何发展?中国低...
01-21
  近日,记者从京津冀产业协同暨先进制造业集群发展新闻发布会上获悉,京津冀自动驾驶实现跨域全...
01-21
  广州日报讯(全媒体记者邓莉)今年将是自主高端新能源车崛起的一年。招银国际在1月发布的最新报...
01-23
最近上映的《白色橄榄树》迅速走红,频繁登上热搜。观众对这部剧的讨论非常热烈,尤其是关于主角李瓒的PTSD是否治愈的话题。在一个灰暗的日子里,宋冉心情沉重地...
02-20
最近,《我的蛇君软又妖》吸引了众多观众的目光,播出后引发了广泛关注。社交媒体上频繁出现关于该剧的讨论和剧情分析,特别是其剧情介绍,激发了观众浓厚的兴趣和...
02-20
  降糖药物的选择应根据糖尿病患者的自身病情、经济条件,潜在性副作用等因素综合考虑。通过这篇文章,希望帮助更多糖尿病患者达到...
01-21
21世纪经济报道记者林昀肖 实习生苏洋 北京报道春节假期已临近结束,而假期复工后往往会感觉容易疲倦、难以集中精神、心神不定、失眠、胃口...
02-04
  为帮助考生和家长了解2025年中考整体时间安排,做好相关准备,现将考试时间预安排公告如下:以上考试时间...
01-21
  作者:西南财经大学马克思主义学院教授、四川省中国特色社会主义理论体系研究中心研究员 刘世强,西南...
01-22
  摘要  【碳酸锂价格节后维持“震荡”业内人士:今年一季度或上演“躁动”行情】对于锂行业...
02-06
  险资在全国的收租版图有加速拓展的势头。近日,新华保险携手万科集团旗下住房租赁平台等,成立...
02-14
当双鱼男第一次见到巨蟹女时,他会展现出一系列特定的表现。这些表现可以帮助我们更好地...
01-22
天蝎座的男生通常被认为是神秘、独立、有魅力的人。他们深思熟虑,善于隐藏自己的情感,并...
01-22
白衬衫搭配什么裤子男?一、白衬衫搭配什么裤子男?白衬衫搭配1、白衬衫搭配黑色西裤男士白色衬衫搭配一条黑色合身的西裤,系上黑色时尚皮带,穿上英伦皮鞋,很帅气有男人味,适合职场...
02-07
苏杭服饰品牌有哪些? 南京有哪些服饰品牌?苏杭服饰品牌有哪些?苏杭服饰品牌著名的有海澜之家/HLA、波司登/BOSIDENG、红豆/Hodo、江苏阳光集团、东渡纺织、虎豹/HUBAO、苏美达...
02-12
2月12日消息,随着电影《哪吒之魔童闹海》登顶全球影史票房榜,电影衍生的正版图书在天猫掀起热潮。天猫中信出版社官方旗舰店的负责人表示,《哪吒・三界往事》这一原创番外绘本,...
02-13
刘强东:无论京东做多大,都将会把最实惠的价格带给用户。1.京东上线竞价购物玩法刘强东认准一件事情,似乎无论发生什么,都会贯彻到底。自从2022年底京东零售内部大会上,刘强东明确...
02-13
尤瓦尔·赫拉利在《人类简史》中曾写道:“人类想要不被淘汰只有一条路:一辈子不断学习,不断改变,不断打造全新的自己。这种改变不只是...
03-04
图片来源:图虫创意 在2025年全国两会期间,全国人大代表、天...
03-09
近日,流程工业一体化方案解决商广东智子智能技术有限公司(以下称“智子智能”)完成近亿元融资,由达晨财智领投,苏创投·国发创投跟投。据了解,本轮融资...
02-07
在全球化的大背景下,中国品牌凭借自身实力与创新能力,在国际舞台上愈发耀眼。近日,来自拉丁美洲的一则消息引起了行业广泛关注:远大智能工业集团博林特电梯,成功中标哥伦比亚麦德...
02-09
今日(1月27日),恐怖探索ADV《呪いの穢れ唄 鳴海龍也の回奇録》Steam页面开放,2025年4月发售,不支持中文,感兴趣的玩家可以点击此处进入商店页面。 游戏介绍: 失...
01-29
由infiniteloop开发,费虚拟桌面宠物游戏《桌面伴侣(Desktop Mate)》的新DLC雪未来发布,冰雪装初音登场,感兴趣的玩家可以关注下了。 Desktop Mate:Steam地址 Deskto...
02-10
记者今天从国家邮政局了解到,今年春节假期,全国邮政快递行业业务量保持良好增长态势,揽收和投递快递包裹超19亿件。国家邮政局数据显示,1月28日至2月4日,全国揽收和投递快递包裹1...
02-05
随着人工智能技术的迅猛发展,AI大模型“深度求索 DeepSeek”凭借其突破性进展迅速走红,各种“培训课”马上就来了。学习人工智能一定要付费吗?消费者如何甄别纷繁的网课?有消费...
02-07
返回

点击右上角微信好友

朋友圈

点击浏览器下方“”分享微信好友Safari浏览器请点击“”按钮

点击右上角QQ

点击浏览器下方“”分享QQ好友Safari浏览器请点击“”按钮