DeepSeek打响头炮!国产芯片开打辅助:卷适配、卷落地、卷性价比

1年前 来源: 观看:157

“忙不过来了。”从春节到元宵,AI芯片和算力厂商的工程师们没有停过一刻忙碌。qGb即热新闻——关注每天科技社会生活新变化gihot.com

奔忙的背后是为了一条名为DeepSeek的“鲇鱼”,其低算力、高性能、开源等特性,使原本卡在算力“瓶颈”中的国产AI再一次拉满想象力。qGb即热新闻——关注每天科技社会生活新变化gihot.com

从大年初四到大年初十,十多家国产AI芯片和算力企业相继加入DeepSeek“朋友圈”,彼时工程师们忙的是DeepSeek模型的适配和服务上架;而如今,要问这些企业在忙什么,得到的回复可能会很统一——部署。qGb即热新闻——关注每天科技社会生活新变化gihot.com

据了解,目前行业正从DeepSeek的适配过渡向部署和应用,企业一方面迎来大量用户咨询,全力响应用户需求,另一方面也正在打造DeepSeek版智算一体机,加速AI应用落地。“DeepSeek真正能成为生产力工具、满足应用落地需求的大模型,可以预期,2025年大模型的应用落地会爆发起来。”业内人士称。qGb即热新闻——关注每天科技社会生活新变化gihot.com

过去两年多,ChatGPT带飞了算力产业,并将英伟达送上“国王宝座”。国产算力厂们苦寻出路。如今,DeepSeek凿开了一个口子,天光已现,但国产算力能否一飞冲天,还有待考验。qGb即热新闻——关注每天科技社会生活新变化gihot.com

有业内人士分析,DeepSeek带来推理算力需求激增,行业可能迎来新一轮的洗牌,未来或是性价比之争。qGb即热新闻——关注每天科技社会生活新变化gihot.com

2月13日,DeepSeek概念股午后再度拉升走高,宏景科技20cm涨停,优刻得(688158.SH)、弘信电子(300657.SZ)、并行科技(839493.BJ)涨超10%。qGb即热新闻——关注每天科技社会生活新变化gihot.com

图源:图虫创意qGb即热新闻——关注每天科技社会生活新变化gihot.com

紧急“适配”qGb即热新闻——关注每天科技社会生活新变化gihot.com

事实上,国产算力厂商的“适配潮”仍在继续。
qGb即热新闻——关注每天科技社会生活新变化gihot.com

例如,早在2月4日,华为就宣布联合硅基流动首发并上线基于华为云昇腾云服务的DeepSeekR1/V3推理服务。但直到2月12日,华为云才再次发文宣布,DeepSeek V3/R1满血版上线。qGb即热新闻——关注每天科技社会生活新变化gihot.com

截至目前,虽已有超15家芯片厂商适配了DeepSeek模型,但据时代财经不完全统计,明确宣布适配DeepSeek R1及V3原版模型的不到一半。qGb即热新闻——关注每天科技社会生活新变化gihot.com

图源:时代财经不完全统计梳理qGb即热新闻——关注每天科技社会生活新变化gihot.com

多数企业宣称能在“几小时内”“一天内”可以快速完成适配的,但大部分仅是DeepSeek R1的系列蒸馏模型,而原版或称“满血版”的模型适配仍在进行中。qGb即热新闻——关注每天科技社会生活新变化gihot.com

云天励飞(688343.SH)副总裁、芯片业务线总经理李爱军告诉时代财经,在适配上线过程中,DeepSeek的模型可分为两类,其一是基于DeepSeek R1蒸馏了一些参数小的模型,包含1.5B、7B、14B以及70B等大模型,这些蒸馏模型的原始模型是通义千问和LLAMA,那么原本能够支持通义千问和LLAMA模型的平台,基本上就能适配这些DeepSeek的蒸馏模型,这一块的工作量相对较小,企业一般花费一周左右就能适配完成。qGb即热新闻——关注每天科技社会生活新变化gihot.com

另一类则是DeepSeek V3和DeepSeek R1的原版模型,这是DeepSeek自研的原生态MOE大模型,其参数量达到了671B,里面囊括了MLA等新的算子,考验着芯片适应超大规模MOE架构、支持新型算子、稀疏MoE模型的执行效率等的能力。qGb即热新闻——关注每天科技社会生活新变化gihot.com

而其中最大的难点在于模型本身的参数量大。“目前,国产HBM(高带宽存储器)芯片的容量不大,在用于推理的人工智能计算场景中,16GB、32GB乃至64GB的HBM容量已经被认为是较大的配置了。但即使是使用64GB的芯片来运行671B参数的大模型,要把参数加载到芯片中,也至少需要11张×64GB的芯片才能勉强放下这个模型。这也意味着单卡无法解决问题,牵涉到卡与卡之间的互联能力和效率。”李爱军谈到,因此,适配的时长取决于各家的基础。基础好、投入大的,一到两周就能完成适配,技术次于此的,可能在两三周左右能够适配完,或者更长时间,有的甚至无法适配。qGb即热新闻——关注每天科技社会生活新变化gihot.com

昆仑芯科技也表示,理论上,各类大模型的常规模型、常规组网能直接跑通,然而难免会出现特殊算子、特殊规模,需要投入人力进行针对性调试。跑通只是基础,后期涉及后端硬件不同、算子实现不同、对应软件版本不同等因素,精度对齐、性能对齐也都需要人力介入进行针对性适配。qGb即热新闻——关注每天科技社会生活新变化gihot.com

不过,也有行业人士向时代财经透露,由于DeepSeek本身开源,适配过程中并不需要授权,尽管目前众多平台都在适配该模型,但这种适配可能并非真正意义上的“接入”。“真正意义上的接入是DeepSeek利用某个智算中心提供云服务,但是目前真正和DeepSeek达成这种合作的厂商非常少,可能只有一两家。”qGb即热新闻——关注每天科技社会生活新变化gihot.com

qGb即热新闻——关注每天科技社会生活新变化gihot.com

部署和落地qGb即热新闻——关注每天科技社会生活新变化gihot.com

适配之外,更关键的是部署。qGb即热新闻——关注每天科技社会生活新变化gihot.com

近期,并行科技(839493.BJ)、壁仞科技、摩尔线程和昆仑芯科技等多家企业均向时代财经透露,他们正在忙于为客户做DeepSeek模型的部署。qGb即热新闻——关注每天科技社会生活新变化gihot.com

“部署是大模型转化为生产力的必要步骤。”中存算半导体董事长陈巍解释,部署相当于在用户的生产环境里进行模型的安装设置和做与客户成产环境的连接。qGb即热新闻——关注每天科技社会生活新变化gihot.com

时代财经在某国产算力运营商的产品交流群中观察到,不少用户在询问如何导入和设置API、如何集成相关服务,还有人咨询DeepSeek模型接入后为何运行速度较慢等。qGb即热新闻——关注每天科技社会生活新变化gihot.com

“行业确实正处于模型应用落地的关键阶段。”2月12日,摩尔线程相关技术负责人向时代财经表示。qGb即热新闻——关注每天科技社会生活新变化gihot.com

时代财经了解到,在近期行业密集适配DeepSeek系列模型后,不少厂商开始寻求落地应用,智算一体机这种硬件部署形式于是浮出了水面。qGb即热新闻——关注每天科技社会生活新变化gihot.com

摩尔线程表示,公司正与雪浪云联合打造了“软硬件紧耦合”大模型训推一体机——雪浪MindCenter X100,就已成功部署DeepSeek-R1-Distill-Qwen(适配1.5B、7B、14B、32B)推理服务。qGb即热新闻——关注每天科技社会生活新变化gihot.com

“一体机生意会是今年的大机会,离线需求太多了。”有业内人士感慨道。qGb即热新闻——关注每天科技社会生活新变化gihot.com

“前段时间大家都在适配,适配了之后呢?我们希望能够在一些领域能够实现真正的应用。”壁仞科技相关负责人告诉时代财经,壁仞科技联合中兴通讯、浙江大学上海高等研究院和一蓦科技推出了智海AI教育一体机。该产品实现了国产算力与DeepSeek的适配及知识课程、实训课题、智能体等教学工具的设计开发,并形成了包含AI通识课、专业课、实践实训在内的一体化解决方案。qGb即热新闻——关注每天科技社会生活新变化gihot.com

2月11日,中国电信(601728.SH)和中国移动(600941.SH)两大电信运营商也分别推出了天翼云和移动云智算一体机-DeepSeek版。qGb即热新闻——关注每天科技社会生活新变化gihot.com

据移动云官方消息,智算一体机简单来说就是基于移动云边缘智能小站算力底座打造的小型专属云,专门为企业量身定制。它复用了边缘智能小站的产品技术,还有统一运维、快速交付这些服务,解决了企业在 AI 应用落地时对数据安全的担忧,还能提高AI应用开发的效率。qGb即热新闻——关注每天科技社会生活新变化gihot.com

图源:移动云官方公众号qGb即热新闻——关注每天科技社会生活新变化gihot.com

此外,京东云、联想(0992.HK)、科华数据(002335.SZ)、浪潮云、中国长城(000066.SZ)、天融信(002212.SZ)等企业均官宣发布了DeepSeek智算一体机。qGb即热新闻——关注每天科技社会生活新变化gihot.com

qGb即热新闻——关注每天科技社会生活新变化gihot.com

行业或迎洗牌?qGb即热新闻——关注每天科技社会生活新变化gihot.com

DeepSeek火了,顺带捧红了国产算力,但也带出了一系列疑问。DeepSeek时代需要怎样的算力?DeepSeek又将如何改变如今算力市场的战局?qGb即热新闻——关注每天科技社会生活新变化gihot.com

此前,DeepSeek似乎已经出现算力吃紧的现象。2月6日,DeepSeek暂停API(接口)充值服务,DeepSeek官方解释为服务器资源紧张。2月9日,DeepSeek调整收费标准,每百万输入tokens的价格为0.5元(针对缓存命中情况)和2元(针对缓存未命中情况),而输出tokens的价格则定为每百万8元。在优惠期内,DeepSeek-V3对于输入tokens的收费是每百万0.1元(缓存命中)和1元(缓存未命中),输出tokens则是每百万2元。qGb即热新闻——关注每天科技社会生活新变化gihot.com

图源:图虫创意qGb即热新闻——关注每天科技社会生活新变化gihot.com

李爱军认为,在DeepSeek模型的性能足够强,而其未来很可能继续延续开源的策略的情况下,企业能够直接使用它进行应用落地,而非自己再重新训练出一个基础模型。由此,未来推理侧的算力需求将大规模爆发。qGb即热新闻——关注每天科技社会生活新变化gihot.com

他表示,在模型训练环节追求的是极致的性能,哪怕GPU价格非常高,企业也不吝购买。一旦到了推理环节,行业的关注点就会变成性价比,因为推理时时刻刻都要使用,GPU芯片在推理时代性价比不突出,专门针对推理场景设计的ASIC芯片会大有机会。qGb即热新闻——关注每天科技社会生活新变化gihot.com

“训练芯片和推理芯片在思路逻辑上有较大区别,训练芯片多选择兼容CUDA架构,走的是GPU架构,推理芯片如云天励飞等,多走的是神经网络处理架构。从训练芯片向推理芯片的转换,市场对芯片的要求、商业模式会有较大的变化。”李爱军推测,未来芯片行业可能将面临新一轮洗牌。qGb即热新闻——关注每天科技社会生活新变化gihot.com

摩尔线程相关技术负责人则认为,从训练侧来看,Scaling Law规模定律仍然有效,模型迭代会加快,对于国产优质训练算力的需求不会降低。长期看,模型参数规模扩大(如GPT-5)和训练方法革新(如MoE)仍会推动训练算力需求增长;从推理侧来看,随着生成式AI应用落地,落地应用(如AIGC、智能体、垂直行业模型)将带来海量碎片化推理需求,市场规模有可能超过训练。qGb即热新闻——关注每天科技社会生活新变化gihot.com

该技术负责人表示,短期内,国产GPU厂商应保持训练芯片的持续迭代,比如最好支持FP8,确保技术不脱节,同时通过推理芯片快速切入商业化场景。从长期上,瞄准“训推一体”架构,通过统一计算平台降低客户切换成本,最终在自主生态中实现训练与推理的协同增长。qGb即热新闻——关注每天科技社会生活新变化gihot.com

至于DeepSeek的冲击波能否影响到大洋彼岸的英伟达,陈巍表示,没有看到deepseek对英伟达的直接利空,但如果DeepSeek引发更大范围更严格的禁运,那么可能使得英伟达GPU销量减少。qGb即热新闻——关注每天科技社会生活新变化gihot.com

“事实上,每一代模型的进步,都意味着同等算力下模型精度更改。在以往模型的进步并未引起英伟达市值下跌。对于deepseek这类大模型,由于参数量巨大,需要更低的存力成本。降本增效是摆在各厂家面前的关键。”陈巍说道。qGb即热新闻——关注每天科技社会生活新变化gihot.com

本文链接:http://www.gihot.com/news-2-524-0.htmlDeepSeek打响头炮!国产芯片开打辅助:卷适配、卷落地、卷性价比

声明:本网页内容由互联网博主自发贡献,不代表本站观点,本站不承担任何法律责任。天上不会到馅饼,请大家谨防诈骗!若有侵权等问题请及时与本网联系,我们将在第一时间删除处理。

上一篇:节后6连板!浙数文化3度公告与DeepSeek无关联,仍遭机构爆炒

下一篇:京东0佣金强攻外卖,餐饮商家:会考虑进驻,但更关心后续流量扶持

为你推荐
据《光子能源杂志》最新发表的一项研究称,以色列内盖夫本-古里安大学科学家开发出一种将液晶和纳米多孔微粒相结合的新方法,从而创造出一种能同时控...
01-24
1月22日,汽车产业再迎重大战略合作:东风汽车集团有限公司(以下简称东风汽车)旗下主流科技电动品牌东风奕派与华为技术有限公司(以下简称华为)在华为深圳...
01-24
辽宁省气象局发布气象信息11日夜间辽宁中东部地区有中雪到大雪并伴有大风和降温将出现明显道路湿滑或结...
02-09
  受益于亚冬会带来的冰雪经济新热度,滑雪服、羽绒服、滑雪手套等装备的销量在这个冬天迎来了...
02-18
新闻记者 潘锡珩通讯员陈默 龙慧芳近日,武汉市武昌区黄鹤楼街道读书社区的居民代表,为武钢江南燃气公司送上了一面锦旗,上面写着“踏实为民办实事,情暖人心暖寒冬”,以此表达对江...
01-22
  中新经纬1月17日电 “国家邮政局”微信号17日发布的《2024年12月中国快递发展指数报告》(以下简称《报告》)显示,2024年12月,快递发展规模指数为636.2,同比提升28.4%。  ...
01-21
1 月 24 日消息,据“一汽红旗”官方公众号,一汽红旗宣布旗下天工系列全新电动中型车定名为天工 05,该车是红旗天工系列的首款轿车,官图称该车将于“新岁登场”,结合该车...
01-25
1 月 27 日消息,特斯拉副总裁陶琳今日发文对焕新 Model Y 的空调系统进行了介绍,这款新车预计 3 月开始交付,后轮驱动首发版(593km 标准续航)26.35 万元,全轮驱动首发版(71...
01-28
  1、《爱你》电视剧原著小说叫《爱你,是我做过最好的事》,小说由笙离所著。  2、原著小说讲的是一个温暖的爱情故事,改编后的电视剧由张凌赫跟徐若晗领衔主演,即将上星江...
02-20
随着电视剧《狂医魔徒》的热播,该剧逐渐吸引了广大粉丝的关注。一经播出,就以精彩的剧情、精良的制作和精心的演绎赢得了观众的一致好评,并且拿下了收视第一的...
02-22
21世纪经济报道 唐唯珂 广州报道医院端经营的考验还在持续。本月,投资30亿元,开诊仅2.5年的重庆全域肿瘤医院在其官方公众号上发布了解除职...
01-21
作者:衣晓蕾 上海市第六人民医院超声医学科公益科普支持:广东省二十一世纪教育基金会 “医生,我最近喉咙疼,还发热,是不是甲流啊?我好害怕啊!”“...
02-07
  大众网记者 王一刚 报道  1.暖·冬至  冬至,在我国农历的舞台上,它不仅是一个至关重要的节气,更是一场阖家团圆、传承民俗的文化盛宴。  为了在幼儿心底种下传统...
01-21
2023年12月11日,灞桥区洪庆街道“双减办”组织教育、安监等多部门,对洪庆地铁口“爱心托管”进行突击检查。  检查中发现,“爱心托管”在市场监管部门有备案,但机构内印有学...
01-21
  摘要  【证监会重磅!13处提及期货解读来了】《关于资本市场做好金融“五篇大文章”的实施...
02-08
  近期,江西、湖北等地的中小银行增资扩股方案获得当地金融监管部门的批复同意。相比往年,此轮...
02-11
金牛座男生通常对于女生有着独特的偏好和要求。他们喜欢一种特定类型的女生,下面将介绍...
01-22
每个星座都有自己独特的喜好和偏好,而摩羯座也不例外。作为一个土象星座,摩羯座的人通常...
01-22
北京时尚潮胖子服饰:穿出个性与自信在北方的气候里,冬天的衣物需要保暖,夏天则需要清凉。而对于胖子们来说,选择一套合适的服饰不仅要考虑到舒适度,更要能够展现个人的魅力。作为...
02-07
秋天穿搭指南:吊带牛仔裙最佳搭配鞋子和裤子推荐引言每到秋天,街头巷尾的穿搭风格总是发生变化。单薄的夏季衣物被厚实的秋装替代,而吊带牛仔裙作为一种经典的单品,总是让人们在...
02-07
2月9日消息,抖音商城情人节活动日前正式启动,2月8日-14日,抖音电商将投入海量的流量激励和用户补贴,鼓励商家达人赢得春节后业绩的快速恢复和爆发增长。本次大促活动依托平台全...
02-09
2月18日消息,遥望科技近日与巴西最大直播机构ABLELIVE达成独家战略合作,携手深耕巴西市场,共同打造该国直播电商行业的最大样板,致力推动巴西直播电商生态体系的深度升级。图源: ...
02-18
2月24日消息,叮当健康科技集团有限公司公告称,相对于截至2023年12月31日止年度净亏损约2.31亿元,公司预期2024财年净亏损将增加64%以上。图源:东方财富网叮当健康表示,以上亏损主...
02-25
3月6日消息,携程集团与山东文旅集团近日宣布达成全方位战略合作,两大旅游集团20强将围绕“平台赋能+产业创新”主线,通过资源整合与模式创新,共同构建覆盖“产品开发、营销推广...
03-09
全球性金融券商集团英国EBC Group平台始终致力于以领先生态,与全球交易者共塑交易的未来。 自第一届交易大赛起,为赤忱的热爱和卓越的才华提供舞台,在全球内寻找交易好手以赋能...
01-24
央广网北京2月7日消息 2025年春节迎来“最长假期”,人们外出旅游的热情被充分激发。京东携手联通数智智慧足迹,对全国31个省会城市、自治区首府和直辖市的景点客流量及旅行消...
02-09
在美国,PS5主机的销量走势领先于PS4,而Xbox Series主机的销量则落后于Xbox One。 这一信息来自Circana(前身为NPD集团)的执行董事兼电子游戏行业分析师马特·皮斯...
01-27
由Dark Panda打造的第三人称射击生存动作冒险游戏《奇异地平线(Strange Horizons)》,现已上线Steam平台。 本作 是一款生存冒险游戏,在游戏中,一个通往另一个维度...
02-06
你的浏览器不支持video标签。极目新闻记者 张屏 视频剪辑 李仪2月5日,10位“楚才”人形机器人在武汉洪山礼堂组团亮相,为湖北省“新春第一会”上演科技序曲。其中,华中科技大学...
02-05
据网络平台数据,电影《哪吒之魔童闹海》观影人次(含预售)突破1.60亿,超《战狼2》观影人次成绩,登顶中国影史观影人次榜!《哪吒2》成中国影史观影人次冠军。(总台央视记者 许盼盼)...
02-09
返回

点击右上角微信好友

朋友圈

点击浏览器下方“”分享微信好友Safari浏览器请点击“”按钮

点击右上角QQ

点击浏览器下方“”分享QQ好友Safari浏览器请点击“”按钮