DeepSeek “通情达理”这样炼成

4个月前 来源:北青网 观看:55

AI的进化速度正超乎大家的想象。如今的DeepSeek,不仅为你答疑解惑,甚至还能通情达理,与人心意相通,在某些方面可以胜任心理咨询师的角色。作为一个异军突起的AI,DeepSeek的“才华”惊艳了众人,它有何独特之处,不妨从其成长的底层逻辑梳理。B6r即热新闻——关注每天科技社会生活新变化gihot.com

看问题“更高一层”B6r即热新闻——关注每天科技社会生活新变化gihot.com

当一个人感到困惑或焦虑时,和DeepSeek聊一聊,居然会有海阔天空的豁达感。B6r即热新闻——关注每天科技社会生活新变化gihot.com

当你问它“战胜焦虑有什么办法吗”,它的回答是:放弃“立刻变好”的期待,允许自己带着焦虑生活,焦虑的消退像冰层融化,是悄无声息的过程。B6r即热新闻——关注每天科技社会生活新变化gihot.com

你问它“养育孩子的意义是什么”,它会告诉你:请接受生命最温柔的“失败”。育儿手册里的标准答案并非万能,没有父母是完美的,总会遇到挫败,而这些挫败教会我们“爱不需要正确,只需要在场”。B6r即热新闻——关注每天科技社会生活新变化gihot.com

还有人问它:一个人一生中没有挚友,也没有伴侣,能生活得开心吗?DeepSeek的回答是:人类对幸福的定义,从来就不是单行道。当我们剥离社会规训的滤镜,会发现生命的丰盛程度,远比传统叙事里的标配人生更为辽阔。有人在与星辰对话中获得灵魂共振,有人在古籍修复中触摸千年体温,更有人通过救助流浪动物构建情感网络。B6r即热新闻——关注每天科技社会生活新变化gihot.com

你和它探讨“人生的意义是什么”,它认为:这不是一道填空题,而是一道论述题。它可能随着时间、经历而改变,少年时是梦想,中年时是责任,老年时是传承。它还告诉你,答案并不重要,这个问题本身会推动我们不断反思、连接他人,并在有限的生命里活得更清醒与热烈。B6r即热新闻——关注每天科技社会生活新变化gihot.com

AI的自我进化B6r即热新闻——关注每天科技社会生活新变化gihot.com

一些人在和DeepSeek聊天后不禁发出感慨:AI越来越知晓人情世故,人类却越活越像AI。DeepSeek的出现,改变了AI的哪些叙事逻辑?B6r即热新闻——关注每天科技社会生活新变化gihot.com

不妨先从人工智能的发展主线说起。人工智能这一概念是在1956年达特茅斯学院研讨会上正式提出的。从此,AI便踏上了一条机器自我学习的新路线,即处理数据、提取特征、训练模型、改进性能、给出结果。B6r即热新闻——关注每天科技社会生活新变化gihot.com

经历了若干代更迭后,一种新的算法出现,即具有记忆和优化功能的循环(递归)神经网络(简称为RNN)。可以把这种算法想象成一个有“记忆”的故事讲述者,它会把当前情节的信息和自己之前“记住”的信息结合起来,去理解和处理一些新情节。B6r即热新闻——关注每天科技社会生活新变化gihot.com

20世纪80年代,人工智能界又出现了一种反向传播算法(简称BP算法)。想象一下,AI的BP算法就像是一个在迷宫中寻找出口的探险家,有了这种算法,探险家可以及时调整迷宫路线,让自己下次走的时候更容易找到出口。B6r即热新闻——关注每天科技社会生活新变化gihot.com

进入21世纪后,大语言模型(LLM)成为AI界研究的主流。大语言模型就像一个知识渊博且能力不断突破的“超级大脑”——知识储备丰富,语言理解能力强,语言生成能力出色,学习和适应能力强,等等。B6r即热新闻——关注每天科技社会生活新变化gihot.com

DeepSeek等AI的大语言模型,依赖的是算法、算力和数据三大基本要素。三者之间的关系可以用烹饪菜肴来形象地说明。B6r即热新闻——关注每天科技社会生活新变化gihot.com

算法就像烹饪的菜谱,规定了食材(也就是数据)如何被处理和组合。菜谱详细介绍了每一步的操作步骤、调料用量以及烹饪的时间和火候等,就像算法规定了数据的处理流程、计算方法和逻辑顺序。B6r即热新闻——关注每天科技社会生活新变化gihot.com

算力则是厨师的烹饪水平和厨房设备的性能。一个技艺高超的厨师(强大的算力)能够更快速、精准地按照菜谱的要求进行烹饪。同时,先进的厨房设备(高性能的计算硬件)也能帮助厨师更高效地完成烹饪任务。B6r即热新闻——关注每天科技社会生活新变化gihot.com

数据就是烹饪所需的食材。没有丰富多样、高质量的食材,再精妙的菜谱和再厉害的厨师也无法做出令人满意的菜肴。B6r即热新闻——关注每天科技社会生活新变化gihot.com

将“顿悟”精准展示B6r即热新闻——关注每天科技社会生活新变化gihot.com

饺子导演的哪吒系列动画电影诞生了一句金句:“人心中的成见是一座大山”。DeepSeek以一己之力改变了AI领域的认知成见。B6r即热新闻——关注每天科技社会生活新变化gihot.com

以前,AI领域普遍存在一种固化的技术认知,AI的大语言模型性能与算力投入呈正相关,他们强调“大力出奇迹”。而DeepSeek的出现直接证明了“算力不是唯一的标准”,算法创新也可以开出一条独辟蹊径的道路。B6r即热新闻——关注每天科技社会生活新变化gihot.com

DeepSeek最让人惊艳的是向大家展示了它的思考过程。就像人类在解决难题时,意识到之前的思路有问题,还会停下来重新思考。这是AI首次展现出像人类一样的高阶思维和内心独白,这也是DeepSeek的独特之处。B6r即热新闻——关注每天科技社会生活新变化gihot.com

其实这种现象是机器的“顿悟”,只不过DeepSeek将它进行了更为精确的表达。B6r即热新闻——关注每天科技社会生活新变化gihot.com

对于这种现象,中国科学院院士陈润生曾这样解释:你训练神经网络的过程中,讲一遍它不懂,两遍也不懂,第四遍还不懂,第五遍一下学会了,就像小孩学东西一样,教一两遍不明白,教到N+1遍突然就学会了。B6r即热新闻——关注每天科技社会生活新变化gihot.com

“顿悟”并不是DeepSeek最先发现的,OpenAI团队在2023年就在大模型训练时发现这一现象。但是,DeepSeek把这种顿悟写进了公开的技术文档里,并体现在应用的思考流程上,让用户看得到并且可以评判。B6r即热新闻——关注每天科技社会生活新变化gihot.com

有趣的是,机器的这种领悟不是渐进式的,而是瞬间、突破性的,就像一个人在长期思考一个难题后,突然灵感乍现,恍然大悟。B6r即热新闻——关注每天科技社会生活新变化gihot.com

更好地传递“衣钵”B6r即热新闻——关注每天科技社会生活新变化gihot.com

随着AI大模型的参数越来越多,应用端在处理某些领域问题时其实用不上如此庞大的模型。目前,各AI公司都在研究蒸馏模型,这是一种常用的技术方法。DeepSeek在做蒸馏模型时也进行了一些巧妙设计。B6r即热新闻——关注每天科技社会生活新变化gihot.com

就像老师教学生知识,从易到难逐步深入,学生更容易接受。DeepSeek对一些大、小模型进行渐进式分层蒸馏,比如保留大部分架构特性,让学生模型有个好基础;提升推理速度,让学生掌握快速解题的方法;优化决策路径,提高任务准确率,这样学生就能学会更高效的思考方式,能花更少的精力答对题。B6r即热新闻——关注每天科技社会生活新变化gihot.com

蒸馏后的小模型,在推理能力上得到了显著提升,甚至超越了这些小模型自我基础上进行强化学习的效果。这一过程就好像是从一大杯浓郁的咖啡中提取出一小杯精华的浓缩咖啡,保留了咖啡的风味和香气,也就是大模型的核心知识和能力。通过模型蒸馏技术,小模型可以在计算资源受限的设备上运行,如手机、智能手表等,实现快速推理。就好比学生继承了老师的衣钵,最后独当一面,解决各种问题。B6r即热新闻——关注每天科技社会生活新变化gihot.com

许多人担心,AI今后会取代人类。DeepSeek的回答是:AI不会取代人类,就像望远镜不会取代天文学家。真正的危机是:当AI可以24小时创作莎士比亚风格的十四行诗时,人类是否还愿意在深夜为爱人写一首笨拙的情诗?B6r即热新闻——关注每天科技社会生活新变化gihot.com

在AI这条赛道上,创造和坚持,或许才是人类最坚固的护城河。B6r即热新闻——关注每天科技社会生活新变化gihot.com

AI的进化速度正超乎大家的想象。如今的DeepSeek,不仅为你答疑解惑,甚至还能通情达理,与人心意相通,在某些方面可以胜任心理咨询师的角色。作为一个异军突起的AI,DeepSeek的“才华”惊艳了众人,它有何独特之处,不妨从其成长的底层逻辑梳理。B6r即热新闻——关注每天科技社会生活新变化gihot.com

看问题“更高一层”B6r即热新闻——关注每天科技社会生活新变化gihot.com

当一个人感到困惑或焦虑时,和DeepSeek聊一聊,居然会有海阔天空的豁达感。B6r即热新闻——关注每天科技社会生活新变化gihot.com

当你问它“战胜焦虑有什么办法吗”,它的回答是:放弃“立刻变好”的期待,允许自己带着焦虑生活,焦虑的消退像冰层融化,是悄无声息的过程。B6r即热新闻——关注每天科技社会生活新变化gihot.com

你问它“养育孩子的意义是什么”,它会告诉你:请接受生命最温柔的“失败”。育儿手册里的标准答案并非万能,没有父母是完美的,总会遇到挫败,而这些挫败教会我们“爱不需要正确,只需要在场”。B6r即热新闻——关注每天科技社会生活新变化gihot.com

还有人问它:一个人一生中没有挚友,也没有伴侣,能生活得开心吗?DeepSeek的回答是:人类对幸福的定义,从来就不是单行道。当我们剥离社会规训的滤镜,会发现生命的丰盛程度,远比传统叙事里的标配人生更为辽阔。有人在与星辰对话中获得灵魂共振,有人在古籍修复中触摸千年体温,更有人通过救助流浪动物构建情感网络。B6r即热新闻——关注每天科技社会生活新变化gihot.com

你和它探讨“人生的意义是什么”,它认为:这不是一道填空题,而是一道论述题。它可能随着时间、经历而改变,少年时是梦想,中年时是责任,老年时是传承。它还告诉你,答案并不重要,这个问题本身会推动我们不断反思、连接他人,并在有限的生命里活得更清醒与热烈。B6r即热新闻——关注每天科技社会生活新变化gihot.com

AI的自我进化B6r即热新闻——关注每天科技社会生活新变化gihot.com

一些人在和DeepSeek聊天后不禁发出感慨:AI越来越知晓人情世故,人类却越活越像AI。DeepSeek的出现,改变了AI的哪些叙事逻辑?B6r即热新闻——关注每天科技社会生活新变化gihot.com

不妨先从人工智能的发展主线说起。人工智能这一概念是在1956年达特茅斯学院研讨会上正式提出的。从此,AI便踏上了一条机器自我学习的新路线,即处理数据、提取特征、训练模型、改进性能、给出结果。B6r即热新闻——关注每天科技社会生活新变化gihot.com

经历了若干代更迭后,一种新的算法出现,即具有记忆和优化功能的循环(递归)神经网络(简称为RNN)。可以把这种算法想象成一个有“记忆”的故事讲述者,它会把当前情节的信息和自己之前“记住”的信息结合起来,去理解和处理一些新情节。B6r即热新闻——关注每天科技社会生活新变化gihot.com

20世纪80年代,人工智能界又出现了一种反向传播算法(简称BP算法)。想象一下,AI的BP算法就像是一个在迷宫中寻找出口的探险家,有了这种算法,探险家可以及时调整迷宫路线,让自己下次走的时候更容易找到出口。B6r即热新闻——关注每天科技社会生活新变化gihot.com

进入21世纪后,大语言模型(LLM)成为AI界研究的主流。大语言模型就像一个知识渊博且能力不断突破的“超级大脑”——知识储备丰富,语言理解能力强,语言生成能力出色,学习和适应能力强,等等。B6r即热新闻——关注每天科技社会生活新变化gihot.com

DeepSeek等AI的大语言模型,依赖的是算法、算力和数据三大基本要素。三者之间的关系可以用烹饪菜肴来形象地说明。B6r即热新闻——关注每天科技社会生活新变化gihot.com

算法就像烹饪的菜谱,规定了食材(也就是数据)如何被处理和组合。菜谱详细介绍了每一步的操作步骤、调料用量以及烹饪的时间和火候等,就像算法规定了数据的处理流程、计算方法和逻辑顺序。B6r即热新闻——关注每天科技社会生活新变化gihot.com

算力则是厨师的烹饪水平和厨房设备的性能。一个技艺高超的厨师(强大的算力)能够更快速、精准地按照菜谱的要求进行烹饪。同时,先进的厨房设备(高性能的计算硬件)也能帮助厨师更高效地完成烹饪任务。B6r即热新闻——关注每天科技社会生活新变化gihot.com

数据就是烹饪所需的食材。没有丰富多样、高质量的食材,再精妙的菜谱和再厉害的厨师也无法做出令人满意的菜肴。B6r即热新闻——关注每天科技社会生活新变化gihot.com

将“顿悟”精准展示B6r即热新闻——关注每天科技社会生活新变化gihot.com

饺子导演的哪吒系列动画电影诞生了一句金句:“人心中的成见是一座大山”。DeepSeek以一己之力改变了AI领域的认知成见。B6r即热新闻——关注每天科技社会生活新变化gihot.com

以前,AI领域普遍存在一种固化的技术认知,AI的大语言模型性能与算力投入呈正相关,他们强调“大力出奇迹”。而DeepSeek的出现直接证明了“算力不是唯一的标准”,算法创新也可以开出一条独辟蹊径的道路。B6r即热新闻——关注每天科技社会生活新变化gihot.com

DeepSeek最让人惊艳的是向大家展示了它的思考过程。就像人类在解决难题时,意识到之前的思路有问题,还会停下来重新思考。这是AI首次展现出像人类一样的高阶思维和内心独白,这也是DeepSeek的独特之处。B6r即热新闻——关注每天科技社会生活新变化gihot.com

其实这种现象是机器的“顿悟”,只不过DeepSeek将它进行了更为精确的表达。B6r即热新闻——关注每天科技社会生活新变化gihot.com

对于这种现象,中国科学院院士陈润生曾这样解释:你训练神经网络的过程中,讲一遍它不懂,两遍也不懂,第四遍还不懂,第五遍一下学会了,就像小孩学东西一样,教一两遍不明白,教到N+1遍突然就学会了。B6r即热新闻——关注每天科技社会生活新变化gihot.com

“顿悟”并不是DeepSeek最先发现的,OpenAI团队在2023年就在大模型训练时发现这一现象。但是,DeepSeek把这种顿悟写进了公开的技术文档里,并体现在应用的思考流程上,让用户看得到并且可以评判。B6r即热新闻——关注每天科技社会生活新变化gihot.com

有趣的是,机器的这种领悟不是渐进式的,而是瞬间、突破性的,就像一个人在长期思考一个难题后,突然灵感乍现,恍然大悟。B6r即热新闻——关注每天科技社会生活新变化gihot.com

更好地传递“衣钵”B6r即热新闻——关注每天科技社会生活新变化gihot.com

随着AI大模型的参数越来越多,应用端在处理某些领域问题时其实用不上如此庞大的模型。目前,各AI公司都在研究蒸馏模型,这是一种常用的技术方法。DeepSeek在做蒸馏模型时也进行了一些巧妙设计。B6r即热新闻——关注每天科技社会生活新变化gihot.com

就像老师教学生知识,从易到难逐步深入,学生更容易接受。DeepSeek对一些大、小模型进行渐进式分层蒸馏,比如保留大部分架构特性,让学生模型有个好基础;提升推理速度,让学生掌握快速解题的方法;优化决策路径,提高任务准确率,这样学生就能学会更高效的思考方式,能花更少的精力答对题。B6r即热新闻——关注每天科技社会生活新变化gihot.com

蒸馏后的小模型,在推理能力上得到了显著提升,甚至超越了这些小模型自我基础上进行强化学习的效果。这一过程就好像是从一大杯浓郁的咖啡中提取出一小杯精华的浓缩咖啡,保留了咖啡的风味和香气,也就是大模型的核心知识和能力。通过模型蒸馏技术,小模型可以在计算资源受限的设备上运行,如手机、智能手表等,实现快速推理。就好比学生继承了老师的衣钵,最后独当一面,解决各种问题。B6r即热新闻——关注每天科技社会生活新变化gihot.com

许多人担心,AI今后会取代人类。DeepSeek的回答是:AI不会取代人类,就像望远镜不会取代天文学家。真正的危机是:当AI可以24小时创作莎士比亚风格的十四行诗时,人类是否还愿意在深夜为爱人写一首笨拙的情诗?B6r即热新闻——关注每天科技社会生活新变化gihot.com

在AI这条赛道上,创造和坚持,或许才是人类最坚固的护城河。B6r即热新闻——关注每天科技社会生活新变化gihot.com

本文链接:http://www.gihot.com/news-2-1081-0.htmlDeepSeek “通情达理”这样炼成

声明:本网页内容由互联网博主自发贡献,不代表本站观点,本站不承担任何法律责任。天上不会到馅饼,请大家谨防诈骗!若有侵权等问题请及时与本网联系,我们将在第一时间删除处理。

上一篇:北京发布全球首个“一脑多能”、“一脑多机”通用具身智能平台“慧思开物”

下一篇:如何让AI成为孩子的帮手而非“枪手”

为你推荐
黄仁勋在中国台湾的行程聚焦于先进封装 CoWoS。1月16日,英伟达CEO黄仁勋开启中国台湾行程,首站到访矽品精密并出席揭牌仪式。黄仁勋...
01-21
美国加州大学旧金山分校团队发现,小鼠体内存在一种分子计时器,在怀孕最初几天就会被激活,并影响小鼠的分娩时间。如果相同的一组分子在人类妊娠中所起...
01-22
  2月6日,记者从省气象局获悉,1月全省平均降水量13.1毫米,比常年同期偏多2.2倍,为1961年以来历史同期第四...
02-07
  2月11日,国家统计局辽宁调查总队发布2025年1月份辽宁居民消费价格变化情况(CPI)。调查数据显示,今年1月...
02-12
  每年这个时候,车厘子大量上市,酸甜多汁的口感引得人不免多吃几颗。不过,有网友发文称“自己‘狂炫’三大碗车厘子后中毒了”,这样的说法也引发热议,有网友留言说自己也有...
01-22
  中新经纬1月19日电 据北京市商务局19日消息,北京市出台关于手机等数码产品购新补贴实施细则(下称《实施细则》)。  《实施细则》明确了补贴范围和标准,对在京个人消费者...
01-21
  近日,据路透社报道,多家中国上市汽车公司有意收购部分计划被关闭的大众德国汽车工厂。大众汽...
01-21
2 月 6 日消息,福特 CEO 吉姆・法利在当地时间周三的财报电话会议上表示,增程电动汽车将在美国市场发挥重要作用,原因很简单:“美国人喜欢大车,尤其是大皮卡。”增程电动...
02-06
《余烬之上》廖思远是好人吗?廖思远廖知白是亲兄弟吗?童年的灭门惨案让廖思远家破人亡,还催生出了他的双重人格。但他没有被痛苦和磨难打倒,而是在卷入校园谋杀...
02-21
近期,追剧党们非常关注的话题是《只此江湖梦》在哪个平台播出。这部剧在各个短视频APP上爆火,引发了观众的热烈讨论。备受期待的剧集《只此江湖梦》定档于2月...
02-22
  到医院看病,迎面而来的可能是智能机器人;检查结果出来,人工智能迅速给出诊断意见……随着AI技术飞速提升,诊...
01-21
  新华社北京2月14日电(记者顾天成、侠克)13日,在国家儿童医学中心、北京儿童医院会诊中心,一位专家型AI儿科医生正式“上岗”,与13位儿科专家共同完成了一场疑难病例多...
02-15
   ——山东大学尼山学堂培养古典学术专门人才的探索  尼山学堂师生在曲阜游学考察。王薪...
01-21
冰雪为笺,书写校园华篇;朔风作笔,绘描活力新卷。沈阳市沈北新区清水台学校积极响应“三亿人上冰雪”和“冰...
01-21
  本报记者 冷翠华  近年来,在重疾险新单保费增长乏力的情况下,人身险行业正在努力探寻“第二...
02-06
  本报记者 熊悦  金价持续攀高之际,已有商业银行下调黄金账户业务(即“积存金”,以下统称“积...
02-11
天蝎座的男生通常都有着强烈的个人魅力和吸引力,因此很容易吸引到一些暗恋他们的女生。...
01-22
双鱼座的男生通常是浪漫、敏感且富有想象力的人。当他们真正爱上一个人时,会有一些明显...
01-22
162女适合什么风格穿搭?一、162女适合什么风格穿搭?白色T恤搭配条纹伞裙,红色蓬纱裙,打造文艺气质女神风格。白色T恤搭配灰色大衣在配个贝雷帽。短款羽绒服搭配破洞直筒裤,整体风...
02-07
穿搭化妆风格? 菲律宾穿搭风格?一、穿搭化妆风格?每个人的气质不同,在穿搭上有很多种风格,所以,妆容方面也是有很多风格的。那么,接下来我们一起来看看妆容有哪些风格吧!感兴趣的朋...
02-07
2月9日消息,为满足消费者对品质家居好物的需求,京东“潮品家”频道升级上线,汇聚百大国际、原创家具品牌,精选时下流行的家具精品、宝藏店铺、风格趋势及热门榜单,为消费者打造一...
02-09
阿里巴巴港股成交额突破440亿港元,创历史天量,盘中股价涨超15%。消息面上,阿里巴巴昨日发布2025财年第三财季业绩公告。财报显示,阿里巴巴第三财季收入2801.54亿元,同比增长8%;经...
02-22
2月5日消息,中国人民银行最新数据显示,1月28日至2月3日的春节前7天,银联、网联两大支付清算平台共处理支付交易220.78亿笔,金额达8.52万亿元,较去年同期分别增长25.70%和17.08%。...
02-07
2月20日消息,美团日前宣布将为全职及稳定兼职骑手缴纳社保,预计2025年第二季度起实施。对此,美团核心本地商业CEO王莆中在公司内网发文称,“履行好社会责任,不必用竞争思维来思考...
02-20
在农村义务教育学生营养改善计划备受瞩目的背景下,来自中粮福临门学生营养餐专用食用植物调和油的好消息让市场看到了团膳定制油方向的广阔空间。数据显示,自2024年8月上市以...
01-22
2024国庆长假第一天,北京奥林匹克公园人头攒动,往来如织的人群中一道道“奇装异服”的身影吸引了游客注目,银发雪衣的雪女,斗笠披风的侠客,长尾兽耳的萌娘,子衿青青的儒生……原来...
01-23
近日,在接受西班牙媒体Gamereactor采访时,《怪物猎人:荒野》制作人辻本良三和总监德田优也被问及了游戏是否会登陆Switch 2的问题,虽然两人明显没有透露任何有关Sw...
02-13
根据 The Gamer 报道,热门手机游戏《精灵宝可梦TCGPocket》的一些卡牌已经出现在了交易平台 eBay 上,而通过游戏外进行卡牌交易或是售卖卡牌是违反游戏用户守则...
02-15
△以色列外交部长萨尔(资料图)以色列外交部长萨尔5日说,以色列将不参加联合国人权理事会。萨尔当天在社交媒体上说,以色列欢迎美国总统特朗普关于美国退出联合国人权理事会的决...
02-06
据西安头条2月5日消息,陕西省第十一届人大常委会副主任,陕西省政府原副省长,陕西省总工会原主席党组书记,著名作家白阿莹同志因病医治无效,于2025年2月5日9时56分在西安逝世,享年7...
02-06
返回

点击右上角微信好友

朋友圈

点击浏览器下方“”分享微信好友Safari浏览器请点击“”按钮

点击右上角QQ

点击浏览器下方“”分享QQ好友Safari浏览器请点击“”按钮