网易首页 > 网易号 > 正文 申请入驻

李善友:DeepSeek的每一次取舍,都在增加AGI实现的概率

0
分享至


过去一个月,DeepSeek 有三个大动作。

7月31日,V4 Flash 正式版上线,把更强的模型能力带到更低的成本区间;8月 13日,V4 Pro 正式版上线,Agent 能力继续提升;8月21日,V4 Flash 视觉实验模型发布,十天后进一步开源。

模型更强、更便宜,也开始能看懂图片。大模型行业由此多了一条“DeepSeek 斩杀线”:一个模型的性能不如DeepSeek,价格还比它高,就很难解释自己的价值。

在巨大的成功面前,DeepSeek选择“克制”。2025年春节,上亿用户涌来时,不做C端产品;AI Coding和Agent兴起后,不做B端应用。它始终把资源投向基础模型,坚持开源和原创研究,不向应用层扩张。

“克制”来自梁文锋对AGI愿景的笃定。在DeepSeek,愿景已经融入现实,成为产品、研究、创新和组织的判断标准。梁文锋说,唯一重要的事情,是增加我们做成AGI的概率。赚多少钱、用什么方式赚钱,并不重要。

2026年8月16日,在混沌创新院第二模块的课堂上,李善友教授第一次讲授 DeepSeek案例。


以下为课程精华,内容经编辑整理:



爆火之后,为什么不抢用户

2025 年春节,DeepSeek 突然迎来上亿用户。假如你是梁文锋,会不会抓住这波流量?

按照互联网公司的做法,下一步应该是产品化、运营用户、做广告、做商业闭环,甚至打造一个超级 App,成为下一个字节跳动。这是上帝硬塞到手里的机会。换成谁,都未必稳得住。

DeepSeek 没有接。其他公司使用它的开源模型承接流量、发展产品,它也没有因此改变方向。别人拿到用户、赚到钱,它并不嫉妒。它要做的仍然是基础模型。

一年后,AI Coding 和 Agent 兴起,B 端又出现了一个巨大机会。DeepSeek 完全可以进入金融、法律、医疗、教育等垂直行业,沿着模型能力向应用层延伸,成为中国的 Anthropic。它还是没有接。

梁文锋的判断是,无论 C 端用户还是 B 端应用,今天看到的都只是“芝麻”,更大的“西瓜”还在后面。别人看到的是订阅、Agent 和软件,他看到的是 AGI。


C 端订阅和 B 端 Agent 已经形成市场,AGI 对应的市场仍然未知

我们今天并不知道 AGI 的价值网络最终会长成什么样。正因为不知道,梁文锋把它称为 Open。这里的 Open 同时指向两件事:技术开源,以及一个尚未被定义的市场。

但不知道,不等于没有判断。梁文锋相信,这个市场逻辑上成立,而且必然会发生。如果今天过早围绕已有应用建立产品、用户和组织,公司的技术和人才就会被眼前的产品吸走。

DeepSeek 目前的商业收入主要来自 API。按照梁文锋的介绍,API 业务没有专门的销售团队,甚至没有专门的客服,客户会自己找来。技术往前走,在应用层自然产生收入,收入再支持研究投入。

为什么梁文锋对眼前的产品机会如此警惕?理解 DeepSeek,要先讲 OpenAI。

OpenAI 创办之初,希望 AGI 服务全人类,也反对 AI 能力被少数大公司垄断。它很早就明确,大语言模型是走向 AGI 的第一步。但 ChatGPT 发布以后,公司越来越多地按照消费互联网的方式运行:需要融资,需要商业化,从开源走向闭源,从非营利走向营利,开始发展 C 端收费和 B 端应用。

一个原本想改变世界的组织,获得第一笔巨大成功后,也可能被成功限制。它捡到一粒芝麻,便以为那是整个世界。

DeepSeek 已经迎来自己的巨大成功。它真正需要防备的,未必是错过某个商业机会,而是让眼前的成功重新定义公司的方向。

所以,DeepSeek 并不是拒绝赚钱,它只是没有让用户、流量和收入重新定义自己。



智能本身即产品,只押一条研究主线

一般的互联网公司极其重视产品。先把产品做好,再获得用户和流量,最后形成商业化,这是移动互联网最熟悉的增长路径。

DeepSeek 的选择不太一样。如果一定要说它的产品是什么,基础模型本身就是产品。说得更简洁一点,智能本身就是产品。

它像一座发电厂,生产的不是某个 App、Agent 或 AI 助理,而是智能。用户通过 API 拿走 token,再把这些智能用到自己的产品和场景里。

对 DeepSeek 来说,token 最重要的特征是便宜。低价不能靠降低品质或贴钱补贴,只能靠工程创新把真实成本降下来。


基础模型生产智能,工程创新持续降低 token 成本

DeepSeek面对的问题非常具体:能不能拿 2000 张显卡,干出别人 20000 张卡的活?一行代码,能不能再省一点电费?

按照梁文锋的说法,DeepSeek的 API 定价大约是成本的 6 倍,希望设备投入能在 10 个月左右收回。无论具体定价怎样变化,背后的逻辑都很清楚:把成本变成产品的核心单点。

这逼着团队重新检查模型训练的每个环节。从数据精度、显存占用到训练流水线,从注意力机制到专家模型的激活方式,每一处都要寻找更高效的解法。很多技术问题在算力充足时可以被资源覆盖,算力有限时,团队只能真正把算法和工程研究透。

外部限制由此变成了一种内部能力。梁文锋与马斯克有一个共同点:他们都在“成本”这个看起来不性感的地方,建立起了真实的技术优势。

后来市场上出现了“DeepSeek 斩杀线”的说法:如果一个模型的性能不如 DeepSeek,价格却更高,它就需要重新解释自己的存在价值。

成本也与 DeepSeek 的愿景直接相关。如果 AGI 最终要服务全人类,智能就必须足够便宜。普惠不是一句价值观口号,它最终会变成每个 token 的价格。


智能本身就是产品,研究方向便直接决定产品的未来。大模型行业每天都有新热点。3D、视频、多模态、世界模型、具身智能,每一个方向都可能长出巨大的市场。

DeepSeek 判断一项技术要不要做,标准依然是:它是否位于通向 AGI 的智能主线上。

梁文锋讲过一条研究路线。第一代是语言大模型,对应 ChatBot;第二代是推理大模型,在它之上可以发展 Coding 和 Agent;下一代大模型的关键,可能是持续学习。


语言、推理、Agent、持续学习、自我迭代与具身智能构成一条连续的研究路线

今天的大模型训练完成后,参数基本就固定了。用户拿它去工作,它可以完成任务,却不会因为解决了一个新问题而自动成长。

人类不是这样。一个人离开学校、进入社会,每解决一个问题,能力都会继续提高。所谓持续学习,就是让 AI 在工作中继续调整自己:边干活,边学习,再带着新的能力继续干活。

今天,持续学习已经成为全球前沿 AI 研究的重要问题之一,DeepSeek 也在研究这个问题。

如果持续学习出现,AI 就可能进入自我迭代。它可以用 AI 研究 AI,开发自己的下一个版本,形成“AI 乘 AI”的非线性加速,新的智能能力会涌现出来。

DeepSeek 只做与 AGI 智能主线相关的事。3D、视频、多模态和世界模型都可能很重要,但如果不在它认定的主线上,就不投入。Coding Agent 在这条主线上,因为它建立在推理模型之上,也可能连接下一代学习方式。

愿景成为团队每天筛选技术方向的标准。行业里可以做的事情越来越多,DeepSeek 反而把自己的任务范围收得更窄。


没有层层管理,人才和创新涌现

梁文锋说,他唯一的核心利益是团队。只要核心团队稳定,早一年或晚一年,DeepSeek 都能实现 AGI。

AI 时代,人才的分量会越来越高。找到聪明人只是第一步,还要让聪明人之间产生集体智慧。

梁文锋说:“他们其实没有组织,是愿景把大家组织起来。”每个人对愿景的表达未必完全一样,但方向和频率接近。

两年前,有人问 DeepSeek,全球最顶尖的 AI 人才似乎都在海外,为什么不去海外挖人?

梁文锋选择在本土培养团队,而且团队里有大量年轻人,包括博士生、应届毕业生和毕业不久的研究者。

选择年轻人,不只看能力、技术和经验,更看好奇心、热情和自信。年龄越大,拥有的东西越多,越容易被过去的经验和习惯约束。年轻人拥有得少,反而敢相信自己可以做前沿创新。

ChatGPT 出现时,国内从投资人到大公司都觉得差距太大,还是做应用更现实。创新首先是一个信念问题。原创需要自信,这种自信在年轻人身上更明显。

AI 也放大了聪明人与普通人的差异。以前,聪明人与普通人的效率可能只差 5% 或 10%;今天,差距可能达到十倍。如果传统公司不尊重这类人才,仍然用层层管理和承接任务的方式组织他们,就很难产生前沿创新。


很多大公司的组织结构已经不适合这一轮 AI 创新。旧经验会成为束缚,新范式需要新组织。

DeepSeek 的做法是尽量减少干预。没有严格预设角色,分工自然形成。每个人带着自己的想法工作,遇到问题时会主动拉人讨论。计算资源也尽可能开放,只要有想法,就可以调用训练集群验证。

它把工作分成工程和研究两类。工程有明确目标,需要自上而下组织,比如在某个时间发布一款新模型;研究则更多来自个人兴趣,自下而上发生,很难提前预设结果。


工程任务自上而下推进,研究探索自下而上发生

梁文锋希望核心团队花在“正事”上的时间不要超过 50%。所谓“正事”,就是有时间表、有明确目标的工程任务。剩下的时间,研究者可以自己决定研究什么。

研究也不能依靠加班推动。一个人在相对松弛的状态下灵光一现,这件事无法提前写进 KPI 或 OKR。

办公室里有一些会议室,两侧的门可以随时打开。一个路过的研究员无意中听到讨论,也许会补上一个关键想法。这样的空间安排,增加了偶然相遇和思想碰撞的机会。

互联网思维的关键词是连接,生成式 AI 的关键词是涌现。AI 的能力来自涌现,AI 时代的组织也应该用涌现的方式运作。

DeepSeek 的 MLA 架构就不是自上而下规划出来的。一位年轻研究者在总结主流注意力架构的演化时,突然产生了一个新想法。团队随后组建小组,用几个月把它验证出来。

另一位年轻博士加入 DeepSeek 时没有强化学习经验。在研究 DeepSeekMath 的过程中,他独立推导出一个公式,试图统一不同的训练方法。他把那个时刻形容为“顿悟”。

基础研究需要这样的偶然,也需要天才之间的碰撞。管理的任务,是为好奇心、试错和人与人之间的连接留下空间。



从模仿到原创,开源之后仍要做0到1

如果 DeepSeek 要实现 AGI,它真正的用户是谁?答案是全人类。

如果要为全人类提供 AGI,最根本的需求是什么?普惠。说人话,就是极致性价比。只有足够便宜,全世界的人才用得起。

要为全人类提供普惠的 AGI 服务,DeepSeek 选择了开源。

没有任何一家公司能够独自完成面向全人类的全部产品和服务。DeepSeek 做自己最核心的基础模型,其他人可以拿它去做产品、做应用、进入不同场景。自己只赚其中一部分钱,也让生态伙伴赚到钱。参与者多了,整个市场反而可能变得更大。

在 AI 时代,闭源也未必能形成持久的技术优势。OpenAI 选择闭源,其他公司仍然可以追上。真正的护城河可能是团队持续成长,是技术经验和创新文化。开源也是一种文化,开放模型和论文,会让外部开发者参与进来,也会吸引更优秀的人才。研究成果被同行使用和追随,对研究者本身也是一种成就。

开源让更多人参与同一个价值网络,接下来是一个更关键的选择:DeepSeek 开源之后,是做 0 到 1 的原创创新,还是做 1 到 10 的跟随创新?

梁文锋在 2023 年和 2024 年的访谈里反复谈到,中美之间真正的差距,是原创与模仿的差距。

过去三十年的 IT 浪潮里,中国公司习惯了别人做技术创新,我们把技术拿过来,在应用层完成商业化。久而久之,两代互联网创业者在潜意识里接受了一个分工:美国人做 0 到 1 的原创,中国人做 1 到 10 的应用。

梁文锋把它视为一道“思想钢印”。

一般理解中,开源模型往往落后于闭源模型,先跟随,再缩小差距。DeepSeek 却选择在开源的同时做原创创新。

梁文锋说,当下最重要的是参与全球科技创新。中国企业长期利用海外技术,在应用层做商业化,这条路不可持续。这一次,目标不是快速盈利,而是参与技术前沿,推动整个生态的发展。中国应该从技术的受益者变成贡献者。

梁文锋和 DeepSeek 对中国创业的意义,就在于他们打破了一道“思想钢印”:中国人也可以做原创,也可以进入底层研究和技术前沿。一个创新者打破纪录以后,其他人才会真正相信,这件事可以做到。


回顾过去几个技术时代,个人电脑时代最有力量的组合是 Windows 加 Intel,一个是操作系统,一个是芯片;移动互联网时代是 Android 加 ARM、高通;进入 AI 时代,主导组合变成 OpenAI 加英伟达,一个代表大模型,一个代表芯片和算力。三个时代的底层架构都主要掌握在美国企业手里。全世界对此已经习以为常。

今天出现了一种可能性:DeepSeek 的基础模型与中国自己的 AI 芯片相互适配,形成 AI 时代新的软硬件组合。这里不必限定是哪两家公司,关键是中国的大模型与中国硬件能不能匹配起来。

如果匹配完成,它的意义就不只属于一家企业。美国限制先进 GPU 向中国出口,反而可能倒逼中国模型与国产硬件更快结合。

把中国当下的条件放在一起看,我们有完整供应链,有新能源与电力能力,有开源大模型,也有走向全球市场的企业。新能源汽车已经在走向全球,AI 创业从出生第一天起也可能是全球化的。把供应链、开源模型和全球化合在一起,会形成一个过去没有出现过的机会。

工业革命以来第一次,中国有可能成为世界的基座之一。

2025 年 1 月,DeepSeek 的爆火只是一个起点。这件事还远没有完成。未来三到五年,如果软件与硬件真正结合,如果持续学习取得突破,它可能成为撬动整个结构的支点。

愿景与商业化结合,决定哪些钱可以赚;愿景与研究主线结合,决定哪些技术要做;愿景与创新结合,决定做原创还是跟随;愿景与组织结合,决定怎样让人才与创新涌现。



张一鸣与梁文锋,两代创业者的选择

最后,我们把张一鸣和梁文锋放在一起看。一个是移动互联网原生创业者,一个是 AI 原生创业者。

PC 互联网进入移动互联网,是一次认知升级。经验属于一阶认知,理性和模型属于二阶认知。张一鸣拥有远超他人的二阶认知,靠算法、产品、用户、流量和商业化,建立了移动互联网时代的完整系统。

但理性是一种工具。当它只服务于自己的商业和产品时,推荐算法也可能持续激发人性下限的贪嗔痴。

有没有可能创造一种新的商业,既能赚钱,又能让人变得更好?我相信 AI 时代会出现新一代创业者,这是混沌的理论、信仰和下注。

如果基于经验创业,更多是 10 到 100 的复制;移动互联网的理性认知,可以产生 1 到 10 的应用创新;AI 时代如果再加入心性和理念,可能出现 0 到 1 的原创创新。

认知决定下限,理念决定上限。今天如果还只靠经验、习惯和关系创业,就很难进入竞争,创业者必须有高认知。但认知也有边界,理念决定上限。站在理念里,你能看见更大的世界,不会轻易被价格、流量和眼前收入困住。

如果一个人用理念做事,他会形成愿力,像创造者一样创造更美好的世界。做商业的过程中,他的心灵可以越来越干净。如果只依赖欲望赚钱,可能积累的是另一种力量。

这也让我重新理解“创业”两个字。创业者忙了一生,最终创造的究竟是什么?不能只看赚了多少钱,也要看这件事让自己和他人变成了什么样的人。

我知道这样的表达可能有些难,也可能有人不认同。但这是我相信的东西。

张一鸣代表移动原生,关键词是认知和“大力出奇迹”;梁文锋代表 AI 原生,关键词是愿景和克制。他们走的是两条不同的路。我们不必简单判断谁对谁错。两个方向在 AI 时代同时出现,是一件很幸运的事。


最后,送给大家三句话。

第一,永远相信自己。你把手头的工作向前推进 0.01 毫米,也是把人类边界向前推进 0.01 毫米。大愿不一定是遥远的口号,把眼前这件事向前推进,就是大愿与现实的结合。

第二,永远相信中国。我相信第三次人类文明可能在我们有生之年到来。它或许不再只是建立在逻辑之上,而是一种新的文明形态,东方智慧可能在其中发挥很大作用。我们这一生如果有机会处在人类文明跃迁的时刻,是一件很了不起的事。

AI 像上帝在敲门。人类如果不能完成新的跃迁,AI 也可能反过来吞噬人类。它既带来机会,也逼迫我们向上走。

最后一句,也是我最想送给每一位同学的话:人生真正重要的追问是“我是谁”。

我们创业,是通过探索世界有多大,来追问自己是谁。永远不要忘记这个问题,也不要看低自己。我们可以成为更好的自己,成为更好的那个版本。在看见更大世界的同时,也看见更好的自己。

无论世界怎样变化,希望大家在奋斗的场域里保有精神能量。愿我们一起把这些美好的东西留住。


以“重新认识 AI”与“重新认识商业”为两条交织的主线,确认企业真问题与杠杆点,从工具、场景、组织范式,帮你启动进化双螺旋。

欢迎加入中国创新者浓度最高的学习场,对话各行业领军人物、参与更多优质企业参访活动、系统学习底层商业认知方法论。


特别声明:以上内容(如有图片或视频亦包括在内)为自媒体平台“网易号”用户上传并发布,本平台仅提供信息存储服务。

Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.

相关推荐
热点推荐
妈妈是著名演员,老公是歌手,生了一双报恩儿女,她真是人生赢家

妈妈是著名演员,老公是歌手,生了一双报恩儿女,她真是人生赢家

青杉依旧啊啊
2026-09-08 23:48:56
百万吃播网红去世,才24岁,知情人曝原因,大油大盐只是冰山一角

百万吃播网红去世,才24岁,知情人曝原因,大油大盐只是冰山一角

喜欢历史的阿繁
2026-09-08 06:51:40
青岛保时捷女销冠称目前排名全球第一,“但大家差距很小”;曾两年卖340台保时捷

青岛保时捷女销冠称目前排名全球第一,“但大家差距很小”;曾两年卖340台保时捷

极目新闻
2026-09-08 09:45:37
陈光琳:安徽省纪委原书记、合肥原市委书记

陈光琳:安徽省纪委原书记、合肥原市委书记

爱下厨的阿酾
2026-09-08 18:03:35
这两样东西放冰箱,等于定时炸弹,一家人住院,都是它惹的祸

这两样东西放冰箱,等于定时炸弹,一家人住院,都是它惹的祸

小柱解说游戏
2026-09-07 01:48:45
委内瑞拉有20万华人,但最令人惊讶的是:这20万人里,竟有九成左右都来自同一个县城

委内瑞拉有20万华人,但最令人惊讶的是:这20万人里,竟有九成左右都来自同一个县城

背包旅行
2026-08-06 10:09:09
16GB+2TB!华为发布会汇总:9月7日,新品正式首发!

16GB+2TB!华为发布会汇总:9月7日,新品正式首发!

科技堡垒
2026-09-07 11:35:30
卧槽,iPhone Ultra 系统界面曝光?

卧槽,iPhone Ultra 系统界面曝光?

果粉俱乐部
2026-09-08 14:05:52
申军良给“梅姨”写了封信:拐了这么多孩子,能睡得着吗?“梅姨”落网细节曝光:出租屋内被抓,生活拮据靠捡废品为生

申军良给“梅姨”写了封信:拐了这么多孩子,能睡得着吗?“梅姨”落网细节曝光:出租屋内被抓,生活拮据靠捡废品为生

封面新闻
2026-09-08 18:09:04
奥委会这下尴尬了:2036年奥运会,中国上海、成都、广州都没申办

奥委会这下尴尬了:2036年奥运会,中国上海、成都、广州都没申办

轻扬墨雨
2026-08-14 13:21:23
郭德纲风波迎来大结局,重罚50多万仅开胃菜,于谦态度很明显了

郭德纲风波迎来大结局,重罚50多万仅开胃菜,于谦态度很明显了

小椰的奶奶
2026-09-08 15:28:01
可悲,已经独立百年的外蒙古,或许正在把中国人40年的努力毁掉

可悲,已经独立百年的外蒙古,或许正在把中国人40年的努力毁掉

抽象派大师
2026-09-03 02:36:31
决不放过,空军少将刚出家门就被乱枪打成筛子,4名警卫又怎样?

决不放过,空军少将刚出家门就被乱枪打成筛子,4名警卫又怎样?

聚峰军评
2026-09-05 10:40:37
你见过又穷又浪费的家庭没?还真就是穷人浪费装富,富人节约装穷

你见过又穷又浪费的家庭没?还真就是穷人浪费装富,富人节约装穷

小鹿姐姐情感说
2026-09-06 12:40:50
2026款五羊 S150上市 售价0.598万元起

2026款五羊 S150上市 售价0.598万元起

车质网
2026-09-07 13:50:08
美元兑日元跌破153关口

美元兑日元跌破153关口

界面新闻
2026-09-08 10:33:25
WTT澳门冠军赛:大爆冷!日本男单全国冠军2:3被淘汰,遭遇一轮游

WTT澳门冠军赛:大爆冷!日本男单全国冠军2:3被淘汰,遭遇一轮游

国乒二三事
2026-09-08 15:01:31
中国比从前更需要鲁迅

中国比从前更需要鲁迅

报人刘亚东
2026-09-06 17:24:36
45岁男子与女友合租一年吃30次他达拉非,一年后房颤,医生:无知

45岁男子与女友合租一年吃30次他达拉非,一年后房颤,医生:无知

垚垚分享健康
2026-09-04 11:20:15
奥迪新车官宣:9月9日即将上市,29万元左右

奥迪新车官宣:9月9日即将上市,29万元左右

手机讲坛
2026-09-09 01:03:26
2026-09-09 05:19:00
混沌学园官方 incentive-icons
混沌学园官方
混沌新鲜事的集散地
2332文章数 5622关注度
往期回顾 全部

科技要闻

小米再次背水一战

头条要闻

律师:摸臀事件女子拉伤男童系人身伤害 男童父母可索赔

头条要闻

律师:摸臀事件女子拉伤男童系人身伤害 男童父母可索赔

体育要闻

韩旭:我一定会再次走出去

娱乐要闻

郭德纲被处罚,郭麒麟被曝恋情瓜

财经要闻

智谱六连跌失守1000大关,发生了什么?

汽车要闻

领克20 领克的纯电小钢炮这次更运动了

态度原创

健康
手机
亲子
公开课
军事航空

同样是脑梗,为何康复结局大不同?

手机要闻

华为Mate XT 2被拆:麒麟9050 Pro的丝印和架构细节,被逐一确认!

亲子要闻

看两个女孩长大了,好可爱好萌呀,会吃会喝性格独立不要妈妈操心

公开课

李玫瑾:为什么性格比能力更重要?

军事要闻

胡塞武装用自行生产的导弹袭击沙特军车

无障碍浏览 进入关怀版