网易首页 > 网易号 > 正文 申请入驻

死神梁文锋

0
分享至

梁文锋大概没想到自己会火到今天这个地步。

最近各种有关他的AI图片非常出圈,大致长这样:



图源:抖音网友AI生成

图里的他,造型还是网上最流传的那样子,但做了些漫画化处理,整体画面充满张力。

你可能很难相信,现在在海外开发者眼中,梁文锋大概就是这个样子。

根据OpenRouter周榜最新数据,DeepSeek V4 Flash单周处理了7万多亿Token,排在第一。

而据OpenCode爆料,单8月1日这一天,DeepSeek-V4-Flash在平台上的Token处理量就高达到了8万亿,其中5万亿来自免费试用,3万亿为开发者付费使用。



图源:X

8万亿Token什么概念?按1个Token约等于1到1.5个汉字算,这相当于8万亿到12万亿个汉字,拿《红楼梦》作参照,全书约73万字,8万亿Token大概能装下1400多万部《红楼梦》。

这就是梁文锋。他左手幻方量化,右手DeepSeek,一边在A股收割,一边在全球AI市场收割。

有网友调侃:“你梁叔叔开着一台死亡收割机在后面追,跑得快没奖励,跑慢的有惩罚。”



图源:抖音



梁文锋不是第一次这么干了

其实,在去年DeepSeek R1上线的时候,就有人把梁文锋叫做AI圈的“死神”。

那时候国产大模型还在比谁参数多、谁发布会排场大、谁的创始人朋友圈转的多,但他悄没声把大模型推理玩法做到了一个所有人都看不懂的高度,并且还有着极低的价格。

后来阿里、百度、腾讯跟着降价,国内第一次大模型价格战就这么打起来了。

当时有人怀疑DeepSeek在赔钱抢市场,梁文锋接受《暗涌Waves》采访时却说,价格是按成本核算后加上一点利润,并不是靠补贴换用户。

换句话说,他不是临时拿低价做促销,而是真的认为大模型就应该卖这么便宜。那时候大家就看出来了,他做生意的思路和别人不一样。

他从一开始就没追求做什么“全行业最强模型”,只要能力做到自己认为的最好,就可以把价格压到对手没法舒服赚钱的位置。

V2是这样,V3、R1是这样,到这次V4 Flash,这套玩法已经很成熟了。

7月31日更新的V4 Flash 0731,DeepSeek官方数据显示,其在Agents’ Last Exam测试中拿到25.2分,距离Claude Opus 4.8只有0.5分;代码能力DeepSWE从旧版的7.3分涨到54.4分,已经接近Opus的58分。



图源:DeepSeek官方账号

但价格差了近90倍。DeepSeek每百万输出Token收0.28美元,Claude Opus 4.8要25美元。

如此巨大的差异,让全世界的开发者都忍不住算一笔账。如果一个活DeepSeek已经能干到90分了,我为什么要为剩下那10分,多花几十倍的钱?

研究公司Artificial Analysis估算了DeepSeek V4-Flash每项智能指数任务的成本。最终结果是,V4-Flash的平均测试成本为3美分

根据实测,Agent跑起来要不停读代码、调工具、翻日志,96%的输入Token都走缓存,看着token量大,实际成本极低。

Agent越能干,用的token越多,DeepSeek的价格优势就越明显。



图源:Artificial Analysis

OpenRouter平台访问流量中,美国、欧洲开发者占比接近半数,大量Agent自动化项目、代码辅助工具、长文本处理应用,主动将默认模型切换至DeepSeek。

可以说,梁文锋正在用性价比画出了一条全球AI的生死K线。跨不过去的,也许就会死。



左手幻方,右手DeepSeek

很多人是因为DeepSeek才知道的梁文锋,但其实他最早是做量化交易的。浙大电子系毕业,和同学一起创办了幻方量化,靠算法在市场里赚差价。

网上关于他流传最广的那张图片,就出自一次金融行业颁奖典礼。



图源:知乎

大模型火起来之前,幻方就自己建了万卡A100的算力集群。2023年,梁文锋把原来的AI研究团队独立出来,才有了DeepSeek。

对此,很多网友玩梗说他“左手量化右手AI,自己给自己供血”,其实没那么玄乎。

梁文锋自己公开说过,大模型和量化交易没有直接关系。不存在“模型越好,量化赚的越多”的飞轮。

幻方给DeepSeek的,是早期不用看投资人脸色的底气。

别的公司创业,先写PPT融资,拿了钱再做模型,每花一笔都要想着怎么给投资人回报,什么时候盈利,什么时候上市。梁文锋是先烧自己的钱,把模型做出来,路走通了,才接受外部投资。

2026年6月DeepSeek第一轮融了500亿,梁文锋自己掏了200亿,腾讯、宁德时代这些机构才跟着进。到现在他也是公司说了算,不用急着商业化,不用为了财报做漂亮数据。

有钱只是基础,真正把价格打下来的是技术效率。

V4 Flash总参数2840亿,每次推理只激活130亿,长上下文下的计算量和缓存占用比上一代低了很多。

别的公司是先堆算力堆出能力,再把成本转嫁给用户;DeepSeek从设计模型开始,就算着怎么少用算力、少占显存、把推理成本压到最低。

所以他能一直降价,不是做慈善,是成本真的能做到这么低。别的公司也能跟着降,但降完能不能赚钱、能不能活下去,就不好说了。



大模型游戏规则被改写

如果时间倒回到几年前,大模型之间的比赛,像是一场正常的马拉松。

OpenAI在前面跑,谷歌、Anthropic跟着,其他公司只要比身边的人快一点,就能融钱、涨估值、卖高价API。跑第一有奖金,跑中间有奖牌,跑最后也能混个参与奖。

但自从DeepSeek来了之后,规则直接变了。



图源:小红书网友AI制图

现在做代码、推理、Agent这些主流场景,默认及格线就是DeepSeek能力差不多跟上,价格也不能差太远。

你做得比它好,用户觉得是应该的,不会多掏钱;你做得没它好,还卖得比它贵,用户转头就换。

这就导致,最难受的不是头部巨头,而是夹在中间的通用大模型公司。能力追不上第一梯队,成本压不到DeepSeek这么低,也没有自己的入口、产品或者云业务能托底。

之前还能靠讲故事融资,现在投资人只要问一句“那我为什么不用DeepSeek”,故事瞬间就讲不下去了。

巨头也没法置身事外。

OpenAI在7月30日把GPT-5.6 Luna降价80%,时间比V4 Flash更新还早一天,不能说是被DeepSeek逼的,但整个行业的价格趋势已经明了:模型越更新,能力溢价越低,token价格只应该越来越便宜。



图源:X

更关键的是全球开发者心智的变化。据多家媒体爆料,如今有相当一部分的美国公司正在偷偷使用中国大模型,

数字遗产平台LilyList的创始人梅因霍尔德表示,“我们超过90%的人,并不需要Anthropic的大模型。”近200家美国科技初创企业敦促美国政府不要切断对中国开源模型的访问。

这种习惯一旦养成,再想抢回去就难了。

很多人说梁文锋是价格屠夫,其实他没杀谁,只是把行业里的水分挤干了。

之前大家总说大模型贵是因为研发成本高,现在才发现,很多成本只是没人愿意优化,没人愿意把利润让出来。

不过,梁文锋这一刀,砍的不只是有其他AI公司。他狠起来,是连自己都砍。

DeepSeek把价格压得越低,模型开的越开放,整个行业就越难靠卖API赚大钱。

哪怕以后DeepSeek做得再好,也很难把价格涨回去,拿不到之前GPT或CLaude那样的高溢价。

可以说,梁文锋不仅砍掉了同行依靠高价API赚钱的可能,也顺手砍低了DeepSeek自己的利润天花板。

但也许,这些他根本就不在乎,如今的梁文锋眼里好像只剩“AGI”。

等他的AGI真正落地那天,所有人都会记住梁文锋这个名字。

作者| 刘峰

特别声明:以上内容(如有图片或视频亦包括在内)为自媒体平台“网易号”用户上传并发布,本平台仅提供信息存储服务。

Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.

相关推荐
热点推荐
李湘母女新加坡逛商场被偶遇,形象大变!网友:终于不穿花裙子了

李湘母女新加坡逛商场被偶遇,形象大变!网友:终于不穿花裙子了

娱乐团长
2026-09-08 10:20:09
一年级的小朋友有多搞笑?网友:她甚至不知道坐班里是干什么的!

一年级的小朋友有多搞笑?网友:她甚至不知道坐班里是干什么的!

另子维爱读史
2026-09-10 10:21:21
嚣张跋扈尝到苦果了!一家三口被遣返,上海飞洛杉矶飞机上打人事件结局舒适,评论区炸锅

嚣张跋扈尝到苦果了!一家三口被遣返,上海飞洛杉矶飞机上打人事件结局舒适,评论区炸锅

火山詩话
2026-09-08 10:33:51
付磊女儿疑再爆料!去安徽找爸爸很多次,躲着不见,买衣服也不收

付磊女儿疑再爆料!去安徽找爸爸很多次,躲着不见,买衣服也不收

寒士之言本尊
2026-09-09 18:40:41
手机和宽带还绑在一起的家庭,建议认真看一下

手机和宽带还绑在一起的家庭,建议认真看一下

李博世财经
2026-09-09 10:14:24
越南废除了汉字、韩国废除了汉字、日本也搞去汉字化,结果呢?越南彻底改用拉丁国语字,扫盲是快了,可当代越南人彻底看不懂自家古籍典章

越南废除了汉字、韩国废除了汉字、日本也搞去汉字化,结果呢?越南彻底改用拉丁国语字,扫盲是快了,可当代越南人彻底看不懂自家古籍典章

扶苏聊历史
2026-09-09 17:53:34
张兰暴瘦的照片刷屏了,我想说点不一样的

张兰暴瘦的照片刷屏了,我想说点不一样的

东方不败然多多
2026-09-09 05:45:14
华为拿下玛莎拉蒂,全网破防了!

华为拿下玛莎拉蒂,全网破防了!

财经三分钟pro
2026-09-08 15:25:19
吃羽衣甘蓝等于啃绿化带,而且“全是农药”?真相来了

吃羽衣甘蓝等于啃绿化带,而且“全是农药”?真相来了

网络辟谣
2026-09-10 07:59:32
女人的第六感能准到什么程度?网友:我儿子小时候多少次要掉地上,都被睡梦中的我一把抓住

女人的第六感能准到什么程度?网友:我儿子小时候多少次要掉地上,都被睡梦中的我一把抓住

解读热点事件
2026-09-10 00:05:13
案例:湖北一女学生和82岁老人同吃同住,老人直接认其做干女儿

案例:湖北一女学生和82岁老人同吃同住,老人直接认其做干女儿

红豆讲堂
2025-01-27 09:30:03
星宇股份财报再现重大失误:外包费用2.44万亿,是年营收184倍;上交所下发监管工作函

星宇股份财报再现重大失误:外包费用2.44万亿,是年营收184倍;上交所下发监管工作函

金融界
2026-09-10 12:00:44
“他能上小学都算祖坟冒青烟!”一家五口颠覆认知:黄毛的爷爷,满背的奶奶

“他能上小学都算祖坟冒青烟!”一家五口颠覆认知:黄毛的爷爷,满背的奶奶

妍妍教育日记
2026-09-09 18:05:48
财神偏爱的3个生肖!好运不声不响,钱包却一年比一年鼓

财神偏爱的3个生肖!好运不声不响,钱包却一年比一年鼓

毅谈生肖
2026-09-10 11:44:12
风向突变!日媒称政府正全力说服中国,APEC峰会中国将硬核出席?

风向突变!日媒称政府正全力说服中国,APEC峰会中国将硬核出席?

阿纂看事
2026-09-09 14:22:37
星宇橙配色谢幕?苹果客服确认:iPhone 17 Pro全系下架,不再重新上架!

星宇橙配色谢幕?苹果客服确认:iPhone 17 Pro全系下架,不再重新上架!

泡泡网
2026-09-10 12:22:08
9月10日,人社部和财政部公布关于26年调整养老金的通知文件了吗?退休人员早知道

9月10日,人社部和财政部公布关于26年调整养老金的通知文件了吗?退休人员早知道

小谈食刻美食
2026-09-10 08:58:28
破镜重圆,井柏然《早春晴朗》24集大结局,是今年看过最拧巴的现偶剧结局

破镜重圆,井柏然《早春晴朗》24集大结局,是今年看过最拧巴的现偶剧结局

娱君坠星河
2026-09-09 17:22:56
欧洲炸锅!见德国右翼大胜,波兰总理直接开骂:谁高兴谁就是叛徒

欧洲炸锅!见德国右翼大胜,波兰总理直接开骂:谁高兴谁就是叛徒

李杻手工制作
2026-09-10 10:32:35
中国人集体戒酒背后:不是不喝了,是终于喝明白了

中国人集体戒酒背后:不是不喝了,是终于喝明白了

你在偷看谁
2026-09-09 20:41:16
2026-09-10 13:23:00
科技头版Pro incentive-icons
科技头版Pro
一起见证改变世界的力量
614文章数 183关注度
往期回顾 全部

科技要闻

一文看懂:iPhone折叠屏顶配2万6,10月才卖

头条要闻

iPhone Duo拿出了苹果的看家本领 打工人可能买不起了

头条要闻

iPhone Duo拿出了苹果的看家本领 打工人可能买不起了

体育要闻

一年丢掉的积分排名,郑钦文用18天找回来

娱乐要闻

郭德纲被处罚2天,身边人传出好消息

财经要闻

银行新高!新一轮周期,刚开始!

汽车要闻

腾势Z9GT易三方闪充尊越型32.98万元上市

态度原创

房产
艺术
健康
本地
数码

房产要闻

别不服!海南的亿万富豪,只有不到300个!

艺术要闻

教师节 | 中国著名油画家们的老师

中风康复为何像“抽丝剥茧”?

本地新闻

宁波,中国制造的隐藏大佬

数码要闻

3599元,Unihertz Titan 2 Elite全键盘5G智能手机国行发售

无障碍浏览 进入关怀版