2025年12月26日晚上十一点,梁文锋坐在杭州一间没有窗户的会议室里,面前的咖啡已经凉了第三杯。
他正在给一个开源社区写邮件。
隔壁房间的工程师们还在为 DeepSeek-V3 的最后一个 checkpoint 守夜。服务器风扇嗡嗡响。梁文锋敲下最后一行,按了发送。
第二天,OpenAI 的股价跌了 3%。
不是因为他发了什么论文。不是因为 DeepSeek 又拿了什么榜单第一。是因为他在邮件里写了一句:我们不融资,不开源收费,不做闭源。
硅谷的投资圈炸了。
那个问答环节,他一个人说了四十分钟
2026年3月,一场闭门交流会上,有人问梁文锋:DeepSeek 到底怎么赚钱?
他沉默了几秒。
然后开始讲他2016年在量化交易公司幻方的一个下午:那天他们的模型跑出了一个反直觉的信号,所有人都觉得是 bug。梁文锋坚持让模型跑了一天。收盘的时候,那个bug
赚了 3000 万。
他说完这个故事,没有回答那个问题。
全场安静。
后来有人说,梁文锋根本没打算解释商业模式。他想说的是另一件事:有些东西,比赚钱重要。
这话从一个掌管百亿量化基金的人嘴里说出来,很奇怪。
但梁文锋就是这么个人。
2023年他决定做 DeepSeek 的时候,跟他最久的一个合伙人问他:你做这个是为了什么?
他说:让最先进的 AI 不要变成少数人的特权。
合伙人说:那你做闭源啊,做大了再开源。
梁文锋说:那不是同一件事。
一个量化交易员的 OpenAI 执念
很少有人知道,梁文锋第一次接触深度学习是在 2014 年。
那年他 29 岁,幻方刚刚从一个小团队变成一家像样的量化公司。他买了几块 GPU,开始自己在交易数据上跑模型。
他的同事觉得他在浪费时间。量化交易拼的是因子挖掘和速度,GPU 跑深度学习太慢了。
梁文锋不管。
他自己写了一套框架,把交易信号建模成序列预测问题。2016 年之后,幻方的收益曲线开始变得不像任何一家同行——太稳了,几乎没有回撤。
圈内人说幻方有秘密武器
。其实那个武器就是梁文锋自己搭的那套神经网络。
2020 年,幻方管理规模突破千亿。梁文锋却越来越沉默。
有一次内部会议上,他问团队一个问题:如果有一天,AI 比我们更会做交易,我们还做什么?
没人回答。
两年后,他给了自己的答案。
557 万美元的耳光
2025年1月,DeepSeek-R1 发布。
训练成本:557 万美元。
比 GPT-4 便宜 95%。
硅谷的 AI 公司沉默了。不是因为技术多强——虽然确实很强——是因为这个数字像一个耳光,扇在每个融了十亿美金的 CEO 脸上。
你们花了十个亿,我们花了五百万,结果差不多。
梁文锋在技术报告里写得很平静:我们用了强化学习,没有人工标注。模型自己学会了推理。
没有人知道他这些东西是从哪儿学来的。
2016年那个跑出反直觉信号的下午,也许就是答案。
量化交易的本质是什么?是在混乱的价格序列里找到秩序。强化学习做推理,本质上是一样的。
梁文锋用了十年时间,在两个完全不同的领域里,证明了同一件事。
不是中国的 OpenAI,是世界的 DeepSeek
2026年春天的某个周一,一封内部邮件被泄露到了 X 上。
邮件的标题只有三个字:不开源。
不是不开源了
,是我们不对外开源了
。发件人是某个 AI 公司的 CTO。
那封邮件像病毒一样传播。每一个转发都在问同一个问题:下一个关门的会是谁?
有人把截图发给了梁文锋。
他回了三个字:不会的。
DeepSeek 的 GitHub 仓库至今没有关。Star 数突破了 12 万。中国开发者贡献了 40% 的代码,美国 22%,欧洲 18%。
梁文锋在一次采访里说了一句话:如果开源是一种商业策略,那它迟早会变。如果它是一种信念,那就不会。
问他的人愣了一下,然后问:你的信念是什么?
他说:技术不应该有国界。
他不是在说漂亮话。
2022年 ChatGPT 刚出来的时候,中国 AI 圈的主流叙事是追赶
。每一个产品发布会上,PPT 的第一页一定是中国版 OpenAI
。
梁文锋从来没说过这句话。
有人问他为什么不这么说。
他说:我为什么要做中国的 OpenAI?我做的是 DeepSeek。
浙江大学的那个晚上
2026年4月,梁文锋回了一趟浙江大学。
他是浙大电子信息工程 2006 届的毕业生。那次回去,他给本科生做了一个演讲。
讲到最后,有学生举手问:梁老师,现在做 AI 创业还来得及吗?
他说:我在 2014 年开始研究深度学习的时候,很多人告诉我,量化交易用不着这个。2023 年我决定做 DeepSeek 的时候,很多人告诉我,中国做基础大模型没有机会。
他停了一下。
所以我不知道来不来得及。我只知道,你不做,就真的来不及了。
那天晚上,他一个人在浙大玉泉校区的操场走了很久。
操场旁边的篮球场上,有人在打球。路灯把他的影子拉得很长。
二十年前,他也是这里的学生。那时候他还没有 GPU,没有千亿参数,没有 557 万美元。
但他已经有了一个问题:这个世界,能不能变得不一样?
最后的问题
2026年6月,DeepSeek 开源了一周年。
有人在 GitHub 上统计了一下,基于 DeepSeek 训练出来的微调模型超过 8000 个。覆盖的语言从印地语到斯瓦希里语,从医疗到农业。
印度有一个小团队用 DeepSeek 做了一个农村医疗问诊助手,下载量超过 200 万。
非洲的一个大学实验室用 DeepSeek 训练了一个作物病虫害检测模型,覆盖了当地五种主要粮食作物。
梁文锋看到了这些数据。
他什么都没说。只是把其中几个项目的 README 转发到了工作群里。
然后继续写他的代码。
那个2025年12月26日的深夜,他发完邮件关上电脑的时候,杭州的夜空有薄薄的雾。
咖啡杯里最后一滴也干了。
他没有回头看一眼窗外。
因为他知道,下一封邮件,还得写。