🐙 章鱼写作助手
仪表盘
文章
热点
问一问
系统
Sidekiq
sai.show
← 返回
编辑文章
标题
摘要
2025年12月26日深夜,梁文锋发了一封邮件:我们不融资、不开源收费、不做闭源。第二天,OpenAI股价跌了3%。从量化交易员到全球AI开源旗手,他用了十年时间在两个完全不同的领域证明同一件事。
封面图片 URL
正文
2025年12月26日晚上十一点,梁文锋坐在杭州一间没有窗户的会议室里,面前的咖啡已经凉了第三杯。 他正在给一个开源社区写邮件。 隔壁房间的工程师们还在为 DeepSeek-V3 的最后一个 checkpoint 守夜。服务器风扇嗡嗡响。梁文锋敲下最后一行,按了发送。 第二天,OpenAI 的股价跌了 3%。 不是因为他发了什么论文。不是因为 DeepSeek 又拿了什么榜单第一。是因为他在邮件里写了一句:我们不融资,不开源收费,不做闭源。 硅谷的投资圈炸了。 ## 那个问答环节,他一个人说了四十分钟 2026年3月,一场闭门交流会上,有人问梁文锋:DeepSeek 到底怎么赚钱? 他沉默了几秒。 然后开始讲他2016年在量化交易公司幻方的一个下午:那天他们的模型跑出了一个反直觉的信号,所有人都觉得是 bug。梁文锋坚持让模型跑了一天。收盘的时候,那个"bug"赚了 3000 万。 他说完这个故事,没有回答那个问题。 全场安静。 后来有人说,梁文锋根本没打算解释商业模式。他想说的是另一件事:有些东西,比赚钱重要。 这话从一个掌管百亿量化基金的人嘴里说出来,很奇怪。 但梁文锋就是这么个人。 2023年他决定做 DeepSeek 的时候,跟他最久的一个合伙人问他:你做这个是为了什么? 他说:让最先进的 AI 不要变成少数人的特权。 合伙人说:那你做闭源啊,做大了再开源。 梁文锋说:那不是同一件事。 ## 一个量化交易员的 OpenAI 执念 很少有人知道,梁文锋第一次接触深度学习是在 2014 年。 那年他 29 岁,幻方刚刚从一个小团队变成一家像样的量化公司。他买了几块 GPU,开始自己在交易数据上跑模型。 他的同事觉得他在浪费时间。量化交易拼的是因子挖掘和速度,GPU 跑深度学习太慢了。 梁文锋不管。 他自己写了一套框架,把交易信号建模成序列预测问题。2016 年之后,幻方的收益曲线开始变得不像任何一家同行——太稳了,几乎没有回撤。 圈内人说幻方有"秘密武器"。其实那个武器就是梁文锋自己搭的那套神经网络。 2020 年,幻方管理规模突破千亿。梁文锋却越来越沉默。 有一次内部会议上,他问团队一个问题:如果有一天,AI 比我们更会做交易,我们还做什么? 没人回答。 两年后,他给了自己的答案。 ## 557 万美元的耳光 2025年1月,DeepSeek-R1 发布。 训练成本:557 万美元。 比 GPT-4 便宜 95%。 硅谷的 AI 公司沉默了。不是因为技术多强——虽然确实很强——是因为这个数字像一个耳光,扇在每个融了十亿美金的 CEO 脸上。 你们花了十个亿,我们花了五百万,结果差不多。 梁文锋在技术报告里写得很平静:我们用了强化学习,没有人工标注。模型自己学会了推理。 没有人知道他这些东西是从哪儿学来的。 2016年那个跑出反直觉信号的下午,也许就是答案。 量化交易的本质是什么?是在混乱的价格序列里找到秩序。强化学习做推理,本质上是一样的。 梁文锋用了十年时间,在两个完全不同的领域里,证明了同一件事。 ## 不是中国的 OpenAI,是世界的 DeepSeek 2026年春天的某个周一,一封内部邮件被泄露到了 X 上。 邮件的标题只有三个字:不开源。 不是"不开源了",是"我们不对外开源了"。发件人是某个 AI 公司的 CTO。 那封邮件像病毒一样传播。每一个转发都在问同一个问题:下一个关门的会是谁? 有人把截图发给了梁文锋。 他回了三个字:不会的。 DeepSeek 的 GitHub 仓库至今没有关。Star 数突破了 12 万。中国开发者贡献了 40% 的代码,美国 22%,欧洲 18%。 梁文锋在一次采访里说了一句话:如果开源是一种商业策略,那它迟早会变。如果它是一种信念,那就不会。 问他的人愣了一下,然后问:你的信念是什么? 他说:技术不应该有国界。 他不是在说漂亮话。 2022年 ChatGPT 刚出来的时候,中国 AI 圈的主流叙事是"追赶"。每一个产品发布会上,PPT 的第一页一定是"中国版 OpenAI"。 梁文锋从来没说过这句话。 有人问他为什么不这么说。 他说:我为什么要做中国的 OpenAI?我做的是 DeepSeek。 ## 浙江大学的那个晚上 2026年4月,梁文锋回了一趟浙江大学。 他是浙大电子信息工程 2006 届的毕业生。那次回去,他给本科生做了一个演讲。 讲到最后,有学生举手问:梁老师,现在做 AI 创业还来得及吗? 他说:我在 2014 年开始研究深度学习的时候,很多人告诉我,量化交易用不着这个。2023 年我决定做 DeepSeek 的时候,很多人告诉我,中国做基础大模型没有机会。 他停了一下。 "所以我不知道来不来得及。我只知道,你不做,就真的来不及了。" 那天晚上,他一个人在浙大玉泉校区的操场走了很久。 操场旁边的篮球场上,有人在打球。路灯把他的影子拉得很长。 二十年前,他也是这里的学生。那时候他还没有 GPU,没有千亿参数,没有 557 万美元。 但他已经有了一个问题:这个世界,能不能变得不一样? ## 最后的问题 2026年6月,DeepSeek 开源了一周年。 有人在 GitHub 上统计了一下,基于 DeepSeek 训练出来的微调模型超过 8000 个。覆盖的语言从印地语到斯瓦希里语,从医疗到农业。 印度有一个小团队用 DeepSeek 做了一个农村医疗问诊助手,下载量超过 200 万。 非洲的一个大学实验室用 DeepSeek 训练了一个作物病虫害检测模型,覆盖了当地五种主要粮食作物。 梁文锋看到了这些数据。 他什么都没说。只是把其中几个项目的 README 转发到了工作群里。 然后继续写他的代码。 那个2025年12月26日的深夜,他发完邮件关上电脑的时候,杭州的夜空有薄薄的雾。 咖啡杯里最后一滴也干了。 他没有回头看一眼窗外。 因为他知道,下一封邮件,还得写。
状态
生成中
草稿
已完成
已发布
发布平台
来源 URL
取消