为什么是梁文锋做出了DeepSeek?

2025-07-11 10:41:13 - 风闻趣

这是梁文2025年开年最火的科技明星,短短几天时间,梁文梁文锋从小到大的梁文家庭后台泄露全过程种种过往都被展现在世人眼前,包括他来不及装修的梁文新房以及在房子里睡觉用的帐篷,都成为了他独特个性的梁文象征。

独特个性固然为人津津乐道,梁文但并不是梁文成功的关键,这个籍籍无名的梁文大学生,在过去的梁文十几年中所能倚靠的,只有他的梁文思想和能力。

所有人都好奇这样一个问题,梁文为什么是梁文梁文锋做出了DeepSeek?这其中固然有时代的因素,以及他本人迥异于其他大模型研究者的梁文个人经历。但AI科技评论认为,梁文理解梁文锋是梁文个什么样的人,才是理解这个问题的关键。

找人才不需要标签

猎头都觉得,帮梁文锋的公司找人太不容易了。

一位从21年开始就与幻方深度合作的猎头告诉雷峰网(公众号:雷峰网),招人招得让他“想哭”,因为难度太高了。

“清华本博,家庭后台泄露全过程六篇顶会,你觉得肯定没问题了吧,哎,怎么简历直接挂了;一个清华本科的MIT博士,第二轮面试就被淘汰了。”

如果要在大厂内部找候选人,他认为,幻方和DeepSeek基本上不会对标国内公司,他们只会对标Google和Meta这样的海外大厂。

另外一位猎头一谈到DeepSeek也是忍不住头大,“太挑剔了,推过一个在字节绩效非常好的年轻中层,聊了之后没过。我就很奇怪,去问他们,给我的回答是,这个人对AI没有热情。人家都是做过一些AI Agent相关的项目了,一般是不太会说这样的评价的。”

梁文锋对人才没有标签,不论学历背景,不论过往业绩,他只看这个人的个人能力和个人素质。

极高的人才门槛,造就了如今的DeepSeek。在国内的大模型团队中,DeepSeek的人才厚度可能不足以跟顶尖公司相提并论,但是人才密度绝对可以说得上是第一档。

留住这些人才,除了DeepSeek的高薪酬外,还有充分尊重创意与idea的运营模式。“无固定团队、无汇报关系、无年度计划”与其说是运营,不如说是信任。《奈飞文化手册》一书曾经说过,“优秀的同事和艰巨的挑战是吸引人们来公司工作的最大因素”。对AI从业者而言,再没有比AGI更艰巨的挑战了。

做最难的事,就要找到最好的人,给出充足的资源与信任。得到信任的顶级人才往往会带来巨大的爆发力,这一理论可以在抖音崛起中得到印证。

在2018年春节期间,抖音日新增客户超过千万量级。一位负责增长的产物经理曾提及,这个增长项目完全没有绩效压力,而且向财务发了一封邮件,他的账户中就多出了上亿元的投放预算。他当时就意识到,“这样的团队,做啥打不赢呢?”

DeepSeek也是同理。被筛掉简历的人,一定不是学历问题;面试通不过,肯定也不是能力问题;人才的需求集中为一句话就是,这个人是可以被信任一同为AGI努力的人吗?

这就是DeepSeek的人才观,理解了这种人才观,就是理解梁文锋的第一步。

极简主义的世界观

尽管做了多年量化,但是梁文锋并不认为自己是个做金融的,他对自己的看法是,“我是做AI的,只不过做的是量化场景”。

几乎所有与梁文锋交流过的人,都说出他是一个不会受到外界干扰的人,“他的思维方式极其纯粹,特别注重第一性原理”,“说话很慢”,“一开口就切中要害”。

量化投资的特性恰好契合了他这种极简主义的风格——它不需要与复杂的上下游产业链打交道,只需专注于纯粹的市场信息。

时至今日,梁文锋依然常常沉浸在自己的工艺世界中,专注于解决问题。比如做大模型这件事,他会告诉别人,“想清楚了就能干,只要有卡就行”,其他困难不在考虑范围之内。

对待金钱也是如此。钱就是用来投资,或者做慈善事业的,只要能花在合适的地方,亏损并不值一提。

2023年底,曾有一个旨在扶助聋哑人士的手语大模型项目,为了拉投资找到了梁文锋。梁文锋提出,这个项目的优点是公益性突出,缺点是市场规模有限,其中的隐患是,这是一个Top高校大学生团队的项目,他们可能不会长期坚持。

尽管极有可能得不到任何回报,他仍然提出,只要团队愿意继续推进项目,他就愿意投入。

过去梁文锋每年会拿出5亿元用于投资或慈善上,现在他把这笔钱花在了DeepSeek上。炒股是为了挣钱,投入大模型是为了AGI,仅此而已。

DeepSeek有将近两万张卡,他对算力极其慷慨,对上述的手语大模型团队,他就承诺过,算力集群会随时向他们开放。但是他又有点“小气”,对这近两万张卡的利用率要求很高,力求打满,不要空转。

这两种行为看似矛盾,如果按照极简主义的观点来解释,那就行得通了:卡的存在就是为了用的,能用尽用,万勿浪费。

不以商业化为限

没花一分钱投放费用,DeepSeek的App只用7天时间就得到了一个亿客户,对这一奇迹般的增长,梁文锋怎么看?有投资人在春节期间专门问了梁文锋这个问题,但是梁文锋看起来对这么大的流量根本毫不在意,投资人得到的回答是,“这距离AGI的路还很远”。

这并不是梁文锋在故作姿态。据雷峰网了解,DeepSeek只安排了两三个人负责App维护、对话网页开发、以及充值后台的运营工作。所以它不好用是正常的。

DeepSeek在B端市场的种种事迹,流传更广。比如此前他们的私有化部署定价仅为45万元,其中不仅包含一台H20或910b的使用权,还附赠大模型支持,使用期限为一年。而同样的价格,在华为云上仅仅只能租到 910b一年的使用权,这也就意味着 DeepSeek 的大模型近乎免费提供。

私有化部署不挣钱,DeepSeek也不在乎靠API挣不挣钱。一位对接DeepSeek的大厂员工吐槽它有一种“爱用不用”的气质,总是很难用,总是不调整。

再大的客户和调用量,都不值得另眼相看。一切大厂在高峰期都要排队,客户体验很差。大客户的反馈也很多,要求DeepSeek扩容扩容再扩容,至少回应流畅一些,不要两次请求就有一次失败,特别是在客服场景上,这种失败几乎不能忍受。

外界喧喧嚣嚣,不过梁文锋看起来并不是很在意这件事情。

这位大厂员工与DeepSeek员工私下交流过怎么改善这个问题,他得到的回答是,梁文锋认为,大厂完全有能力自己想办法解决请求失败的问题,他们应该自己给自己兜底,而不是过度依赖 DeepSeek来保障支持。

这个回答简直要把他给气笑了,“我们可是DeepSeek的Top级客户。”

可以说,现在的梁文锋不在乎商业化的一切可能。

在不少团队投入到应用的今天,梁文锋曾经跟一个好友说过,“你不要一直去看应用和行业落地的事情,你现在去看只能把你自己禁锢住了,因为没有到时候,现在想的一切都是错的。而且你在错误的路上你还投入了更多时间、精力和钱。”

这是对好友的忠告,也是自己的践行。将精力投入到应用上,投入到商业化上,对梁文锋来说,不论做什么,都是一条错误的道路。

而正确的道路从来只有一条,他现在已经走在了正确的道路上。


雷峰网原创文章,未经授权禁止转载。详情见转载须知。

为什么是梁文锋做出了DeepSeek?

- END -

33895

聚焦AI科技与医疗的跨学科融合,CAIR香港人工智能与机器人医疗论坛开幕

聚焦AI科技与医疗的跨学科融合,CAIR香港人工智能与机器人医疗论坛开幕

2024年3月28日至29日,“CAIR香港人工智能与机器人医疗论坛”在香港科学园举行。论坛由中国科学院香港创新研究院人工智能与机器人创新中心主办,聚焦人工智能与机器人在医疗领域的创新应用。来自全球的

非遗对话世界:BERRIN苝韵颜酒以文化为锚开启全球化征程

非遗对话世界:BERRIN苝韵颜酒以文化为锚开启全球化征程

来源标题: 非遗对话世界:BERRIN苝韵颜酒以文化为锚开启全球化征程在全球化浪潮中,中国酒类品牌正以文化为纽带开启新一轮国际叙事。近日,国内天然酒品类开创者BERRIN苝韵颜酒以“中国非

《临江仙》内容热度破万!爱奇艺再造古装爆款

《临江仙》内容热度破万!爱奇艺再造古装爆款

来源标题:《临江仙》内容热度破万!爱奇艺再造古装爆款6月15日,《临江仙》在爱奇艺内容热度值突破10000,引爆2025暑期档。《临江仙》开播以来爱奇艺内容热度持续飙升,并霸榜灯塔、云合、德塔文、艺恩

网易云音乐推出“毕业福利季”活动 会员、iPad、游戏道具等丰富福利免费送

网易云音乐推出“毕业福利季”活动 会员、iPad、游戏道具等丰富福利免费送

来源标题:网易云音乐推出“毕业福利季”活动 会员、iPad、游戏道具等丰富福利免费送6月9日,网易云音乐宣布“毕业福利季”主题活动正式上线,推出送会员福利、游戏联动福利、好歌福

2025年电影票房破300亿

2025年电影票房破300亿

来源标题:2025年电影票房破300亿从票房构成来看,年度票房榜前十名影片中,国产电影占据九席。《哪吒之魔童闹海》以超过51%的票房占比持续领跑,《唐探1900》和《封神第二部:战火西岐》分列第二、三

新时代工艺美术作品巡展昆明站启幕,百件匠心之作诠释文化传承与创新

新时代工艺美术作品巡展昆明站启幕,百件匠心之作诠释文化传承与创新

来源标题:新时代工艺美术作品巡展昆明站启幕,百件匠心之作诠释文化传承与创新6月5日,“新时代工艺美术作品巡展第五站)”在昆明市博物馆隆重开幕。作为国家艺术基金2025年度重点资

抖音举办“反诈开放日”活动,同步上线首部反诈短剧

抖音举办“反诈开放日”活动,同步上线首部反诈短剧

来源标题:抖音举办“反诈开放日”活动,同步上线首部反诈短剧6月10日,在2025年全国反诈宣传月即将启动之际,抖音在北京举办“反诈开放日”活动。活动现场,北京市委网信办、北京市

今天,130年的世界电影和120年的中国电影在上海相遇

今天,130年的世界电影和120年的中国电影在上海相遇

来源标题:今天,130年的世界电影和120年的中国电影在上海相遇《穆赫兰道》剧照绘出不拘一格的“电影史”风貌130年的世界电影和120年的中国电影在六月的上海相遇,这一届上海国

首场“解数Talk” 直播来了——大模型语料数据联盟开源数据集解读

首场“解数Talk” 直播来了——大模型语料数据联盟开源数据集解读

一、解数Talk 介绍为帮助广大开发者更好地了解大模型语料数据联盟发布的AI大模型语料数据,沟通大模型企业在AI视角下的数据需求,不断服务大模型产业生态和落地应用,联盟发起单位上海人工智能实验室联

《特里斯坦与伊索尔德》排练向观众开放 瓦格纳巅峰7月上演

《特里斯坦与伊索尔德》排练向观众开放 瓦格纳巅峰7月上演

来源标题:《特里斯坦与伊索尔德》排练向观众开放 瓦格纳巅峰7月上演《特里斯坦与伊索尔德》首次排练现场。解放日报记者 董天晔 摄“《特里斯坦与伊索尔德》将动机精准嵌入剧情转折点,使音乐成为戏

“六六给荔节”实“荔”出圈,让世界从“美荔广东”看到“给荔中国”!

“六六给荔节”实“荔”出圈,让世界从“美荔广东”看到“给荔中国”!

来源标题:“六六给荔节”实“荔”出圈,让世界从“美荔广东”看到“给荔中国”!从苏东坡发出“日啖荔枝三百颗,不辞长作岭南人”的千古咏叹,到新时代“甜蜜经济&rdquo

短剧非常关系四川拍摄再掀热潮

短剧非常关系四川拍摄再掀热潮

来源标题:短剧非常关系四川拍摄再掀热潮由龙旭影业,龙旭导演指导出品,环球影业监制,执行制片人王易丹,2025年度精品网络微短剧《非常关系》系列在四川举行开机。好戏登场粗汉拳客和落魄千金的情缘,燃点很满