7月31日,,DeepSeek(深度求索)宣布新一代模子DeepSeek-V4-Flash正式版,,启动果真测试。。这一模子的架构、参数规模和上一版本一致,,但通事后训练优化,,Agent能力大幅提升,,加之远低于同类产品的价钱,,引发海内外开发者的狂欢。。
一位澳大利亚AI从业者在社交平台感伤:我喜欢DeepSeek的做法。。他们不搞铺天盖地的宣传,,也不会每隔一周就做出什么惊人允许。。他们会消逝几个月,,默默地举行研发,,然后带着一款性能堪比顶尖产品,,价钱却低得多的产品回归。。
当DeepSeek站在全球人工智能竞争的聚光灯下,,它的首创人梁文锋,,险些从公众视野中消逝了。。
自2025年头DeepSeek依附R1模子出圈以来,,梁文锋没有再接受媒体采访,,也少少果真露面。。DeepSeek官网恒久只设一个果真邮箱。。
但2026年,,这家明星公司最先泛起一些改变。。建设三年,,首次对外开放融资,,大规模扩招研发职员,,DeepSeek正在进入一个新的生长阶段。。它追逐AGI的目的没有改变,,但它面临的现实与一年前差别了。。站在这个时间节点回望,,会发明DeepSeek的许多特质,,险些都能在梁文锋身上找到谜底。。
梁文锋 图/视觉中国
不干预、不设KPI
2023年7月,,在海内某头部院校读博士一年级的池羽,,闯过三轮面试,,进入DeepSeek担当实习研究员。。ChatGPT掀起的大模子浪潮正席卷全球,,3个月前,,幻方量化基金宣布建设自力AI研究公司。。池羽入职确当月,,DeepSeek正式完成工商挂号。。公司在杭州和北京都设有办公室,,梁文锋经常往返于两地。。
池羽在这里事情了一年,,见证了这家明星公司的早期阶段。。他对梁文锋的初印象是谦逊。。池羽的专业偏向是强化学习,,其时DeepSeek还没人涉足这一领域,,“梁老板其时对我说,,‘你教我强化学习’”。。
已往两年,,外界热衷于将梁文锋塑造成一个手艺理想主义者,,但容易忽略的是,,他着实也是一个善于组织科研的治理者。。梁文锋曾谈到自己的选人逻辑:相比履历和履历,,他更看重基础能力、创立力、好奇心和热情。。他提到,,团队里没有所谓“高深莫测的奇才”,,“都是一些Top高校的应届结业生,,没结业的博四、博五实习生,,尚有一些结业才几年的年轻人”。。
池羽也契合梁文锋的选人标准。。2023年,,海内大模子竞赛兴起,,不乏互联网大厂和明星创业公司入局,,池羽选择加入没有现在着名度的DeepSeek。。他对《中国新闻周刊》说,,自己追求AGI,,重视英雄主义,,对自己的能力很有信心。。DeepSeek吸引他的地方是,,梁文锋提到各人可以从零最先探索大模子的搭建。。他履历了三轮面试和线上笔试,,问题很难,,“能通过面试的人,,能力都不会差”。。
梁文锋信任招来的人,,把主要的事情交给他们做,,并且不干预、不设KPI。。作为实习研究员,,池羽自力牵头了DeepSeek大模子强化学习基础设施(LLM RL Infra)的早期搭建事情,,他完成了基础框架的搭建,,获得认可后,,梁文锋又调来了更多研究职员一起相助。。
其时每周的例会上,,团队会围绕模子训练的差别????榛惚ㄏM!3赜鸹匾,,梁文锋十分犀利,,看重手艺细节,,会盯着他以为主要的地方,,一直追问。。他能感受到,,梁文锋也会对和熟悉领域相关的内容很感兴趣,,也想要实验一些新工具,,“但这也是他谦逊的地方,,一最先没有接触时,,他会让我们先凭证自己的思绪去做”。。
池羽记得,,团队里有不少和他一样在读博或刚结业不久的年轻研究员。。各人从业履历未几,,却有充分的自主权。。“真的挺理想主义的,,其时人少,,人均可挪用的算力资源很是多。。”
梁文锋曾提到,,这类有热情的年轻研究者,,对科研的盼愿,,远超对钱的在意。。但这不料味着薪酬不主要。。事实上,,DeepSeek早期提供的薪酬很有竞争力。。池羽没有透露详细薪资,,但认可待遇高于不少偕行。。2025年2月,,媒体关注到DeepSeek的招聘信息,,公司大都岗位月薪2万元以上,,焦点研发岗位年薪可达百万元,,AGI偏向实习生日薪为500元至1000元。。
这种用人逻辑,,在幻方量化时期已经形成了。。梁文锋曾谈到,,幻方量化在2015年刚建设时,,焦点团队包括他自己,,都没有量化履历。。焦点手艺岗位,,也是以应届生和结业一两年的新人为主,,主力销售从零最先。。他强调个人能力,,“不可说是乐成的神秘,,但这是幻方的文化之一”。。路透社曾采访的一位熟悉梁文锋的量化基金司理透露,,在幻方量化,,一位资深数据科学家的年薪可以抵达150万元,,而同类职位在其他公司通常低于80万元。。
梁文锋曾提到,,DeepSeek没有组织(治理系统),,激励各人,,更多依赖一个配合追逐的目的。。池羽形貌其时在DeepSeek的事情气氛:招人不设限、扁平、互帮相助、自由。。在DeepSeek的那一年,,他记得所有人都朝着AGI的偏向,,相助很丝滑,,“那里缺人,,谁就会补上”。。
他以为,,这种气氛与梁文锋的治理方式有关。。“梁老板愿意听取别人的建议,,在自己熟悉的领域也会提出自己的看法。。”脱离DeepSeek后,,池羽也在Meta等一些大厂实习,,他能感受赴任别的组织气概:Meta更强调个人英雄主义,,但在DeepSeek,,“各人一起‘坐火箭’,,缺了谁都不可”。。
2025年2月17日,,用户在DeepSeek手机客户端上提问。。图/新华
“榨取,,是一种战略”
2002年,,梁文锋以806分的效果成为广东吴川市高考状元。。梁文锋分享学习履历时说:“要重视自学,,不要纯粹知足跟先生走,,要有自己的学习妄想、要领、目的与标准要求。。”现在回看,,梁文锋的许多选择,,似乎都在延续这一思绪。。
在海内外AI行业,,创业公司不但在竞争模子,,也在竞争注重力。。首创人接受采访、活跃于社交媒体、向资源市场讲故事,,是一种常见的做法。。2024年下半年以后,,海内“百模大战”进入下半场,,行业讨论的焦点最先转向商业模式,,梁文锋差池外发声,,不急于融资,,把大部分资源投入模子研发。。从少有的果真讲话和DeepSeek的生长路径来看,,他并不追随行业主流或“共识”,,而是有自己明确的判断和目的。。
今年7月以来,,一份梁文锋与投资人的内部交流会实录在互联网上普遍撒播。。
在这份交流实录中,,梁文锋多次提到一个词——榨取,,“榨取是一种战略”。。首先体现在对开源蹊径的选择上。。已往几年,,中美大模子公司逐渐形成了两条差别蹊径。。以OpenAI为代表的公司一直强化闭源模式,,以DeepSeek为代表的公司始终坚持开源。。
梁文锋对开源的判断,,基于他对工业生长的明确。。在他看来,,AI未来创立的价值足够重大,,“可能会占人类社会GDP的10%”,,没有任何一家企业能够独吞这样一个市场。。若是试图独吞利益,,最终会被历史镌汰。。
同样的逻辑也体现在产品定价上。。梁文锋提到,,DeepSeek不追求商业利益最大化,,而是坚持“合理”的利润,,“或许是我们到市场上买一批装备回来,,十个月收回本钱”。。他坦言,,让利可以让用户感受到善意,,也能增强团队的认同感。。他分享,,团队内部讨论模子价钱时,,最初设定了更高价钱,,但成员并不知足;;决议降价后,,公司群里“许多人是欢呼的”。。由于团队会以为做的事情真正被更多人使用,,而不但是为了挣钱。。
2025年头,,DeepSeek-R1宣布后一周,,日活跃用户突破2000万,,月尾峰值凌驾4500万。。关于一家创业公司而言,,这本是承接流量、快速商业化的最佳窗口,,梁文锋却没有把重点放在留住用户或尽快变现。。
2025年以来,,腾讯、字节跳动、阿里等大厂围绕AI应用入口,,已经睁开多轮竞争。。但梁文锋在上述交流中提到,,团队从未想过把DeepSeek做成下一个超等App,,没有盲目投入争抢个人用户,,“由于后面尚有西瓜,,前面的可能都是芝麻”。。
池羽对此也有感受。。他回忆,,团队恒久关注的目的始终是AGI,,“以是对做产品这些事情,,没有那么在意。。梁老板也会把资源集中到最主要的事情上,,好比其时各人优先把预训练做好”。。
这种判断也体现在更早的结构中。。在大模子浪潮真正到来之前,,幻方量化已经最先投入AI基础设施建设。。2020年前后,,幻方投入近2亿元建设深度学习训练平台“萤火一号”;;两年后,,又斥资约10亿元建设“萤火二号”,,配备约1万张英伟达A100 GPU。。据报道,,其时海内具备这一规模AI算力储备的企业,,除互联网大厂外并未几。。
梁文锋厥后回应,,这背后并没有重大的商业逻辑,,更多源于对AI能力界线的好奇心。。对圈外人来说,,ChatGPT是一个跨时代的节点,,但关于更多AI从业者来说,,2012 年,,AlexNet在ImageNet图像识别大赛中夺冠,,已经展示了数据加算力可以“大力出事业”的可行性。。从其时起,,梁文锋便最先有意识安排算力。。
虽然,,梁文锋能坚持自己的节奏,,也有现实条件支持。。背后的幻方量化恒久拥有稳固现金流,,为DeepSeek提供研发预算。。梁文锋曾体现,,幻方作为DeepSeek的出资方之一,,有富足的研发预算,,每年尚有数亿元公益预算,,须要时也可以投入研发。。
但资金并不可诠释所有。。一位不肯签字的大模子从业者在接受《中国新闻周刊》采访时提到,,2023年以来,,OpenAI乐成后,,海内不少创业者体现想要做“中国版OpenAI”。。Anthropic受到关注后,,又泛起一批模拟其路径的公司,,DeepSeek走红后,,类似的追随者也曾泛起。。在他看来,,这折射出中国AI创业的一种普遍征象——对强者绝对听从,,倾向于复制已经被验证的乐成路径。。
清华大学盘算机系教授刘知远也是一名AI创业者。。在他看来,,梁文锋更值得关注和学习的地方,,并不在于选择了哪一条详细手艺蹊径,,也不料味着他的每一个判断都是准确的,,而是在于能够坚持自力判断,,甚至在别人不看好时,,依然坚持自己以为准确的事情。。倾覆式立异需要的,,正是这种基于差别化探索的勇气,,而不是“内卷”式的复制。。
2026年6月,,DeepSeek完成建设以来的首轮外部融资,,进入了一个新的生长阶段。。AI插画/adan
榨取的价钱
今年6月,,DeepSeek已完成建设以来的首轮外部融资,,募资总额超500亿元人民币,,约合74亿美元。。这是中国AI大模子行业迄今规模最大的单轮融资,,也意味着,,这家恒久坚持不融资的公司,,正式向外部资源洞开了大门。。
梁文锋为什么变了????在不少业内人士看来,,焦点原因并不是缺钱。。上述大模子创业者告诉《中国新闻周刊》:“若是只是为了训练模子,,DeepSeek应该没有那么大的融资需求。。”他剖析,,以DeepSeek现在的研发模式来看,,幻方量化恒久稳固的收入足以支持模子训练,,DeepSeek自己又以低本钱训练著称,,也没有像许多偕行一样大规模投入C端产品。。
外界推测,,真正的压力来自人才。。关于一家恒久没有融资、没有上市妄想的公司而言,,员工持有的期权很难形成明确价值。。当整个行业掀起新一轮AI人才争取战时,,仅靠理想主义,,很难恒久留住最顶尖的研究职员。。
已往一年,,DeepSeek成了海内AI行业最主要的人才泉源之一。。在R1爆火后,,大厂加入抢人大战。。小米以网传的万万年薪挖走罗福莉;;DeepSeek V3、R1等模子的焦点孝顺者郭达雅,,加入字节跳动Seed团队;;第一代大语言模子焦点作者王炳轩加盟腾讯混元,,多模态认真人阮翀脱离加入元戎启行,,另一位焦点成员魏浩然也已去职。。与此同时,,字节跳动、腾讯、阿里等公司纷纷打出“薪酬上不封顶”“待遇不限”等招聘口号,,AI人才竞争周全升级。。
梁文锋也在上述内部交流中认可,,DeepSeek最大的风险是团队稳固性。。他直言:“只要我能够坚持团队的稳固性,,我一定能做成AGI。。”这次融资之后,,这一风险获得了一定缓解,,“各人拿到的期权照旧较量多的,,金额也较量大”。。
事实上,,梁文锋并不是完全拒绝资源,,而是担心资源会改变公司的生长节奏。。他曾提到,,早期团队也和差别的出资方交流,,但许多 VC 对做研究有记挂,,他们有退出需求,,希望尽快做生产品商业化,,这与公司优先做研究的思绪有冲突。。
值得注重的是,,即便决议开放融资,,梁文锋依然试图把自动权掌握在自己手中。。据媒体报道,,在本轮融资中,,梁文锋个人出资约200亿元,,占总融资额约40%,,仍是最大简单出资方。。腾讯、宁德时代、京东、网易等投资方虽然加入投资,,但均不拥有投票权,,所持股份还设置了五年锁按期。。
不过,,随着融资完成,,DeepSeek也不可阻止地面临新的改变。。6月下旬,,DeepSeek启动建设以来最大规模招聘,,明确提出将各部分规模扩大至少一倍,,岗位笼罩算法、研发、产品、运营、数据工程及职能等多个偏向。。与已往以研究团队为焦点差别,,这次招聘中也增添了产品相关岗位。。
上述大模子从业者告诉《中国新闻周刊》,,已往梁文锋险些可以把所有精神放在研究上,,但随着融资完成,,公司需要面临越创造确的商业预期。。“以前可以不急着思量产品,,但未来一定需要补齐产品、服务和商业化能力,,这是公司生长到这个阶段不可阻止的事情。。”
一位为DeepSeek服务的猎头在接受《中国新闻周刊》采访时提到,,DeepSeek不缺应聘者,,近期的招人标准仍然很高,,宁缺毋滥。。但从企业生长纪律来看,,小团队时期形成的文化,,随着规模扩大往往碰面临磨练。。
已往三年,,梁文锋通过个人判断和团队文化,,塑造了DeepSeek奇异的事情方式。。但当公司进入新阶段,,早期依赖理想主义和高度信任形成的默契,,怎样延续到更大规模的组织中,,或许将是梁文锋需要面临的现实挑战。。
(为;;な芊谜咭私,,池羽为假名)
发于2026.8.10总第1247期《中国新闻周刊》杂志
杂志问题:梁文锋:榨取与价钱
记者:杨智杰(yangzhijie@chinanews.com.cn)
编辑:闵杰