首页> 新闻>  正文
“梁”性循环
来源:赛迪网     作者:王子祺 2026-08-04 16:17:02
微信分享二维码

扫码分享到微信

关闭

7 月 31 日,DeepSeek 正式开放 V4-Flash 正式版 API 公测。按理说一个大模型更新不算稀奇,可这一次的动静大得不正常:先看一组数字。开源编程平台 OpenCode 披露,仅 8 月 1 日一天,V4 Flash 在其平台上的 Token 处理量就冲到 8 万亿,其中 5 万亿来自免费试用额度,3 万亿是开发者真金白银的付费调用。全球最大模型聚合平台 OpenRouter 的周榜(7 月 27 日至 8 月 2 日)上,V4 Flash 以 7.22 万亿 Token 的周调用量登顶全球第一——榜单前五全是中国的模型,中国已经连续 14 周在调用量上压过美国。更戏剧性的一幕,发生在上线前一天:7 月 30 日,OpenAI 紧急宣布 GPT-5.6 系列降价,其中轻量级模型 Luna 直接砍掉 80%,输出价格从每百万 Token 6 美元降到 1.2 美元。评论区有人贴了张 DeepSeek 的定价表,只补了一句:"我们想要 DeepSeek 的价格。"

一个成立刚满三年的中国 AI 公司,凭什么把全球最贵的 AI 公司逼到连夜砍价?很多人把这归功于"中国 AI 崛起",但更准确的说法是:这背后站着一个具体的人。过去一年,网友给他起了不少外号:因为把顶级模型的价格打到地板,有人喊他"梁叔叔",说这是"梁叔叔百亿补贴";中二一点的网友,直接封他"梁圣"。而在这一堆称呼里,我更偏爱一个在圈内私下流传的说法——"梁性循环"。它初看是个谐音梗,听着像谁都在念叨的"良性循环",可那个"梁"字,分明是一个活人的姓。姓梁的人很多,可如今能让一个词以他的姓氏命名、还被当成真事讨论的,只有一个:梁文锋。

在大多数报道里,梁文锋是那种标准的"技术理想主义者"人设:出身广东湛江一个教师家庭,父母都是镇上的小学老师;从小是那种"别人家的孩子"式的学霸,毕业之后做量化、办私募,把赚到的钱全部砸进通用人工智能,还把成果免费开源给全世界。2025 年,他接连入选《时代》全球百大影响力人物与《自然》年度十大科学人物,身家估算冲到数百亿美元——一个从村里走出来的学霸,靠技术改变世界,顺便成为富豪。这个故事太顺了,顺到像剧本。

顺到让人忽略一个问题:一个做量化交易出身的人,为什么突然"改行"搞 AI?而且搞得这么凶——发布即开源、定价即地板、上线即登顶。如果只看表层,你会觉得这是理想主义者的慷慨;可一旦把时间线拉长到十六年,你会发现另一件事:梁文锋从来没有"改行"过。他只是在不同的棋盘上,反复下同一盘棋。而这盘棋的名字,就是那个谐音梗——梁性循环。

故事得从三十多年前讲起。1985 年,梁文锋出生在广东湛江吴川市覃巴镇米历岭村,父母是镇上小学老师。他在吴川一中读完初高中,2002 年以"高考状元"的成绩考入浙江大学电子信息工程专业,那年他十七岁。大学里他对金融市场生了兴趣,2005 年拿了全国大学生电子设计竞赛一等奖;2007 年考上浙大信息与通信工程研究生,2010 年拿到硕士学位,毕业论文写的是《基于低成本 PTZ 摄像机的目标跟踪算法研究》。从机器视觉入门,这条路后来悄悄拐向了金融。

拐点出现在 2008 年。全球金融危机里,还在读研的梁文锋带着团队用机器学习跑全自动量化交易——用模型替代人做投资决策。这一步,他比行业早了将近十年。2013 年,他和浙大同学徐进创办杭州雅克比投资;2015 年又成立杭州幻方科技,主打"用数学和 AI 做量化投资"。那一年市场剧烈波动,幻方靠高频量化策略跑出好成绩,圈内自此有了"北九坤,南幻方"的说法。

真正让幻方脱胎换骨的,是梁文锋对算力的超前下注。2016 年 10 月,幻方上线第一个由深度学习生成的交易仓位,开始用 GPU 跑策略;到 2017 年底,几乎所有策略都 AI 化。2019 年他自研"萤火一号"训练平台,砸近 2 亿元、堆了 1100 块 GPU;2021 年再投 10 亿元建"萤火二号",一口气囤下约一万张英伟达 A100。同一年,幻方资管规模突破千亿,坐上国内量化私募"四大天王"的交椅。后来他在金牛奖演讲里说,幻方量化的使命是"用技术让市场更有效率"——这句话,和日后他说"用技术让智能更便宜",是同一套语法。

巅峰也伴着裂缝。2021 年底幻方因策略同质化出现历史最大回撤,公开致歉、关闭募集通道;2022 年整体收益仅 0.38%,此后逐年压降规模。这些起伏说明,量化这条"正反馈"路,本身就有自己的周期与脆弱。可正是在这段时间里,梁文锋把幻方的算力"粮草"悄悄转向了一桩更冒险的事。

2023 年 7 月,他从幻方抽出最精锐的一支队伍,创办深度求索(DeepSeek),正式进军通用人工智能。此后是一条被反复讲述、又被不断验证的曲线:2024 年 5 月 V2 把推理成本压到每百万 Token 约 1 元,引爆大模型价格战;12 月 V3 开源;2025 年 1 月 R1 以约 560 万美元的训练成本叫板 GPT-4,应用登顶中美 App Store;再到今年 7 月 31 日,V4 Flash 正式版上线、单日处理 8 万亿 Token、把 OpenAI 逼到连夜降价。从吴川的状元少年,到千亿私募的"量化天王",再到今天站在 AI 风暴眼里的那个人——这条曲线的每一段,都在为同一台引擎蓄力。

很多人把他的选择解读成理想主义,但他在暗涌的访谈里把话挑得很明:"我们做大模型,其实跟量化和金融都没有直接关系",他只是觉得,通用人工智能是"下一个最难的事之一"。被问到这个循环会不会太霸道,他更在意的是另一件事:"我们经常说中国 AI 和美国有一两年差距,但真实的 gap 是原创和模仿之差。如果这个不改变,中国永远只能是追随者,所以有些探索也是逃不掉的。"你看,他连"追随者"三个字都接受不了,又怎么会满足于做一个"行业颠覆者"?他要的是让中国第一次站到技术前沿——"我们的出发点不是趁机赚一笔,而是走到技术的前沿,去推动整个生态发展"。聊到这支队伍,他同样直白:V2 模型里没有海外回来的人,都是本土培养的;选人只看热爱和好奇心,"很多人对做研究的渴望,远超对钱的在意"——这也是为什么一群年轻人愿意跟着他往前冲。这套说法,和他十六年前带着团队用机器学习跑量化时,其实是同一件事:把"不可能"当成一道待解的题,而不是退回去的理由。

也就是说,"用市场的钱强化模型、再用模型回去搅动市场",在他身上不是修辞,是履历。量化圈管这叫正反馈,圈里人管这叫"梁性循环"——一个听着像表扬的词,装的却是他一个人的引擎。现在你该明白这名字的妙处了:它念出来和"良性循环"一模一样,可头一个字不是"良",是梁文锋的"梁"。一个听着像褒义的好循环,落下来却是用他一个人的姓氏命名、由他一个人驱动的周期——这大概就是这届网友最狠的谐音梗:把一场追杀,安上了一个像表扬的词。

把它搬到大模型竞争里,循环长这样:你研发,我低价开源逼近,你被迫继续砸钱买卡,你的利润变成我的势能。而 DeepSeek V4 Flash 与 OpenAI 的这次交手,几乎是这个循环的实时演示。V4 Flash 采用 MoE 架构——简单说,就是"把大模型拆成很多小专家,每次只叫醒最对症的那几个",所以成本只跟被激活的参数挂钩,而不是总参数量。这套架构下,V4 Flash 总参数 2840 亿、激活仅约 130 亿,却支持 100 万 Token 上下文,把顶配能力压到地板价;更关键的是,这套低成本架构已经能在国产芯片上跑起来——智源 FlagOS 在 V4 Flash 发布后第一时间完成了对华为昇腾、沐曦、海光、摩尔线程、昆仑芯等 8 款国产 AI 芯片的 Day-0 适配,等于给循环备好了一条不依赖英伟达的算力底座。OpenAI 在正式版上线前一天抢先宣布 GPT-5.6 Luna 降价 80% 应战,可多家分析指出 V4 Flash 的实际任务成本仍比 Luna 低约 60%。

所以梁文锋到底在干什么?我的判断是:他从来没把自己当成一个"AI 布道者",他始终是一个量化交易员——只是把交易标的从股票换成了智能本身。低价开源不是慷慨,是武器;免费不是目的,是手段。他自己给过一个更轻的说法:"DeepSeek 不是有意成为一条鲶鱼,只是不小心成了一条鲶鱼。"可鲶鱼是让一池子鱼都动起来,收割机是把一整块地都收走——这两个意象之间的距离,大概就是他嘴上说的和手上做的距离。它真正的杀伤力在于一句大白话:你敢更新,我就出一个接近你水准的版本,然后免费开源。R1 时代这一幕已经上演过——R1 发布后,OpenAI 两周内连发三个模型,其中 o3-mini 被多家媒体点名是"为应对 R1 提前发布";连山姆·奥特曼都公开承认闭源策略"站在了历史错误的一边";据外媒报道,Meta 的生成式 AI 团队当时内部一度"陷入恐慌"。

而评论区那句"我们想要 DeepSeek 的价格",才是这个循环真正的燃料。它不是厂商之间的军备竞赛,是用户用脚投票:当 DeepSeek 把顶配压到几乎白送,需求侧就被彻底教育出了"低价预期"。从此,任何高价模型都要面对一句无声的质问——你凭什么比 DeepSeek 贵?这恰恰是梁性循环最狠的地方:它不只从供给侧压制对手,更在需求侧重置了全行业的定价锚。顺着这个逻辑看各家的分头布局——代码智能体、视频生成、通用推理,每个方向都安排一个"低价逼近者"——就一点都不乱了:这是把"逼近式压制"铺到每一个战场。而 DeepSeek 也不是孤军:同样走开源开放权重路线的还有 Kimi K3(2.8T MoE、原生多模态)等中国模型,整个开放权重阵营像一组编队,在不同赛道同时贴着闭源巨头的价格线往下压。

但梁性循环不是永动机。圈里对它能不能成立,至少分三派:循环真实派说,V4 Flash 登顶、OpenAI 连夜砍价,这就是实证;循环脆弱派则泼冷水——循环的第一颗齿轮是"DeepSeek 必须持续保持成本领先",这依赖算力供应链。这一条,梁文锋自己比谁都清楚,他早就把话放那儿了:"我们面临的问题从来不是钱,而是高端芯片被禁运。"真被卡了脖子,弹药就断了,而且开源逼近天然有自伤,把价格压到地板,也压缩了 DeepSeek 自己的变现空间,更关键的是,OpenAI、Meta 完全可以靠闭源高毛利、企业级订阅和生态绑定赚钱,压根不接你的价格战。更何况,OpenAI 把这次降价讲成了自己的故事——它宣称靠内部效率提升(GPT-5.6 Sol 帮着优化推理软件,把端到端服务成本降了约 20%、token 生成效率提了 15%,连 ARC-AGI-3 基准都从 13.3% 跳到 38.3%、还少用了六分之五的输出 token)把"充裕智能"回馈给用户,还亮出 10 亿活跃用户、200 万企业客户的规模牌。换句话说,它未必是在"追着 DeepSeek 的价格跑",而可能只是在跑自己的路线图。循环能逼对手"降价",却未必能逼对手"出局"。

第三派看得更宽:这根本不是纯市场行为,而是国家算力与电力产能的较量。芯片管制、核电审批、电网扩容,都是政府手里的牌。这一点在 7 月 31 日那天格外刺眼——就在 DeepSeek V4 Flash 正式上线的同一天,中国国务院核准了辽宁庄河、浙江金七门二期、广东太平岭三期、山东莱阳一期 4 个核电项目、共 8 台机组,总投资超 1700 亿元,这是"十五五"首批核准的核电项目。循环要烧的电,国家直接批了新机组来供。

三派其实不矛盾——有意思的是,这个谐音梗本身就是三派分歧的缩影:"良性循环"和"梁性循环",念起来一模一样,只差一个字:是"良",还是"梁"。同一个读音,两种写法,三种立场:对普通用户和开发者,它是良性——价格被压到地板,受益的是千千万万用得起的人;对梁文锋,它是"梁"性——一台以他的姓氏命名、由他一个人驱动的引擎;而对被迫跟进降价的对手,这个循环既不"良"也不"梁",而是结下了梁子——每被迫跟一次价,利润就薄一分,梁子就深一层。妙就妙在,"梁子"的"梁",还是他那个"梁"。同一个读音:写"良"是普惠,写"梁"是引擎;对对手,则是结下一个解不开的梁子。全看你站在哪一头。

从"梁叔叔"到"梁圣",再到"梁性循环",网友给他起的每一个名字,指向的都是同一件事。而这篇人物纪传,临了想让你带走的是一句话:梁文锋这个人,最值得记住的不是他的身家,也不是他开源了什么模型,而是他把"良性循环"这四个字,硬生生写成了自己的姓氏。听起来是句表扬,实际上是一台发动机——一台以市场利润为燃料、以开源免费为武器、以"让对手更累"为目的的发动机。

而这台发动机的转速,也有物理上限——电。国际能源署测算,全球数据中心的用电量到 2030 年可能翻倍到约 945 TWh,电费正在成为所有玩家共同的天花板。看明白了吗?它给所有玩家的提醒很冷:靠烧钱堆出的领先,是负债,不是资产;真正的护城河,是别人追你时,你自己也在轻松往前走。而当电成了硬瓶颈,这场"追杀"的结局,大概率不是谁收割了谁,而是大家一起,卡在供电表那个跳不动的数字上。

那台雷霆大的联合收割机还在轰鸣。只是它追的尽头,是一片需要核电才能点亮的、沉默的荒原。而驾驶它的人,此刻大概正站在风暴眼中央,看着计价表上跳动的 Token 数——像一个十六年前就开始数着回撤曲线的人,只是这一次,他数的是全世界的算力。

他开的这台机器,姓梁。(文/王子祺)

阿里、腾讯、字节AI办公的“统一战争”:赛马落幕,入口为王

7月的最后一周,中国AI办公赛道仿佛被按下了同一个按钮。三家公司,两周之内,不约而同地对自己亲手养大…

6小时前

百度入局AI办公:dodo并入百度搭子,Agent矩阵火力全开

对百度而言,办公Agent业务将从多线推进改为集中作战,也标志着百度将整合优势资源,全面入局AI办公赛道…

4小时前
你可能也喜欢这些文章