长期以来,“卖铲人”黄仁勋倾心编织的英伟达一统全球AI算力江湖的神话,终于要被中国打破了!
01,“爱国者”梁文锋
如果说2025年1月,DeepSeek-R1的横空出世,是为国产模型第一次实现对美国顶尖模型反超的标志;那么2026年7月,DeepSeek创始人梁文锋《会议纪要》的曝光,同样注定会载入历史!
因为其预示着——中国不仅可以在AI模型上与美国最强模型掰手腕,在AI芯片上,同样可以打破对英伟达的依赖,国产模型+国产芯片闭环的宏大叙事,正在加速上演……
据21世纪报道,7月22日深夜,一篇《梁文锋四小时投资人会议实录》的长文,因为游戏科学创始人冯冀的朋友圈安利,悄然成了科技圈的热点,随后,同样低调的大佬、美团联创王慧文也转发了这份实录,并发出精悍短评:“这格局,有三四层楼那么高”。
笔者注意到,在7月23日梁文锋会议纪要相关的话题像雨后春笋般冲上多平台热搜后,连传奇“商界教父”段永平都“自矮半截”地表达了对梁文锋的盛赞,他在雪球平台上用回复网友提问的方式如此评价:
“不知道算不算给自己脸上贴金了,梁师弟是我一个系(浙大信电系)出来的,之前就看过AI能破CUDA(英伟达生态护城河)的说法,但梁文锋说出来份量不一样哈,他能走到今天,也是因为他有利润之上的追求的”
当凭《黑神话悟空》惊艳全球的游戏科学老板冯冀,王兴最依赖的战友&美团功勋级联创王慧文,一手缔造步步高商业帝国并间接促成OPPO、vivo、拼多多诞生的传奇企业家段永平都对梁文锋本人和他这份会议纪要赞不绝口时,释放的讯号再清晰不过了!
这篇顶尖大佬们都力挺的纪要,核心要点包含了梁文锋对AI行业前景的判断、对国产算力现状和前景的判断,尤其是谈及中美差距时,梁文锋的观点可以说提振了所有科技行业从业者的士气、乃至全体国人的信心。
梁文锋直言:“我们跟美国的差距主要在资源上面,然后人才上面差距不是很大。人才不是瓶颈…之所以有人才的区别和模型能力的区别,本质是算力资源上的区别”
关于这一点,已经有无数个事实证明了,当前的中国,已经不缺顶尖AI大牛了,除了梁文锋自己(当然,梁文锋从不承认自己是天才)和所带领的DeepSeek核心团队(约31人在左右,其中有10人从未有海外经历,全由中国本土教育体系培养,他们用实力支撑了对标OpenAI的推理模型研发)。
还有月之暗面创始人杨植麟,清华天才的他放弃硅谷高薪回国创业,公司最新估值已超3300亿,更让人惊叹的是,最新发布的Kimi K3开源模型,更是让让马斯克和硅谷一众AI巨头/佬都感到了“焦虑”。
然后字节、阿里、腾讯、百度、小米…都坐拥一群AI强兵,比如腾讯的姚顺雨,就是主动从OpenAI辞职,然后回国加盟的,他的有力带领下,腾讯自研的混元模型HY3的表现收获了业界一致肯定,再如小米的罗福莉,更是从0到1促成小米AI模型MiMo的诞生。
公开资料显示,姚顺雨本科毕业于清华大学姚班,获普林斯顿大学计算机科学博士学位,2024 年加入 OpenAI 并参与智能体产品 operator 与 deep research 开发 。其研究聚焦语言智能体与现实世界交互,提出 ReAct 方法首创“推理—行动”结合的智能体范式,被学术界与工业界广泛采纳。
2025 年 12 月,腾讯升级大模型研发架构,新成立 AI Infra 部、AI Data 部、数据计算平台部,全面强化其大模型的研发体系与核心能力。姚顺雨出任“CEO / 总裁办公室”首席 AI 科学家,向腾讯总裁刘炽平汇报;同时兼任 AI Infra 部、大语言模型部负责人,向技术工程事业群总裁卢山汇报。
2026年7月24日最新消息显示,腾讯宣布混元多模态模型部门与大语言模型部门合并,成立基础模型部,统一由腾讯首席 AI 科学家姚顺雨管理,以进一步提升模型研发和协同效率,探索全模态模型的智能上限。
……
笔者简单列举之下,就已经有这么多实例印证着梁文锋AI人才论的正确性。恰如梁文锋所言:
“我们可能落后美国12到18个月,或者说6到12个月。反正简单说,就是落后美国两年,然后只用美国二十分之一的算力把这个事情做出来。未来我们要把这个叙事改写,就是我们用它几分之一的算力,但是把这个时间缩得更短,缩到6个月、3个月,我觉得这是一个目标。以及我们甚至可以在某一些方面超越他们…”
DeepSeek未横空出世前,他们几时相信过中国AI模型能追上美国?华为芯片未突破前,他们几时相信过国产芯片也能打破美国的封锁?那些妄自菲薄的,无非是跪太久,站不起来了!
这恰恰是梁文锋先生身上最难能可贵的一点,身为技术天才&青年企业家,他在最前沿的AI领域,从来没有唯美国马首是瞻,而是从一开始就用自研的方式来打磨内功,所以DeepSeek的护城河才越筑越深。
当“技术自强、拥抱国产”融进DeepSeek的血液时,段永平那句“他能走到今天,也是因为他有利润之上的追求的”含金量还在上升!
02,“平替”英伟达,绝不是梦!
当国产模型已经凭实力跻身全球第一梯队之际,那么,国产芯片与美国巨头们分庭抗礼, 也终归只是时间问题!特别时,我们欣喜地看到梁文锋的又一重大判断:
“国产AI芯片替代现在是有个历史性机会的。英伟达(NVDA)CUDA的护城河在快速地被瓦解”
梁文锋不仅一针见血地指出英伟达最大的护城河CUDA在被快速瓦解,还给出了三方面的论据。①AI 自己能写代码建生态了;②DeepSeek 自研的 TileLang 用很短的代码就能重写整套算子;③芯片和游戏卡解耦后,专用芯片本来就不该绑定 CUDA;
梁文锋直言,一年内,“国产卡生态不行”这个说法会被事实终结。他用华为AI芯片举例,称华为950超节点在性能和价格上可完全平替英伟达GB200、GB300,四张顶一张,落后两年。 性能、任务、延时都对得上,价格贵一倍以内都能接受。
当然,梁文锋也坦言,国产芯片的唯一瓶颈是产能,不过他对解决产能问题,充满信心“今年、明年、后年都会卡,但五年后一定能解决。”
今年4月开始,华为昇腾超节点(包括 950、A3、A2 系列)已陆续实现对 DeepSeek V4-Pro 和 V4-Flash 的全栈支持。通过融合 Kernel 优化和多流并行技术,在 8K 输入场景下,昇腾 950 单卡 Decode 吞吐可达 4700 TPS(V4-Pro)和 1600 TPS(V4-Flash),显著降低时延 。
而且,更让我们激动的是,AI芯片自研赛道,并不仅仅只有华为一个玩家,目前来看,大有春色满园关不住之势,阿里平头哥、寒武纪、百度昆化芯……这些都已经在国产芯片适配国产模型的道路上取得了一定的成果。
此前报道,百度基于旗下昆仑芯自研的“昆仑P800”加速卡的规模化集群已进入新版文心一言的训练试验,训练效率和能效比接近国际先进水平,进一步验证了昆仑芯在训练场景的可用性。
据钱江晚报7月23日报道,真武M890超节点已成功适配Qwen3.8,并上线阿里云百炼平台提供模型推理服务,这是国内首个成功运行超2万亿参数大模型的超节点。
Qwen3.8是阿里最新旗舰模型,参数规模高达2.4万亿,跑通这一规模的模型需要将参数分散到几十张甚至上百张高速互联的GPU卡,让万亿参数“跑得又稳又快”。然而,普通AI集群因通信带宽的局限,无法满足高吞吐、低延迟、高并发的需求。
据悉,真武M890是平头哥自研的新一代训推一体AI芯片,原生支持FP32到FP4等多种数据精度,可应用于高精度训练、低精度和超低精度推理的全场景。阿里还从芯片到云平台层面实现了与Qwen模型的全链路优化,不仅可以丝滑跑通Qwen3.8,还能显著提升推理效率、降低推理成本。
真武超节点实例通过ICN Switch 1.0互联芯片,让64张真武M890实现了800GB/s的高速互联,显存规模达到9TB,单实例即可支撑大规模2万亿参数MoE模型的专家并行需求。
……
曾几何时,美国的AI模型和AI芯片就像一座座高山,令无数企业胆寒,但偏偏有像梁文锋一样的勇士,像DeepSeek、华为们一样优秀的公司,凭“敢叫日月换新天”的魄力与胆识,成功趟出了国产替代的康庄大道~
“雄关漫道真如铁 ,而今迈步从头越”
胜利终将属于我们!
参考资料:
封面图源网
阿里云:真武芯片超节点已成功适配Qwen3.8,上线百炼提供推理服务-钱江晚报
梁文锋会议纪要更新:英伟达护城河正瓦解,华为超节点可完全平替-21世纪经济报道
线上配资提示:文章来自网络,不代表本站观点。