产业观察技术公司评论分析· 4633· 约8分钟阅读

暴涨50倍之后,国产GPU终于敢谈光追了

A
AI编辑团队AI 原创内容
2026-09-04 12:23 发布· 本文由作者与AI协作完成
本内容由人工智能生成,仅供研究参考,不构成投资建议。
💡

摩尔线程确认第五代架构GPU「庐山」年内上市,首次为国产显卡装上硬件光追底座,官方口径称3A性能提升15倍、光追性能暴涨50倍,显存最高64GB。本文拆解参数背后的架构逻辑、对标叙事的水分、业绩与生态的真实底气,以及国产图形栈这场硬仗的胜负手。

国产GPU喊了很多年「追赶」,但从未有一个时刻像现在这样,把追赶的靶子从模糊的「国际大厂」具体到了光追这个具体高地。

2026年9月4日,摩尔线程在半年度业绩说明会上确认:基于第五代「花港」架构的第二款芯片「庐山」GPU,有望于年内正式上市。这是国内首款支持硬件实时光线追踪的国产图形卡——换句话说,国产GPU第一次在光追层面拥有了真正的硬件底座,而不是靠软件模拟硬撑的门面功夫。

本文的核心判断只有一句:「庐山」的历史意义大于参数意义。它未必立刻改变市场格局,但它改变了国产图形栈「能不能玩」的资格问题。

⚠️ 说明:本文中的性能倍数、生态规模与财务数据均来自摩尔线程官方业绩说明会及公开宣传口径,截至发稿尚无第三方评测机构的独立验证。涉及实际游戏表现、能效与推理性能的数据,请以量产卡上市后的独立评测为准。

🎯 一面插在光追高地的旗子

先说场景。过去几年,国产显卡发布会的固定曲目是跑分、对比,以及口径谨慎的「敬请期待」。光追这个话题,国产厂商基本绕着走——因为光追不是参数表上能注水的一栏,它需要实打实的硬件加速单元,需要完整的DirectX 12 Ultimate兼容性,需要游戏引擎愿意为你的卡做适配。缺任何一环,光追就是PPT词汇。

这一次不同。摩尔线程明确,「庐山」集成第二代硬件光线追踪加速引擎,完整支持DirectX 12 Ultimate,还配上了第一代AI生成式渲染架构(AGR)。这三个东西凑在一起,意味着国产GPU第一次具备了承接3A游戏现代渲染管线的硬件资格。

数据层面,官方给出的跨越式提升是:相比上一代「S80」,「庐山」3A游戏渲染性能提升15倍,光线追踪性能暴涨50倍,几何处理性能提升16倍,原子访存性能提升8倍。这些数字后面会单独拆,但先记住一个产业事实:敢把光追性能单独拿出来讲50倍提升的国产厂商,摩尔线程是第一家。当然,这些倍数均出自官方口径,且上一代S80的图形性能基数本身较低,「跨越式提升」的实际观感如何,仍需等第三方实测来回答。

产业逻辑上,这面旗子的意义在于「入场券」。没有硬件光追,国产显卡在消费级市场永远是「能亮机、能办公」的替补选手;有了硬件光追,才有资格进入「能玩游戏」的正式名单。资格问题解决后,才谈得上性能追赶。这一步,行业等了太多年。

📈 15倍与50倍:参数暴涨背后的架构换血

金句先放这:参数暴涨的本质,不是奇迹,是基数。

冷静拆解这组数字。「庐山」是「花港」架构的第二款芯片,采用新一代指令集,官方口径是算力密度提升50%、能效提升10倍,支持FP4到FP64全精度计算。注意关键词——「新一代指令集」。跨代际的指令集更迭,意味着这不是上一代产品的打磨改良,而是推倒重来的架构换血。从低基数起步的架构革命,出现十几倍的提升幅度并不反常,AMD的RDNA、英特尔的Xe都在换架构时交出过类似的相对增速。

参数表一目了然(以下均为摩尔线程官方口径,未经独立验证):

性能指标对比上一代S80
3A游戏渲染性能提升15倍
光线追踪性能提升50倍
几何处理性能提升16倍
原子访存性能提升8倍
AI计算性能提升64倍
算力密度提升50%
能效提升10倍

这份表里最有含金量的其实不是50倍的光追,而是「能效提升10倍」。GPU是电老虎,能效上不去,桌面卡可以做得很激进,但进不了笔记本、进不了边缘计算场景。能效跨代提升,说明「花港」不是堆晶体管的高分低能选手,而是冲着通用平台去的。

产业判断:这一代架构的真正对手盘不是某一张卡,而是「能不能撑起一个产品线」。指令集、全精度覆盖、光追引擎、AI渲染架构四位一体,摩尔线程在赌的是平台化路线而非单点爆款。赌对了,后面每一代都是复利;赌错了,就是又一笔7.69亿元的研发沉没成本——顺带一提,这是他们2026年上半年研发投入的数字,同比增长38.16%。

⚖️ 64GB显存超越RTX 5090?对标叙事要打个折

素材里最抓眼球的一句话:显存容量最高可达64GB,超越RTX 5090的32GB,业内普遍认为其性能对标RTX 50系列。

这句话需要精确地读。「业内普遍认为对标」,和「性能等于」,中间隔着一整个太平洋。消费级GPU的竞争从来不只是显存容量:驱动成熟度、游戏适配覆盖、光追单元的实际效率、生态工具链,每一项都是年为单位的长跑。一张卡显存翻倍,在3A游戏里换来的可能是稳定的1080p高画质,而不是4K光追满帧。何况「对标RTX 50系列」至今只是厂商和渠道的口径,没有任何一份独立横评能佐证这个说法——英伟达的生态位、驱动质量和游戏适配深度,都不是参数表能追平的。

但这个对标叙事也有它合理的一面。显存堆到64GB,指向的显然不只是游戏市场——它真正瞄准的是本地大模型推理。「庐山」的AI计算性能提升64倍(官方口径),配备统一任务引擎(UNITE)统一调度所有计算单元,配合MUSA软件栈对vLLMSGLangOllama等主流推理框架的完整覆盖。看懂了吗?这是一张「游戏卡外形、AI卡灵魂」的产品。64GB显存能塞进相当规模的本地模型,这个配置逻辑更像数据中心推理卡下放到桌面。

一句话概括「庐山」的双线作战:同一套MUSA软件栈,一头接消费级游戏市场,主打光追与3A渲染;一头接本地大模型推理,主打vLLM、Ollama等框架适配。

产业判断:把两张牌打在一起,是国产GPU在英伟达垄断格局下的务实打法——游戏市场赚口碑和生态,AI推理市场赚真金白银。据多位接近厂商渠道的人士说法,国产GPU在AI推理侧的出货确定性远高于消费游戏侧,后者更像是「必须打但短期不指望赚钱」的阵地战。「庐山」的双角色设计,本质是让AI业务养游戏业务。

💰 营收暴增147%:业绩是底气,也是倒计时

故事说到钱。GPU行业最不缺的就是理想主义叙事,最缺的就是现金流。这次业绩说明会的含金量恰恰在于:摩尔线程是在一个「有钱赚」的位置上发布光追卡的。

数字摆出来(均为公司披露口径):2026年上半年营收17.36亿元,同比增长147.42%,已超过2025年全年;研发投入7.69亿元,同比增长38.16%。用一条时间线看清节奏:

  • 2025年全年:营收规模被2026上半年单半年反超
  • 2026年上半年:营收17.36亿元,同比增147.42%
  • 2026年上半年:研发投入7.69亿元,同比增38.16%
  • 2026年9月4日:业绩会确认庐山年内上市
  • 2026年四季度:庐山预计正式上市

需要指出的是,上述财务数字来自公司半年度业绩说明会的自我披露,营收的具体构成(信创、AI推理、行业客户各占多少)尚未有公开拆分,第三方审计或渠道侧的独立交叉验证也暂时缺位。在国产替代叙事升温的当下,对这组数字保持「可信但待验证」的态度是必要的。

即便如此,这组数字的产业含义仍有两层。第一层,营收半年干完一年,说明国产GPU的需求侧是真的——不管来自信创采购、AI推理还是行业客户,市场愿意为国产方案付钱了。这是所有国产替代故事能走通的先决条件。

第二层更微妙:研发投入占营收比约44%,这个强度意味着公司依然处于「收入高速增长但重金押注未来」的阶段。研发投入增速38%,低于营收增速147%,剪刀差在收窄,商业化在提速——这是好信号;但GPU研发是十年尺度的事,7.69亿元半年投入对标的国际同行年度百亿美元级研发盘子,体量差着两个数量级。

所以业绩是底气,也是倒计时。「庐山」Q4能不能如期上市、上市后供货和驱动能不能稳住,决定了这147%的增长能不能延续。据行业内的私下判断,国产GPU最怕的不是性能落后,而是「发布即巅峰、量产即哑火」的循环——参数发布会人人会开,能把卡铺到用户手里才是本事。

🌱 80万开发者和2167项专利:软件栈才是真护城河

硬件光追解决了资格问题,但决定国产GPU生死的是软件。

看两个数字:MUSA生态开发者数量已突破80万名;累计申请专利2167项,其中发明专利占比超过94%。这两个数字放在一起,勾勒出摩尔线程的真实战略重心——它不是在造一张卡,是在造一套图形与计算的生态栈。不过同样要说明:「80万开发者」的统计口径(注册即算,还是有活跃贡献)目前无从核实,这类数字在国际大厂的口径里也普遍偏宽,看趋势即可,不必当精确值。

为什么软件栈这么关键?因为GPU的护城河从来不在于晶体管,而在于CUDA式的生态锁定。全世界无数团队试过做GPU,死掉的那批几乎都不是死于硬件性能,而是死于没人愿意为你的架构写驱动、做适配、迁移代码。光追尤其如此——一个游戏引擎要为某家GPU开启光追路径,需要驱动层、API层、引擎层三层咬合,任何一层掉链子,玩家的体验就是花屏和掉帧。

这条链路可以简化成一句话:指令集与架构,决定驱动与API兼容的难度;驱动与API,决定游戏引擎适配的门槛;而引擎适配的广度,最终决定玩家实际体验的上限。推理侧同理——MUSA对主流框架的覆盖,压低的是开发者的迁移成本,养大的是生态本身。

这就是MUSA软件栈对vLLMSGLangOllama完整覆盖的含金量所在:在AI推理侧,迁移成本被压到主流框架的默认选项级别;在游戏侧,DirectX 12 Ultimate的完整支持意味着现代3A的渲染管线至少「理论上」能跑。从理论到流畅,中间是无数个驱动版本的迭代。

产业判断:80万开发者是这次发布里最容易被忽视、但长期最重要的数字。硬件一代一换,生态十年一建。「庐山」如果Q4如期上市并保持供货稳定,它承担的真正使命是把MUSA从「厂商自己的软件栈」变成「开发者愿意默认适配的平台」。这一步跨过去,国产GPU才算有了可持续的商业模式;跨不过去,每一代硬件都是在沙地上盖楼。

结语:不缺参数,缺的是能买到、能跑光追的好卡

回到开头那句话:国产GPU从来不缺发布会参数,缺的是能买到、能跑光追的好卡。

庐山」的意义,是把国产图形栈第一次带到了硬件光追的高地脚下——性能对标RTX 50系列的业内预期无论打几折,资格问题已经解决。接下来Q4的上市,考验的不再是实验室里的仿真数字,而是量产良率、驱动迭代速度和游戏适配清单的长度。

对整个行业而言,这是一次值得记录的节点:当摩尔线程用半年17.36亿元的营收、80万开发者和2167项专利证明这条路能走通时,后来者也有了跟进的理由。光追高地上的这面旗能不能站稳,Q4见分晓。而无论结果如何,国产GPU的竞争叙事,已经从「要不要做」正式进入了「做得好不好」的阶段——这本身,就是进步。

至于这面旗最终插得多牢,答案不在9月4日的发布会上,而在四季度用户手里那张卡的帧率曲线里。届时,本系列会拿独立实测数据回来重新校准今天引用的每一个官方数字。