资讯🔥7.0

2大关键处仍被卡:国产AI芯片还在追赶3年前的NVIDIA显卡

驱动之家·2026/9/6 13:38:00🔗 原文

📋总体概括

国产AI芯片与英伟达的差距依然显著。在FP16算力与内存带宽两大核心指标上,国产最强的华为昇腾910C算力约780TFLOPS、带宽780GB/s,带宽虽超H100,但算力远不及3年前的H200(1700TFLOPS、900GB/s)。华为已推出更新的昇腾950,采用自研高性能内存,带宽提升至4TB/s。背景是OpenAI GPT-6 Astra用10万卡训练、仅显卡费用约60亿美元,凸显算力差距对国内大模型的制约。华为、寒武纪、壁仞、摩尔线程及互联网大厂均在投入自研,但追赶仍需时间。

关键信息

  • OpenAI GPT-6 Astra首次使用10万卡训练,仅显卡费用就约60亿美元,凸显算力规模壁垒
  • 国产最强的昇腾910C算力780TFLOPS、带宽780GB/s,带宽超H100但算力差距大
  • 3年前的H200为1700TFLOPS、900GB/s,国产AI芯片尚难追平其性能
  • 华为新一代昇腾950采用自研高性能内存,带宽已达4TB/s
  • 华为、寒武纪、壁仞、摩尔线程及百度阿里字节腾讯等均在研发AI芯片

🔥犀利点评

带宽追平、算力掉队,这是典型的单点突破式宣传叙事——内存带宽好堆,依赖的是自研互连;FP16算力背后是制程和架构的硬差距,被卡脖子的恰恰是最难啃的部分。拿3年前的H200当标杆本身就说明问题:人家已经跑到下一个周期了。昇腾950的4TB/s值得肯定,但算力数据避而不谈,多少有点报喜藏忧。国产芯片的真正出路不在跑分表,而在集群效率和软件生态。

本文由本站自动聚合,以下为原始来源:前往 驱动之家 阅读全文