资讯🔥8.0
2大关键处仍被卡:国产AI芯片还在追赶3年前的NVIDIA显卡
📋总体概括
OpenAI发布首个使用10万卡训练的GPT-6 Astra大模型,仅显卡费用就达60亿美元,凸显中美算力差距。国内华为、寒武纪、壁仞及云厂商均在研发AI芯片,但对比内存带宽与FP16算力两大核心指标,国产最强的华为昇腾算力为780TFLOPS、带宽780GB/s,带宽超过H100,算力仍远落后于H200的1700TFLOPS。最新昇腾950已用自研内存将带宽提升至4TB/s。
⚡关键信息
- ▸OpenAI的GPT-6 Astra是首个用10万卡训练的大模型,显卡费用高达60亿美元
- ▸国产AI芯片受算力短缺制约,华为、寒武纪、壁仞、摩尔线程及百度阿里字节腾讯等均投入自研
- ▸昇腾算力达780TFLOPS、带宽780GB/s,带宽超H100,但算力距H200的1700TFLOPS仍有较大差距
- ▸内存带宽与FP16算力是大模型训练推理的核心瓶颈指标,国产在两大关键处仍被卡
- ▸华为最新昇腾950采用自研高性能内存,带宽已提升至4TB/s,优于昇腾910C
🔥犀利点评
60亿美元买10万张卡,这笔账本身就说明了游戏规则——AI竞赛本质是算力军备赛,模型层面的追赶再热闹,底层芯片追不上就是空转。昇腾带宽反超H100算是唯一亮点,但FP16算力连三年前的H200都摸不到,单点突破掩盖不了整体代差。950的4TB/s带宽若属实值得肯定,可别再拿一两个指标刷存在感,训练生态、互联规模、良率才是真正的生死线。
📰 相关资讯(与本文相关的其他资讯)
本文由本站自动聚合,以下为原始来源:前往 驱动之家 阅读全文 →