$SNDK HBF 表示、その帯域幅はHBMの12.8 TB/sに相当し、同時に各GPUは4TBのメモリを提供するのに対し、HBMはわずか192GBです。これにより推論のメモリ容量が大幅に拡張されます。Qwen3の社内テストでは、1つのHBF GPUが、8つのHBM GPUでようやく完了できる作業負荷を処理しました。また、4つのHBF GPUの出力は8つの出力と同等であり、これは約8倍のCAPEX効率、約2倍のGPU効率を意味します。こうした性能が大規模に維持できるなら、HBFは推論に必要なGPU数を減らし、NANDをより価値の高いAIメモリスタックの層へ移行できます。