$SNDK HBF indica que sua largura de banda é equivalente aos 12,8 TB/s do HBM; ao mesmo tempo, cada GPU pode fornecer 4 TB de memória, enquanto o HBM tem apenas 192 GB, o que expande significativamente a capacidade de memória para inferência. Nos testes internos do Qwen3, um GPU HBF executou uma carga de trabalho que exigiria oito GPUs de HBM para ser concluída; e a saída de quatro GPUs HBF foi a mesma de oito. Isso significa ~8 vezes a eficiência de CAPEX e ~2 vezes a eficiência de GPU. Se esse desempenho puder ser mantido em larga escala, o HBF pode reduzir o número de GPUs necessários para inferência e mover o NAND para um nível de maior valor na pilha de memória para IA.