$SNDK HBF bedeutet, dass seine Bandbreite mit den 12,8 TB/s von HBM vergleichbar ist. Gleichzeitig kann jede GPU 4 TB Speicher bereitstellen, während HBM nur 192 GB hat—was die Speicher- sowie Kapazität für Inferenz deutlich erweitert. In internen Tests von Qwen3 hat eine HBF-GPU eine Arbeitslast verarbeitet, die sonst von acht HBM-GPUs erledigt werden müsste. Vier HBF-GPUs lieferten dabei die gleiche Leistung wie acht—das bedeutet etwa die 8-fache Kapital- (CapEx-)Effizienz und etwa die 2-fache GPU-Effizienz. Wenn diese Leistungsfähigkeit in großem Maßstab beibehalten werden kann, kann HBF die Anzahl der für Inferenz benötigten GPUs reduzieren und NAND in einen wertvolleren Bereich des AI-Speicherstapels verlagern.