$SNDK HBF означает, что его пропускная способность сопоставима с 12,8 ТБ/с у HBM; при этом каждый GPU может предоставить 4 ТБ памяти, тогда как HBM имеет только 192 ГБ. Это значительно расширяет объем памяти для вывода (inference). Во внутренних тестах Qwen3 один HBF GPU выполнял рабочую нагрузку, которую обычно требовали восемь HBM GPU, а результаты четырех HBF GPU соответствовали результатам восьми. Это означает ~в 8 раз более высокую капиталоэффективность (CAPEX) и ~в 2 раза более высокую эффективность GPU. Если такая производительность сможет масштабироваться и сохраняться, то HBF может сократить количество GPU, необходимых для вывода, и переместить NAND в более ценную для AI-стек памяти область.