Essa onda é realmente diferente! Enquanto os outros modelos soltam uma palavra de cada vez, nosso novo Nemotron-Labs-Diffusion já entra no modo paralelo, gerando vários tokens de uma vez, e sem pressa para travar a escolha de cada palavra.

É como fazer um upgrade de um processador de thread única para um de múltiplos núcleos, a velocidade de geração decolou #AI模型 #geração paralela