¡NVIDIA está trabajando a toda velocidad para desarrollar al menos un modelo de código abierto Nemotron 4 de 10 billones de parámetros, con el objetivo de reducir la dependencia de grandes clientes como OpenAI y de los gigantes de la nube! La empresa no solo ha aumentado en gran medida su promesa de potencia de cómputo del servicio en la nube hasta 28 mil millones de dólares mediante el servicio de retroarriendo de servidores, sino que también ha creado la «alianza Nemotron», un ecosistema de co-construcción que incluye a Mistral, Cursor y otros. Las acciones de NVIDIA en el premercado de EE. UU. suben cerca de un 2%.
NVIDIA apuesta con fuerza por desarrollar modelos de inteligencia artificial de código abierto propios, intentando ampliar así la demanda de GPU. Aunque esta estrategia también la coloca en una situación delicada: compite directamente con sus propios clientes y con sus empresas de inversión.
The Information informó el día 11 que el objetivo de NVIDIA es llevar el rendimiento de la versión más grande de Nemotron 4 a un nivel comparable con los mejores modelos de código abierto del mundo. Varios empleados revelaron que el número de parámetros de este modelo se espera que sea de al menos 1 billón, aproximadamente el doble de su modelo máximo actual Nemotron 3 Ultra. En un correo electrónico, el vicepresidente de IA generativa de NVIDIA, Kari Briski, dijo: "Invertimos en Nemotron porque creemos que cada empresa y cada país necesita modelos de código abierto de vanguardia que sean accesibles".
La demanda actual de chips de NVIDIA se concentra mucho en un puñado de laboratorios de vanguardia y proveedores de servicios en la nube como OpenAI, Microsoft y SpaceX, y dichas entidades están posicionándose cada vez más para desarrollar chips de IA propios. El impulso de Nemotron 4 busca ampliar la base de demanda hacia un público de usuarios empresariales más amplio, reduciendo así la dependencia de NVIDIA de sus clientes líderes. Anastasios Angelopoulos, director ejecutivo de la firma de evaluación de modelos de IA Arena, dijo: "Sea cual sea la compañía que haga un excelente modelo de código abierto, NVIDIA es quien gana".
Las acciones de NVIDIA en la preapertura en el mercado de valores de EE. UU. suben cerca de un 2%.

Objetivo de mil millones de parámetros; inversión en capacidad de cómputo se triplica
Según varios empleados involucrados en el proyecto Nemotron, el modelo Nemotron 4 de mayor escala que planea desarrollar NVIDIA tendrá al menos 1 billón de parámetros, aproximadamente el doble del modelo máximo actual Nemotron 3 Ultra que se lanzó este junio. El tamaño de parámetros de este modelo seguirá estando muy por debajo de los principales modelos de código abierto de China, pero NVIDIA también subraya que su tecnología de compresión permite que modelos más pequeños logren un rendimiento sobresaliente.
En términos de inversión en capacidad de cómputo, la determinación de NVIDIA se refleja en una expansión significativa de sus compromisos de financiación. Según se informa, la empresa obtiene capacidad de cómputo alquilando servidores de IA a través de proveedores de servicios en la nube que compran sus chips. A abril de este año, el valor total de los compromisos plurianuales de NVIDIA con servicios en la nube ya se ha incrementado a 28.000 millones de dólares a principios de 2031, aproximadamente tres veces la cifra divulgada un año antes. De ese total, el gasto correspondiente a este año fiscal (hasta enero de 2028) es de alrededor de 7.000 millones de dólares, bastante inferior al nivel de inversión de OpenAI y Anthropic, pero ya supera el total de financiación histórica de la gran mayoría de los principales laboratorios de código abierto de Estados Unidos y China.
En cuanto al tamaño del equipo de desarrollo, el proyecto Nemotron también sigue ampliándose. Los autores firmantes del artículo de investigación del último modelo importante de NVIDIA llegaron a 570 personas, y varios empleados dijeron que el número de participantes en Nemotron 4 será mayor. "Ahora todo el mundo quiere unirse", dijo un ex empleado.
Conformar la "Alianza Nemotron" y atraer socios del ecosistema de código abierto
Para acelerar el desarrollo de Nemotron 4, NVIDIA ha construido una red de colaboración llamada "Alianza Nemotron". Sus miembros incluyen desarrolladores de código abierto como Reflection, Cursor, Thinking Machines y Mistral. Mientras cada parte impulsa sus propios proyectos de modelos, también contribuyen a Nemotron 4 con datos de entrenamiento, soporte de evaluación y propuestas de diseño de modelos.
Además, según reveló una persona directamente involucrada en la colaboración, la startup de entrenamiento de modelos Prime Intellect aportó 300.000 entornos simulados a este proyecto para apoyar el entrenamiento del modelo. La startup de herramientas de programación de IA Cognition también forma parte de los miembros de la alianza. Fuentes informadas señalan que la empresa ya ha entablado conversaciones con NVIDIA para proporcionarle datos de entrenamiento de código, pero la colaboración relevante aún no se ha anunciado oficialmente al público.
Las motivaciones de participación de los miembros de la alianza son diferentes. Algunas empresas quieren ampliar su cuota de mercado aprovechando el impulso que NVIDIA da al ecosistema de código abierto; otras esperan influir, a un costo menor, en la dirección del desarrollo de un modelo de alta calidad que puedan utilizar, evitando así la presión de asumir por sí mismas los costos de entrenamiento de capacidad de cómputo. Vincent Weisser, CEO de Prime Intellect, define esta alianza como una acción colectiva para contrarrestar la monopolización de un único "modelo de dios", en lugar de un juego de suma cero por el título del mejor modelo de código abierto.
Se difumina la frontera entre clientes y competidores
Nemotron 4 impulsa a NVIDIA en una sutil tensión estructural. Por un lado, OpenAI ha sido durante mucho tiempo un importante motor de la demanda de los chips de NVIDIA, y NVIDIA ya ha invertido 30 mil millones de dólares en ella; por otro lado, la posición de Nemotron 4 consiste precisamente en ofrecer a las empresas una alternativa más barata, compitiendo con el modelo de negocio de laboratorios de vanguardia como OpenAI. Al mismo tiempo, empresas incluidas en la alianza, como Reflection AI y Thinking Machines, también son startups de código abierto en las que NVIDIA ya ha invertido.
Sin embargo, para NVIDIA, esta lógica competitiva no necesariamente es un juego de suma cero. Anastasios Angelopoulos, director ejecutivo de Arena, una firma de evaluación de modelos de IA, señaló: "Sea cual sea la compañía que haga un excelente modelo de código abierto, NVIDIA es quien gana". La lógica central de NVIDIA es que cuanto más próspero sea el ecosistema de código abierto y cuanto más diverso sea el conjunto de participantes, mayor será la demanda total de GPU.
Actualmente, los modelos de la serie Nemotron ya han logrado cierta adopción en el mercado. En junio, Palantir anunció una colaboración con NVIDIA para utilizar modelos Nemotron con clientes del gobierno de Estados Unidos. Pero según datos de pruebas de referencia de organizaciones como Arena y Artificial Analysis, el modelo máximo actual de NVIDIA, Nemotron 3 Ultra, solo ocupa el segundo lugar entre los modelos de código abierto en Estados Unidos, después del modelo Inkling recién publicado por Thinking Machines, y en el ranking global de modelos se encuentra incluso fuera del top 40.
El cronograma de lanzamiento sigue sin estar claro
Aunque la escala del proyecto es enorme, sigue existiendo una gran incertidumbre sobre la fecha de lanzamiento de Nemotron 4. Varios empleados dijeron que NVIDIA ya ha tomado algunas decisiones sobre los datos de preentrenamiento y la arquitectura, pero aún no ha confirmado finalmente las especificaciones y la fecha de lanzamiento; la fase final de entrenamiento tampoco ha comenzado, y se estima que tardará varios meses. Dos empleados creen que el modelo podría lanzarse a más tardar a finales de este otoño, mientras que otros empleados consideran que el tiempo podría ser aún más tarde.
Al mismo tiempo, NVIDIA ya publicó esta semana una versión más pequeña de la serie Nemotron: Nemotron 3.5 Lightning, que se enfoca en ejecutar tareas de agentes de IA con la mayor rapidez y eficiencia posible. NVIDIA también lanzó de manera simultánea un software de enrutamiento de modelos gratuito para ayudar a las empresas a construir de forma más conveniente herramientas de enrutamiento de modelos personalizadas, asignando automáticamente tareas específicas de IA al modelo más óptimo y económico para su procesamiento.
En un podcast en enero de este año, Bryan Catanzaro, vicepresidente de investigación de aprendizaje profundo de NVIDIA, dijo que invertir en Nemotron"es crucial para el futuro de nuestra empresa". El CEO de NVIDIA, Huang Renxun, también manifestó públicamente su apoyo al código abierto el mes pasado en un correo, afirmando que los modelos de código abierto "promueven la seguridad, la ciberseguridad, el avance científico y la seguridad nacional".
