Fuente de la reimpresión del artículo: La tendencia de la IA
Este artículo se publicó por primera vez en la aplicación Titanium Media, autor: Lin Zhijia
Según los informes del 6 de octubre, OpenAI, la empresa estadounidense de IA detrás de ChatGPT, planea desarrollar sus propios chips de IA. Ha estado llevando a cabo discusiones internas desde el año pasado e incluso ha comenzado a evaluar posibles objetivos de adquisición de empresas de chips de IA para resolver la escasez. de chips de IA de los que depende y altos costos.
Según los informes, el equipo de OpenAI cree que existen tres opciones de adquisición de potencia informática de modelos grandes de IA, incluida la construcción de sus propios chips de IA, una colaboración más estrecha con empresas de chips como NVIDIA y la planificación para diversificar el suministro de chips fuera de NVIDIA: lo último. El objetivo es superar Beyond Nvidia.
Ya en 2022, el director ejecutivo de OpenAI, Sam Altman, se quejó públicamente de la escasez de chips GPU de Nvidia y dijo que la empresa estaba gravemente limitada por las GPU.
Dado que NVIDIA domina el 95% del mercado mundial del campo de entrenamiento de IA, a medida que las tarjetas gráficas GPU (unidad de procesamiento de gráficos) de NVIDIA se vuelven escasas y los costos de la potencia informática de la IA continúan aumentando, incluso el poderoso OpenAI está buscando nuevas soluciones para evitar quedarse "atascado" en mucho tiempo".
Sam Altman, director ejecutivo de OpenAI
Los costos de la energía informática se disparan, OpenAI busca personalizar los chips de IA
Desde 2023 hasta ahora, la "locura" de los grandes modelos de IA representados por ChatGPT se ha extendido por todo el mundo, y los grandes modelos están promoviendo el desarrollo de la IA en una dirección más general. La escasez y el coste de la potencia informática se han convertido en factores fundamentales que restringen el desarrollo de la IA.
Actualmente, NVIDIA ocupa el 82% del mercado global de aceleración de IA de centros de datos y monopoliza el mercado global de capacitación de IA con una participación de mercado del 95%, convirtiéndose en el mayor ganador en esta ronda de lucha cuerpo a cuerpo de IA. Como fundador y director ejecutivo de la empresa, Huang Renxun ha ganado mucho dinero. El valor de mercado de la empresa supera el billón de dólares y su patrimonio neto llega a los 39.900 millones de dólares.
Al mismo tiempo, el aumento de la demanda de potencia informática también ha dificultado la búsqueda de tarjetas GPU NVIDIA. La cantidad de tarjetas gráficas NVIDIA A100 se ha convertido en un estándar para medir la potencia informática de una empresa.
Según las estadísticas, OpenAI utiliza entre 10.000 y 30.000 GPU NVIDIA para entrenar el modelo GPT-3.5. Un informe de TrendForce muestra que, si se calcula en función de la potencia de procesamiento de las tarjetas gráficas NVIDIA A100, la ejecución de ChatGPT puede requerir el uso de 30.000 tarjetas gráficas NVIDIA GPU.
En términos de precio, el precio del H800 actualmente disponible en China ha llegado a 200.000/pieza, mientras que el precio del A100/A800 ha aumentado a alrededor de 150.000 y 100.000/pieza. Tomando como ejemplo el requisito de potencia informática de 2000P, la GPU H800 tiene una potencia informática de una sola tarjeta de 2P y requiere 1000 tarjetas. El costo estimado de la tarjeta es de 200 millones de yuanes; la tarjeta única A800 tiene una potencia informática de aproximadamente 0,625P y requiere 3200; tarjetas El costo estimado de la tarjeta es de hasta 320 millones de yuanes.
Además de comprar una tarjeta gráfica GPU, el servidor también debe considerar la configuración y el cálculo de toda la máquina, incluida la CPU, el almacenamiento, las conexiones de comunicación NV-Link, etc., así como factores como el consumo de energía, el alquiler del sitio, y los costos de operación y mantenimiento, el costo total supera los 600 millones de yuanes, y la súper costosa supercomputadora OpenAI de Microsoft, que cuesta cientos de millones de dólares y utiliza decenas de miles de chips NVIDIA, se está utilizando para el entrenamiento de potencia informática.
Sin embargo, desde que OpenAI anunció su negocio de nube empresarial GPT, la relación entre Microsoft y OpenAI se ha ido alejando. Las noticias muestran que Microsoft también está desarrollando chips de IA personalizados.
De hecho, no se trata solo de OpenAI. En esta ola de demanda de potencia informática, los principales gigantes tecnológicos como Google, Amazon, Microsoft y Meta han estado diseñando chips de IA para sus negocios. Por ejemplo, los últimos teléfonos móviles de la serie Pixel 8 de Google utilizan el chip Google Tensor G3 y el coprocesador Titan M2, los cuales son productos de desarrollo propio de Google, y el último chip de CPU de servidor ARM desarrollado por Amazon, Graviton 3E, también se utiliza en su; Negocio en la nube de AWS entre.
Sin embargo, OpenAI no tiene experiencia en el desarrollo de chips de IA. Se necesitan al menos dos años para que un chip pase del establecimiento del proyecto a la producción en masa. No está claro si OpenAI continuará avanzando en el plan de chips personalizados, y la efectividad del chip permanece. para ser probado a lo largo del tiempo.
Reuters citó a expertos de la industria diciendo que se trata de una inversión enorme y que los costos anuales de investigación y desarrollo pueden alcanzar cientos de millones de dólares. Al mismo tiempo, OpenAI está considerando adquirir algunas empresas de chips de IA para acelerar el proceso de desarrollo propio de chips.
Pero personalizar los chips de IA puede llevar años, lo que significa que OpenAI seguirá dependiendo de proveedores de chips como Nvidia y AMD durante mucho tiempo.
Curiosamente, The Information informó el 4 de octubre que Meta dejó de personalizar los chips VR/AR y que el equipo se disolvió, utilizando en su lugar chips de procesador proporcionados por Qualcomm.
Por lo tanto, todavía se necesita tiempo para probar si el chip de IA personalizado de OpenAI finalmente estará disponible.
Otras noticias muestran que SoftBank planea invertir mil millones de dólares para establecer una nueva empresa de hardware de IA con Ultraman, y el diseñador de Apple Jony Ive también está en conversaciones con Ultraman para crear un nuevo producto de hardware de IA.
La competencia en el mercado de modelos grandes se intensifica a medida que Google y Amazon pasan a competir con OpenAI
Apenas unos días después de que Amazon anunciara su inversión, se informó que el competidor de OpenAI, la empresa unicornio de inteligencia artificial (IA), Anthropic, estaba refinanciando.
Según un informe de The Information del 4 de octubre, Anthropic, fundada hace sólo dos años, está negociando con Google y otros inversores y planea completar una nueva ronda de financiación de al menos 2.000 millones de dólares estadounidenses (aproximadamente 14.394 millones de RMB). La valoración posterior al dinero puede alcanzar entre 20.000 y 30.000 millones de dólares, más de cinco veces la valoración de la empresa de 4.000 millones de dólares en marzo de este año.
Posteriormente, la competencia en el mercado de modelos grandes de IA se intensificó, y Google y Amazon también comenzaron a prestar atención y diseñar a los competidores de OpenAI.
Se informa que la empresa Anthropic AI fue fundada en 2021 por Dario Amodei, ex vicepresidente de investigación de OpenAI, Tom Brown, primer autor del artículo GPT-3, y otros. En ese momento, los investigadores liderados por Amodei abandonaron OpenAI después de desacuerdos sobre la dirección de la compañía, temiendo que la inversión de Microsoft en OpenAI la llevara por un camino más comercial, alejándose de las ideas originales de la compañía.
En diciembre de 2022, el equipo de Anthropic publicó un artículo titulado "IA constitucional: inofensividad a partir de comentarios de IA" en arxiv, que describe un modelo AnthropicLM v4-s3 basado en entrenamiento no supervisado con 52 mil millones de parámetros, comparando directamente el modelo OpenAI GPT-3.
En enero de este año, Anthropic lanzó Claude, un nuevo producto modelo de chatbot de IA basado en AnthropicLM v4-s3, que se considera un fuerte competidor de ChatGPT.
El 4 de febrero de este año, Google Cloud, la división de computación en la nube de Google, anunció una nueva asociación con Anthropic. También se informó que Google invirtió casi 400 millones de dólares (aproximadamente 2.030 millones de RMB) en Anthropic. La nueva financiación permitirá a Anthropic. La inversión en valoración aumentó a casi 5 mil millones de dólares.
Antes de la inversión de Google, Anthropic había recaudado más de 700 millones de dólares en financiación, entre cuyos inversores se encontraba Alameda Research, un fondo de cobertura de criptomonedas establecido por el fundador de FTX, SBF. Una de las razones por las que Google invirtió en Anthropic es que el director ejecutivo de la empresa ha expresado repetidamente la amenaza y el impacto de ChatGPT en sus búsquedas, publicidad y otros negocios.
Según The Information, Anthropic dijo a los inversores que los ingresos anuales de la compañía han sido de alrededor de 100 millones de dólares antes, pero debido a su profunda cooperación con Amazon, se espera que sus ingresos aumenten significativamente en 2023, alcanzando los 200 millones de dólares, con ingresos mensuales. acercándose a los 17 millones de dólares; para finales de 2024, Anthropic espera tener unos ingresos anuales de 500 millones de dólares, que es 1/200 veces la valoración de Anthropic y mucho más alto que el múltiplo de valoración de OpenAI.
