BlockBeats News, 10 de agosto, segundo um relatório do LatePost, a plataforma aberta de MaaS da ZhiPu tem quase 7 milhões de usuários registrados, um aumento de cerca de 2 milhões desde o início de julho, e o número de clientes empresariais chegou a 23.000. O produto para desenvolvedores, o ZCode, ultrapassou 1 milhão de usuários em apenas um mês.O relatório afirmou que o ARR (Annual Recurring Revenue) da ZhiPu cresceu cerca de 15 vezes desde o início deste ano. Fontes do mercado revelaram que o ARR atual da ZhiPu pode chegar a 2 bilhões de dólares, mas esses dados não foram confirmados oficialmente.Com o rápido crescimento da demanda por inferência de modelos, a ZhiPu está expandindo sua infraestrutura de computação doméstica. Entende-se que a ZhiPu implantou mais de 50.000 chips de computação de IA produzidos domesticamente para lidar com a demanda crescente por inferência. Antes, havia rumores de mercado de que a ZhiPu teria construído uma infraestrutura de computação de IA produzida domesticamente com capacidade de 1GW.O crescimento da ZhiPu é impulsionado principalmente pelo aumento da demanda em cenários de programação. Após o lançamento do modelo GLM-5, o ARR da empresa cresceu rapidamente, e o negócio de API passou a se tornar a principal fonte de receita. A ZhiPu também está otimizando continuamente a eficiência da inferência, melhorando a utilização do poder de computação por meio de técnicas como divisão de cache KV e arquitetura de rede de inferência.Além disso, a ZhiPu lançou em julho uma versão de alta velocidade da API, com taxa de geração de tokens de 400 por segundo, aproximadamente 8 vezes mais rápida do que a API regular. Em 31 de julho, a empresa reabriu a compra do Coding Plan e ajustou significativamente os preços, com a mensalidade da versão Lite passando para 118 iuan.Profissionais do setor acreditam que, à medida que a demanda por programação com IA continua crescendo, otimizar a eficiência da inferência se tornará uma vantagem competitiva central para empresas de grandes modelos. Quem conseguir gerar mais tokens com a mesma capacidade de computação terá uma vantagem em termos de custos e comercialização.Atualmente, empresas chinesas de grandes modelos como ZhiPu, Kimi e DeepSeek enfrentam gargalos de capacidade de computação e pressão de competição de modelos. O mercado espera que várias empresas lancem uma nova geração de modelos em agosto, intensificando ainda mais a concorrência em grandes modelos de IA.
