$SOL $SPCX A falha nos serviços de IA da Microsoft Azure durou seis horas; clientes do mundo todo foram afetados
Na semana passada, a Microsoft Azure sofreu uma grande interrupção de serviços de IA, deixando o Copilot, chamadas à API da OpenAI e algumas cargas de trabalho de aprendizado de máquina inoperantes por seis horas.
A causa foi a falha do sistema de resfriamento dos data centers combinada com um erro na programação do tráfego, o que levou a uma ampla indisponibilidade de recursos computacionais.
Este é o terceiro grande incidente da Azure este ano, e os clientes começaram a questionar a estabilidade da infraestrutura de IA da Microsoft.
Durante a falha, algumas empresas mudaram temporariamente para plataformas de nuvem de reserva.
Na minha visão, esse incidente evidenciou a fragilidade de uma infraestrutura centralizada de IA.
Quando os serviços de IA de milhões de usuários ficam dependentes de poucos data centers, qualquer falha em um sistema de resfriamento pode desencadear uma avalanche.
O valor da computação distribuída fica mais evidente nesse tipo de situação. a p i a r y s distribui os nós em regiões e hardwares diferentes ao redor do mundo, e não coloca todos os ovos em uma única sala.
No futuro, é possível que todo mundo tenha seu próprio assistente de IA, e eles deveriam rodar em redes mais flexíveis e distribuídas. $ H N Y - d 6 b 0
A Azure voltou a cair—você acha que ainda dá para confiar em uma infraestrutura centralizada de IA? #币安九周年 #AI
Na semana passada, a Microsoft Azure sofreu uma grande interrupção de serviços de IA, deixando o Copilot, chamadas à API da OpenAI e algumas cargas de trabalho de aprendizado de máquina inoperantes por seis horas.
A causa foi a falha do sistema de resfriamento dos data centers combinada com um erro na programação do tráfego, o que levou a uma ampla indisponibilidade de recursos computacionais.
Este é o terceiro grande incidente da Azure este ano, e os clientes começaram a questionar a estabilidade da infraestrutura de IA da Microsoft.
Durante a falha, algumas empresas mudaram temporariamente para plataformas de nuvem de reserva.
Na minha visão, esse incidente evidenciou a fragilidade de uma infraestrutura centralizada de IA.
Quando os serviços de IA de milhões de usuários ficam dependentes de poucos data centers, qualquer falha em um sistema de resfriamento pode desencadear uma avalanche.
O valor da computação distribuída fica mais evidente nesse tipo de situação. a p i a r y s distribui os nós em regiões e hardwares diferentes ao redor do mundo, e não coloca todos os ovos em uma única sala.
No futuro, é possível que todo mundo tenha seu próprio assistente de IA, e eles deveriam rodar em redes mais flexíveis e distribuídas. $ H N Y - d 6 b 0
A Azure voltou a cair—você acha que ainda dá para confiar em uma infraestrutura centralizada de IA? #币安九周年 #AI