
Esta mudança marca um grande afastamento do modelo tradicional de loja dos primeiros tempos da Web, onde cada empresa geria o seu próprio sistema e as falhas eram contidas. Hoje, quando um LLM ou seu host em nuvem encontra problemas, o impacto se espalha rapidamente por dezenas e às vezes centenas de empresas dependentes em tempo actual. Isto foi claramente demonstrado em 2025, quando um importante fornecedor de LLM e a sua infraestrutura em nuvem enfrentaram interrupções. Por quase sete horas, os aplicativos alimentados por LLMs, que vão desde ferramentas legais de IA até chatbots de atendimento ao cliente e sistemas de decisão da cadeia de suprimentos, ficaram inoperantes. As perdas financeiras foram significativas e tangíveis: milhares de milhões perdidos em receitas e enormes custos para soluções de emergência.
As interrupções se tornam mais frequentes
É tentador descartar grandes falhas na nuvem ou LLM como eventos raros de cisne negro isso não se repetirá por anos. Mas isso é uma ilusão. Ao contar com alguns fornecedores de hiperescala para o poder computacional das aplicações empresariais, criamos pontos de falha centralizados nos nossos sistemas empresariais mais vitais. A conveniência e a relação custo-benefício dos LLMs de terceiros escondem uma verdade frágil: à medida que mais organizações dependem destes serviços partilhados para os seus dados, raciocínio e envolvimento, cada fornecedor torna-se um alvo maior para problemas operacionais, ataques cibernéticos, configurações incorretas ou bugs de software program.
Além disso, a procura de serviços LLM está a crescer rapidamente, ultrapassando os limites da infra-estrutura precise e aumentando o risco de sobrecarga. Os provedores também estão evoluindo rapidamente, colocando novos modelos e capacidades em camadas sobre complexos sistemas de nuvem legados. Isto cria um terreno instável sob o que muitos executivos esperam ser uma solução do tipo “definir e esquecer”.