A empresa de tecnologia obtém vantagem de custo em inteligência artificial ao operar inferência com silício próprio, sem pagar margem a terceiros. Essa estratégia permitiu ao Google reduzir o custo de respostas centrais de IA em mais de 30% no primeiro trimestre de 2026, segundo dados financeiros.
A vantagem econômica reside no fato de que a empresa utiliza seu próprio silício e modelos, diferentemente de concorrentes que alugam GPUs da NVIDIA, pagando uma taxa de margem bruta de 75% por token processado. Em reunião do primeiro trimestre de 2026, Sundar Pichai declarou que o novo TPU 8i oferece “80% melhor desempenho por dólar que a geração anterior” em inferência.
A otimização de custos se reflete nos resultados financeiros. A receita do Google Cloud cresceu 63% para US$ 20,03 bilhões no trimestre, e a margem operacional da nuvem subiu para 32,9%. O lucro por ação (EPS) atingiu US$ 5,11, superando a expectativa de US$ 2,63, e a administração aumentou o dividendo em 5% para US$ 0,22 por ação.
A infraestrutura própria também atrai outras empresas. Anthropic, Character.AI e Perplexity utilizam TPUs para reduzir custos. Além disso, a empresa afirma que “estamos limitados por capacidade de computação no curto prazo”, indicando alta demanda pelo serviço de nuvem.

