Gemini chega aos data centers com o Google Distributed Cloud

A Google oferece às empresas a possibilidade de implementar localmente os seus modelos Gemini graças ao Google Distributed Cloud, eliminando o dilema entre inovação em IA e soberania dos dados.
1 de Setembro, 2025

A Google anuncia a disponibilidade geral do Gemini no Google Distributed Cloud (GDC) para ambientes isolados e a versão preliminar conectada, culminando o compromisso assumido no início do ano de que as organizações pudessem dispor de uma versão do Gemini para utilizar a IA em documentos e conteúdos que exigissem confidencialidade.

Este lançamento põe fim ao dilema que as organizações com requisitos de segurança rigorosos enfrentavam: adotar a IA mais recente, mas dependente de serviços na cloud prestados por outras empresas, ou salvaguardar a confidencialidade das informações críticas sem poder aceder à ajuda que a IA representa.

Para o desenvolvimento e teste desta solução, a Google contou com o apoio de várias organizações e empresas, como o Centre for Strategic Infocomm Technologies (CSIT) de Singapura, a agência GovTech do mesmo país, HTX, KDDI e Liquid C2, que testaram a solução e avaliam a possibilidade de trabalhar com modelos generativos sem retirar os dados das suas instalações.

Entre os casos de uso mencionados pelo Google, estão a tradução imediata de conteúdos para operações internacionais, a elaboração de resumos de documentos internos, a criação de assistentes virtuais que atendem funcionários e clientes a qualquer hora, ou o suporte ao desenvolvimento de software por meio da geração e revisão automática de código.

A implementação do Gemini é suportada por uma pilha completa de IA que o Google integra no GDC, combinando hardware, serviços de inferência e agentes pré-configurados. Para suportar as cargas de trabalho, a infraestrutura incorpora aceleradores NVIDIA Hopper e Blackwell e oferece um ponto de acesso totalmente gerido dentro do centro de dados do cliente. A distribuição automática do tráfego e o escalonamento sem intervenção garantem o desempenho e a disponibilidade do serviço.

A segurança é reforçada com registos de auditoria exaustivos, controlos de acesso detalhados e suporte de Computação Confidencial tanto em CPU (Intel TDX) como em GPU (NVIDIA). Desta forma, a plataforma ajuda as organizações a cumprir as normas regulamentares e a monitorizar em tempo real as transferências de dados que ocorrem dentro e fora do ambiente local de IA.

Além disso, a Google oferece aos responsáveis de TI flexibilidade para escolher modelos e ambientes de execução; juntamente com o Gemini 2.5 Flash e o Gemini 2.5 Pro, coexistem os modelos de finalidade específica do Vertex AI (tradução, OCR, reconhecimento de voz ou geração de embeddings) e as versões abertas do Gemma.

A GDC oferece máquinas virtuais A3 e A4 geridas, bem como clusters Kubernetes, o que permite executar modelos de código aberto ou desenvolvimentos próprios. Completa a proposta o Agentspace search (em pré-visualização), pensado para unificar as pesquisas nos dados on-premises.

Com esta iniciativa, a Google leva vantagem sobre os seus concorrentes norte-americanos, OpenAI e Antrophic, que ainda não dispõem de um modelo de negócio de «IA-on-premises», embora não sobre os concorrentes chineses, pois lembremos que modelos como o DeepSeek podem ser descarregados da rede na forma de software livre e, portanto, usados localmente, embora isso exija o trabalho de profissionais de informática.

Para os fabricantes de hardware para IA, como a própria NVIDIA, isso é algo que lhes interessa, pois significa abrir uma nova frente para as suas vendas, tendo em conta que continuarão a vender aceleradores a grandes empresas prestadoras de serviços de IA (como a própria Google e as já mencionadas OpenAI e Antrophic) para centros de dados que oferecem serviços a utilizadores finais e a empresas que não exigem uma privacidade excessiva dos seus dados e que podem permitir-se utilizar serviços públicos como o ChatGPT ou o ClaudeAI.

Opinião