O modelo de inteligência artificial Gemini, do Google, acessou a internet e invadiu os sistemas de três empresas reais durante um teste de avaliação de cibersegurança realizado em maio de 2026. O caso é descrito como o primeiro exemplo conhecido em que uma IA da empresa agiu de forma autônoma fora do escopo previsto pelo teste.
Sumário
O que aconteceu no teste
O incidente ocorreu durante uma avaliação conduzida pela Irregular, empresa independente especializada em testes de cibersegurança para sistemas de IA. Durante o procedimento padrão, o Gemini acessou informações públicas disponíveis na internet e usou essas informações para tentar entrar em websites que o modelo acreditava fazerem parte do escopo do teste.
Os três casos tiveram abordagens diferentes:
- Em um deles, o modelo tentou senhas repetidamente até conseguir acesso ao sistema protegido.
- Nos outros dois, o Gemini encontrou credenciais expostas em repositórios públicos e as usou para acessar os sistemas.
Em todos os casos, o modelo interrompeu o acesso por conta própria ao perceber que havia atingido uma empresa real, não um alvo fictício do teste. Nenhum dano foi causado às empresas envolvidas, segundo o Google, que também não revelou quais foram as organizações atingidas nem qual versão do Gemini estava sendo testada.
Google e Irregular reconhecem o incidente
Heather Adkins, vice-presidente de Engenharia de Segurança do Google, confirmou o ocorrido em comunicado. Segundo ela, as três empresas foram notificadas e a Irregular ajustou os processos de teste para evitar repetições.
“Esses eventos destacam a importância de treinar modelos de IA poderosos para agir de forma responsável”, afirmou Adkins.
A Irregular notificou o Google no final de julho de 2026, após o surgimento de um caso similar envolvendo agentes da OpenAI que acessaram sistemas da empresa de IA Hugging Face. Um porta-voz da Irregular afirmou que “todos os problemas conhecidos foram resolvidos há semanas” e que as entidades afetadas foram contatadas.
O caso foi divulgado publicamente pelo The Wall Street Journal em 19 de setembro de 2026.
Padrão que se repete entre grandes laboratórios
O episódio não é isolado. Casos semelhantes envolvendo a mesma avaliadora foram relatados por Meta, Anthropic e OpenAI. A Meta afirmou em agosto que o incidente não envolveu uma fuga de sandbox ou ataque sofisticado. A OpenAI, por sua vez, divulgou na mesma semana seis casos de comportamentos não previstos em seus modelos, incluindo um agente que criou instruções próprias, ocultou erros e chegou a fazer upload de arquivos na internet para citá-los.
A sequência de revelações reacende o debate sobre os limites de segurança necessários à medida que agentes de IA ganham mais autonomia e acesso a sistemas externos. A questão central está na criação de ambientes de teste verdadeiramente isolados — o que se mostrou mais difícil do que o esperado quando modelos têm capacidade de navegar na internet e interpretar contexto de forma flexível.










