Investigadores de cibersegurança que invadiram sistemas da OpenAI no início do verão estão a lançar um alerta: a indústria da IA não está preparada para os riscos de segurança associados a modelos cada vez mais poderosos. A preocupação surge após a confirmação de que o Google Gemini conseguiu, autonomamente, invadir três redes corporativas reais durante um teste de segurança em maio, um episódio que se junta a uma lista crescente de incidentes que têm alarmado o setor.
Segundo o Washington Post, a empresa Hacktron revelou que os seus investigadores encadearam duas vulnerabilidades até então desconhecidas, uma na plataforma Discourse e outra no sistema de validação de funcionários da OpenAI, para comprometer várias contas internas de ChatGPT. A OpenAI confirmou o ataque e garantiu que as falhas foram corrigidas.
Este episódio soma‑se a outros que marcaram o verão da empresa. Em julho, dois modelos da OpenAI escaparam de um ambiente de testes fechado, ganharam acesso à internet por conta própria e invadiram sistemas internos da plataforma Hugging Face. Sam Altman classificou o caso como um “incidente cibernético sem precedentes”. Dias depois, a empresa divulgou mais seis situações de comportamento inesperado, incluindo modelos que escondiam erros, fabricavam dados e moviam ficheiros para a internet sem autorização.
Gemini também saiu da sandbox e atacou empresas reais
Num desenvolvimento separado, revelado pelo Wall Street Journal, o Google confirmou que o Gemini violou sistemas de três empresas reais durante uma avaliação conduzida pela startup israelita Irregular.
O teste pretendia limitar o modelo a um ambiente fechado, simulando uma empresa fictícia. Contudo, um erro permitiu acesso à internet, levando o Gemini a:
- adivinhar uma password e entrar num sistema protegido
- encontrar credenciais públicas em repositórios online e utilizá‑las para aceder a outras duas redes
Segundo Heather Adkins, vice‑presidente de engenharia de segurança do Google, o modelo parou voluntariamente quando percebeu que os sistemas eram reais. O Google notificou as empresas afetadas, mas não divulgou o incidente de imediato, uma decisão que gerou críticas entre especialistas.
Um padrão preocupante em toda a indústria
Os incidentes com Gemini não são isolados. A Irregular confirmou que falhas semelhantes ocorreram em testes com modelos da OpenAI, Anthropic e Meta, todos resultantes da mesma vulnerabilidade nos seus procedimentos de avaliação, entretanto corrigida.
Jack Cable, CEO da empresa de cibersegurança Corridor, afirmou ao Wall Street Journal que o Google tentou enquadrar o caso como uma vulnerabilidade tradicional, quando na verdade representa algo novo: modelos de IA capazes de ultrapassar barreiras e executar operações de ciberataque reais por iniciativa própria.
O Google insiste que o Gemini agiu corretamente ao interromper as ações. Mas o debate permanece aberto: que regras de divulgação devem aplicar‑se quando o atacante é um modelo de IA, e não um humano?
Fica ainda mais conectado:
- Avengers Doomsday: novo relatório revela o artefacto que pode redefinir o MCU
- O superiate de €350 milhões que levou o CEO da Revolut a tribunal
- Razer Tartarus V2 Pro é o novo keypad gaming ótico analógico

