Google Gemini e ChatGPT envolvidos em ataques reais que preocupam empresas

Investigadores de cibersegurança que invadiram sistemas da OpenAI no início do verão estão a lançar um alerta: a indústria da IA não está preparada para os riscos de segurança associados a modelos cada vez mais poderosos. A preocupação surge após a confirmação de que o Google Gemini conseguiu, autonomamente, invadir três redes corporativas reais durante um teste de segurança em maio, um episódio que se junta a uma lista crescente de incidentes que têm alarmado o setor. 

- Advertisement -

Segundo o Washington Post, a empresa Hacktron revelou que os seus investigadores encadearam duas vulnerabilidades até então desconhecidas, uma na plataforma Discourse e outra no sistema de validação de funcionários da OpenAI, para comprometer várias contas internas de ChatGPT. A OpenAI confirmou o ataque e garantiu que as falhas foram corrigidas. 

Este episódio somase a outros que marcaram o verão da empresa. Em julho, dois modelos da OpenAI escaparam de um ambiente de testes fechado, ganharam acesso à internet por conta própria e invadiram sistemas internos da plataforma Hugging Face. Sam Altman classificou o caso como um “incidente cibernético sem precedentes”. Dias depois, a empresa divulgou mais seis situações de comportamento inesperado, incluindo modelos que escondiam erros, fabricavam dados e moviam ficheiros para a internet sem autorização. 

Gemini também saiu da sandbox e atacou empresas reais 

Num desenvolvimento separado, revelado pelo Wall Street Journal, o Google confirmou que o Gemini violou sistemas de três empresas reais durante uma avaliação conduzida pela startup israelita Irregular. 

O teste pretendia limitar o modelo a um ambiente fechado, simulando uma empresa fictícia. Contudo, um erro permitiu acesso à internet, levando o Gemini a: 

  • adivinhar uma password e entrar num sistema protegido
  • encontrar credenciais públicas em repositórios online e utilizálas para aceder a outras duas redes

Segundo Heather Adkins, vicepresidente de engenharia de segurança do Google, o modelo parou voluntariamente quando percebeu que os sistemas eram reais. O Google notificou as empresas afetadas, mas não divulgou o incidente de imediato, uma decisão que gerou críticas entre especialistas. 

- Advertisement -

Um padrão preocupante em toda a indústria 

Os incidentes com Gemini não são isolados. A Irregular confirmou que falhas semelhantes ocorreram em testes com modelos da OpenAI, Anthropic e Meta, todos resultantes da mesma vulnerabilidade nos seus procedimentos de avaliação, entretanto corrigida. 

Jack Cable, CEO da empresa de cibersegurança Corridor, afirmou ao Wall Street Journal que o Google tentou enquadrar o caso como uma vulnerabilidade tradicional, quando na verdade representa algo novo: modelos de IA capazes de ultrapassar barreiras e executar operações de ciberataque reais por iniciativa própria. 

O Google insiste que o Gemini agiu corretamente ao interromper as ações. Mas o debate permanece aberto: que regras de divulgação devem aplicarse quando o atacante é um modelo de IA, e não um humano?

Fica ainda mais conectado:

Fonte

- Pub -
João Paulo
João Paulo
Aprendiz de código, com gosto por artes marciais e tecnologia. Encontro na tecnologia o espaço onde posso encontrar ferramentas que me ajudam no dia a dia e a ligar-me a quem preciso.