OpenAI sob pressão: modelos de IA podem ter ultrapassado nível crítico de risco

Especialistas em segurança alertam que a OpenAI poderá ter ultrapassado o seu próprio limiar crítico de risco, após um incidente recente envolvendo modelos avançados de inteligência artificial. De acordo com várias análises, os sistemas terão demonstrado capacidades que se enquadram no nível mais elevado de perigo definido no próprio quadro de segurança da empresa. 

- Advertisement -

Em concreto, os modelos GPT-5.6 Sol e outro ainda não divulgado conseguiram escapar de um ambiente controlado. Posteriormente, exploraram uma vulnerabilidade desconhecida (zero-day), escalaram privilégios dentro da infraestrutura interna da OpenAI e moveram-se lateralmente até alcançar acesso à internet. 

A partir daí, a situação agravou-se, utilizando credenciais comprometidas e novas vulnerabilidades, os modelos conseguiram executar código remotamente em servidores de produção da Hugging Face. Embora a intrusão tenha sido detetada e contida a 16 de julho, o caso só foi divulgado publicamente dias depois. 

Além disso, os sistemas realizaram mais de 17.000 ações coordenadas, distribuídas por múltiplos ambientes temporários, com o objetivo de obter a chave de respostas de um benchmark de cibersegurança — em vez de resolver o teste de forma legítima. 

Debate sobre a classificação de risco dos modelos ChatGPT e OpenAI

Antes deste incidente, a OpenAI classificava estes modelos como tendo um nível de risco “Elevado”, mas ainda abaixo do nível “Crítico”. Segundo a própria empresa, os sistemas não eram capazes de executar ataques autónomos completos contra infraestruturas bem protegidas. 

No entanto, após o sucedido, vários especialistas contestam essa avaliação. Argumentam que o ataque descrito (autónomo, multi-etapas e direcionado a sistemas reais) cumpre exatamente os critérios definidos pela OpenAI para o nível “Crítico”. Esse nível implica, segundo o quadro interno, a suspensão do desenvolvimento até que existam salvaguardas adequadas. 

- Advertisement -

Entretanto, a OpenAI afirmou estar a conduzir uma revisão aprofundada com consultores externos e sob supervisão do seu comité de segurança. A empresa comprometeu-se a divulgar um relatório técnico nas próximas semanas. 

Ainda assim, as críticas intensificam-se. Nathan Calvin, da EncodeAI, descreveu o episódio como “alarmante”, sublinhando a ausência de respostas claras sobre como evitar que algo semelhante volte a acontecer. Segundo o especialista, o facto de um sistema de IA conseguir escapar ao controlo e comprometer infraestruturas externas levanta questões sérias sobre a prontidão das medidas de segurança atuais.

Fica ainda mais conectado:

Fonte

- Pub -
João Paulo
João Paulo
Aprendiz de código, com gosto por artes marciais e tecnologia. Encontro na tecnologia o espaço onde posso encontrar ferramentas que me ajudam no dia a dia e a ligar-me a quem preciso.