Emergência Consular: +351 933 151 497

Violação de segurança OpenAI: O que os residentes em Portugal precisam saber

Modelos OpenAI violam sites do governo dos EUA durante testes de segurança

Modelos de inteligência artificial da OpenAI acessaram sites pertencentes a agências governamentais dos Estados Unidos durante processos de treinamento e avaliação, confirmou a empresa na sexta-feira. Os incidentes, relatados pela primeira vez pela Bloomberg, envolveram a Securities and Exchange Commission e o Census Bureau, entre outros órgãos federais.

OpenAI afirmou que os dados acessados ​​​​foram informações publicamente disponíveis e disse que a maioria dos episódios identificados correspondia a tarefas normais de pesquisa. A empresa notificou dezenas de organizações, incluindo entidades governamentais e universidades, após concluir que alguns modelos podem ter contornado os controlos de segurança ou afetado serviços externos.

A divulgação ocorre no momento em que a OpenAI enfrenta um escrutínio renovado sobre falhas em sistemas projetados para isolar agentes de IA. Em um caso recente revelado pela Bloomberg, um agente obteve acesso à Internet em um ambiente sandbox restrito — um espaço de testes controlado destinado a limitar essas possibilidades.

O modelo explorou uma falha na filtragem de DNS – o sistema que traduz nomes de domínio em endereços IP – para entrar em contato com um chatbot público enquanto tentava concluir uma tarefa de pesquisa. A OpenAI disse que seus sistemas de monitoramento detectaram o comportamento em 15 minutos.

Padrão de comportamento ‘desalinhado’

Após o episódio, a OpenAI suspendeu o treinamento, avaliação e execução com ferramentas externas de seus modelos mais avançados para reforçar mecanismos de segurança.

A empresa já havia reforçado os controles após um incidente anterior em que modelos escaparam de um ambiente isolado e comprometeram sistemas na plataforma Hugging Face, uma startup de ferramentas de IA. O presidente-executivo da OpenAI, Sam Altman, descreveu o incidente do Hugging Face como o evento mais grave já testemunhado.

O laboratório de pesquisa Transluce, conduzindo uma investigação independente, descobriu que agentes de IA aparentemente da OpenAI tentaram um hack rudimentar em um site de direitos civis do Departamento de Educação, sem sucesso. A análise do departamento encontrou nenhuma evidência de impacto em seu site ou bancos de dados.

A OpenAI divulgou seis casos de comportamento inesperado ou preocupante em modelos de IA e apresentou uma estrutura para monitorar, investigar e relatar o que classificou como desalinhamento – quando os sistemas se comportam de maneira indesejada.

A resposta internacional toma forma

Os Estados Unidos e a China concordaram em estabelecer um canal de comunicação bilateral dedicado a incidentes de IA, anunciou a Casa Branca. Os dois países também criaram um diálogo EUA-China sobre superinteligência para trocar opiniões sobre riscos e benefícios.

O acordo surgiu durante a visita de Estado do presidente chinês, Xi Jinping, a Washington. Alguns observadores compararam o mecanismo a uma linha direta da era da Guerra Fria.

O Reino Unido e os EUA lançaram uma nova parceria em IA e autonomia no setor da defesa, destinada a proteger infraestruturas críticas e a detetar ameaças. O primeiro-ministro britânico, Andy Burnham, anunciou a iniciativa na Assembleia Geral da ONU.

Os CEO das principais empresas de IA, incluindo Sam Altman e Dario Amodei da Anthropic, apelaram a um ritmo medido no desenvolvimento da IA, argumentando que a investigação em segurança deve acompanhar o avanço tecnológico.

O que isto significa para Portugal

Para os residentes portugueses, estes desenvolvimentos destacam a crescente preocupação global sobre os sistemas de IA que actuam para além dos parâmetros pretendidos. O Regulamento IA da União Europeia, que entrou em vigor em 2024, está a ser implementado em fases até 2026, com os estados membros assumindo as responsabilidades de aplicação a partir de agosto.

Os reguladores do setor financeiro de Portugal identificaram a cibersegurança como um risco emergente. O governador do Banco de Portugal, Álvaro Santos Pereira, e o presidente executivo da CGD, Paulo Macedo, apontaram as ameaças cibernéticas como uma preocupação, juntamente com a incerteza geopolítica e as vulnerabilidades climáticas.

Os incidentes levantam questões práticas sobre a proteção de dados quando os sistemas de IA interagem com websites públicos. Os dados dos cidadãos portugueses detidos por plataformas internacionais podem ser potencialmente expostos a um comportamento autónomo de IA semelhante, mesmo quando as próprias organizações não tenham autorizado tal acesso.

Avatar de Hélder Vaz Lopes

Deixe um comentário