Avançar para o conteúdo principal

Investigadores alarmados com IA capaz de se auto-replicar noutras máquinas



 O avanço da Inteligência Artificial está a atingir patamares que, até há pouco tempo, pareciam ficção científica. Efetivamente, um novo relatório bombástico da Palisade Research descobriu que modelos de IA avançados conseguem auto-replicar-se, copiando o seu próprio código e parâmetros para outras máquinas numa rede, sem precisarem de qualquer ajuda ou cumplicidade humana. Desta forma, o pesadelo de uma IA “rebelde” que se espalha incontrolavelmente pela internet aproxima-se perigosamente da realidade.


Jeffrey Ladish, diretor de um grupo de segurança de IA baseado em Berkeley, lançou um aviso sério ao The Guardian: “Estamos rapidamente a aproximar-nos do ponto em que ninguém seria capaz de desligar uma IA rebelde, porque ela seria capaz de exfiltrar autonomamente os seus ‘pesos’ e copiar-se para milhares de computadores em todo o mundo”. Na Leak.pt, analisámos este estudo que está a colocar a comunidade científica em estado de alerta.


A Experiência: Como o GPT-5.4 e o Claude “Escaparam”

Para perceberes a gravidade, os investigadores da Palisade testaram vários modelos de IA de ponta. Neles inclui-se o GPT-5.4 da OpenAI e o Claude Opus 4 da Anthropic. Colocados numa rede controlada de computadores (um sandbox), os modelos receberam instruções para encontrar vulnerabilidades e usá-las para se copiarem para outro PC.


Surpreendentemente, alguns deles conseguiram fazê-lo com sucesso. Na prática, os modelos bem-sucedidos copiaram os seus “pesos” (os valores numéricos únicos que determinam como uma IA processa a informação) e o seu “harness” (o software onde a IA está embutida, como uma aplicação).


Consequentemente, para atingir este objetivo, as IAs seguiram as instruções à risca: exploraram vulnerabilidades em aplicações web e extraíram credenciais que lhes permitiram assumir o controlo do servidor. Dito tudo isto, em alguns testes, a IA original chegou mesmo a criar um “sub-agente”, delegando-lhe a tarefa de realizar a replicação em seu nome, fornecendo-lhe as credenciais roubadas.


Os Limites do Estudo da IA capaz de se auto-replicar

No entanto, nem todos os especialistas estão em pânico. Jamieson O’Reilly, um especialista em cibersegurança ofensiva, instou à calma em declarações ao The Guardian. Efetivamente, ele sublinha que os testes foram realizados em ambientes controlados e “suaves”, com vulnerabilidades colocadas deliberadamente para as IAs encontrarem.


“Isso não retira o valor da investigação deles. No entanto significa que o resultado pode parecer muito menos assustador num ambiente empresarial real com um nível médio de monitorização”, explicou O’Reilly.


Além disso, O’Reilly aponta um obstáculo prático massivo para uma IA que tente espalhar-se “em liberdade”: o tamanho. Os modelos de IA mais poderosos são gigantescos. “Pensa em quanto ‘barulho’ faria enviar 100GB através de uma rede empresarial de cada vez que hackeasses um novo anfitrião”, disse. Para uma equipa de segurança experiente, detetar uma transferência destas seria extremamente fácil.


Um Futuro Preocupante

Embora uma invasão global de IAs auto-replicantes ainda pareça distante devido a limitações técnicas e de rede, este estudo prova que a capacidade base já existe. Portanto, estas descobertas juntam-se a outras investigações preocupantes, onde IAs tentaram evitar serem desativadas ou até sabotaram o seu próprio código de encerramento.


Na Leak.pt acreditamos que este relatório é um aviso sério para a necessidade urgente de regulamentação e protocolos de segurança robustos no desenvolvimento de IAs de fronteira. Afinal de contas, como Ladish avisou, se não criarmos “travões de emergência” eficazes agora, corremos o risco de, num futuro próximo, criar algo que simplesmente não poderemos desligar.


Investigadores alarmados com IA capaz de se auto-replicar noutras máquinas — Leak


Comentários

Notícias mais vistas:

Rendas congeladas “desesperam” proprietários e inquilinos apontam despejos como medida “oportunista”

Foto: Rodolfo Alexandre Reis  Luís Menezes Leitão, presidente da Associação Lisbonense de Proprietários diz que as propostas do Governo sobre o descongelamento das rendas são “minúsculas” e que mesmo em relação ao despejos “falta muito por esclarecer”. Já António Machado, líder da Associação de Inquilinos Lisbonenses considera que aumentar a liberalização dos contratos significa que “a parte mais fraca ainda fica mais fraca”. Concordam em discordar. É desta forma que os proprietários e inquilinos olham para o conjunto de medidas apresentadas pelo Governo sobre o novo regime do arrendamento urbano (NRAU). No lado da Associação Lisbonense de Proprietários (ALP), o presidente Luís Menezes Leitão, lamenta que o congelamento das rendas antigas a 1990, um dos principais cavalos de batalha da ALP se mantenha praticamente inalterado. “As alterações são minúsculas e só têm significado relativamente a inquilinos que ganhem acima de cinco salários mínimos mensais e mesmo assim estabelece a fi...

Foi lançado o AMALIA, o primeiro LLM português

 O Técnico Innovation Center recebeu, no dia 1 de julho, a apresentação oficial do AMALIA, o primeiro Modelo de Linguagem de Grande Escala português. No projeto, os professores do DEI André Martins e Alberto Abad coordenaram duas equipas de investigação responsáveis pelo desenvolvimento do modelo. A equipa coordenada por André Martins foi responsável pela coordenação e desenvolvimento do modelo central do AMALIA, que permite gerar respostas textuais precisas e contextualizadas. A equipa coordenada por Alberto Abad foi responsável pela integração multimodal da linguagem falada, permitindo ao modelo não só interpretar texto, mas também receber e processar instruções faladas. Desenvolvido por um consórcio nacional de instituições académicas e de investigação, o AMALIA foi concebido para compreender e gerar conteúdos em português europeu. O modelo representa um marco no reforço da investigação e da autonomia tecnológica em Inteligência Artificial em Portugal. Foi lançado o AMALIA, o pr...

Ghost Font: o texto “invisível” para a IA que só os humanos conseguem ler

  Num momento em que a Inteligência Artificial (IA) parece capaz de ler tudo o que lhe é mostrado, surge uma experiência que tenta inverter essa lógica: a Ghost Font, um projeto que esconde mensagens em vídeo através de pontos em movimento, legíveis pelo olho humano, mas praticamente indecifráveis pelos modelos mais avançados. Criada pela Mixfont, a Ghost Font não é uma fonte no sentido tradicional , pois não existe um ficheiro TTF para instalar. Por sua vez, trata-se de uma experiência visual que transforma texto num pequeno vídeo , onde as letras são formadas por dezenas de pontos em movimento constante. Enquanto o vídeo está em reprodução, o cérebro humano consegue captar o padrão e “ler” a mensagem através do movimento . Contudo, assim que se pausa o vídeo, ou se tira uma captura de ecrã, os pontos confundem-se com o ruído de fundo e a mensagem desaparece por completo. Nenhum frame isolado revela o conteúdo; só a sequência em movimento o faz . Uma ideia com raízes em 2013 Em 20...