A OpenAI vai acrescentar uma marca de água ao texto elegível do ChatGPT e do Codex na União Europeia (UE), em resposta ao AI Act, e os clientes da API em todo o mundo podem ativar a funcionalidade em modelos selecionados.
Esta semana, a OpenAI detalhou a forma como vai responder à exigência europeia de que os conteúdos gerados por Inteligência Artificial (IA) sejam identificáveis por máquina.
O AI Act aplica essa obrigação também ao texto, sendo que as obrigações do artigo 50.º se aplicam, em regra, desde 2 de agosto de 2026, e os fornecedores de sistemas colocados no mercado antes dessa data podem cumprir a obrigação de marcação até 2 de dezembro de 2026.
Assim, a empresa optou por uma implementação por fases, assumindo que a tecnologia de marcação e deteção de texto ainda tem limitações significativas.
O que muda e para quem
Desde já, os clientes da API em todo o mundo podem optar por receber texto com marca de água em modelos selecionados, mantendo-se a funcionalidade desativada por predefinição.
Nas próximas semanas, a OpenAI vai acrescentar a marca de água ao texto elegível do ChatGPT e do Codex apenas na UE, em todos os planos. A empresa indica ainda que não pretende torná-la a predefinição global no início, justificando a abordagem regional com a necessidade de aprender com a utilização real.
Como funciona a marca de água
A tecnologia, chamada textGrain, assenta num sinal estatístico introduzido nas escolhas de palavras do modelo, que o detetor procura depois para avaliar se uma passagem contém uma marca da OpenAI.
Segundo os testes da própria empresa, o desempenho do sistema igualou ou superou o de outras abordagens avaliadas, incluindo o SynthID para texto, e não houve diferenças significativas nos resultados de testes de desempenho do modelo mais recente com e sem marca de água. A OpenAI diz também que pretende disponibilizar a tecnologia em código aberto.
Os resultados divulgados mostram que a deteção depende muito do comprimento e do tipo de texto: com uma taxa-alvo de falsos positivos de 1%, o detetor identificou a marca em cerca de 80% das passagens de 200 tokens e em cerca de 95% das de 400 tokens, em conteúdos como psicologia, sendo a taxa substancialmente inferior em áreas como a matemática, onde há menos liberdade na escolha de palavras.
A edição também enfraquece o sinal, pois, em passagens de 400 tokens em inglês, a substituição de 10% das palavras por sinónimos fez a deteção cair de cerca de 92% para 66%, e a substituição de 25% reduziu-a para 17%.
A OpenAI sublinha ainda que a marca de água:
Não mede a contribuição humana;
Não estabelece autoria nem responsabilidade;
Não identifica o utilizador;
Não garante a veracidade do conteúdo.
Além disso, a ausência de marca detetada não prova que o texto tenha sido escrito por uma pessoa, uma vez que pode ter sido editado, traduzido ou gerado por outras ferramentas.
Quem pode verificar o conteúdo gerado por IA
O detetor não ficará disponível ao público no lançamento, devido ao risco de falsos positivos e de marcas não detetadas, e o acesso será concedido caso a caso a investigadores e organizações especializadas que se candidatem, em conformidade com o Código de Conduta europeu.
A ferramenta indica apenas se foi detetada uma marca da OpenAI, sem identificar o utilizador nem revelar os pedidos ou as conversas, e as ferramentas de verificação de imagens e áudio da empresa continuam públicas.
Só na UE: texto gerado pelo ChatGPT vai passar a ter marca de água
Comentários
Enviar um comentário