Tecnologia

ChatGPT passa a ter marca de água nos textos na UE, a ferramenta que a OpenAI guardou em 2024

Adrian Kessler
Adicione-nos no Google

A OpenAI passou muito tempo a explicar publicamente por que razão não iria colocar uma marca de água nos textos do ChatGPT. Agora, vai fazê-lo na mesma. Não foi a tecnologia que a fez mudar de ideias. Foi uma lei, com prazo e multa associados.

A empresa afirma que os textos produzidos pelo ChatGPT e pelo Codex para utilizadores da União Europeia terão uma assinatura estatística invisível, implementada gradualmente nas próximas semanas em todos os planos. No resto do mundo, a mesma marca existe apenas como uma opção na API para programadores, desativada por predefinição. A fronteira traçada pela OpenAI coincide com a da jurisdição que a pode penalizar.

Como funciona a marca de água do ChatGPT

O método, chamado textGrain, não acrescenta nada de visível ao texto. Quando várias palavras seguintes se encaixam de forma igualmente plausível numa frase, uma chave secreta inclina a escolha a favor de uma delas. Uma ligeira influência não significa nada. Mas, repetida centenas de vezes ao longo de um texto, forma um padrão que um detetor com acesso à chave consegue identificar. Como o sinal está nas próprias palavras, sobrevive a uma operação de copiar e colar. A OpenAI elaborou o relatório técnico com investigadores da University of Pennsylvania e da Yale. O documento não regista qualquer impacto significativo na qualidade: no Artificial Analysis Intelligence Index, os textos com marca de água obtiveram 49,76 pontos, contra 49,57 sem a marca.

A ferramenta que a OpenAI já tinha

Nada disto é novo dentro da OpenAI. No verão de 2024, o Wall Street Journal noticiou que a empresa tinha uma marca de água textual funcional, considerada 99,9% eficaz em documentos internos, mas estava a adiá-la. A OpenAI respondeu que estava a adotar «uma abordagem deliberada». As razões que apresentou eram técnicas e sociais: o método era «fácil de contornar por agentes mal-intencionados», através de traduções ou reformulações feitas com outro modelo, e podia estigmatizar a IA como ferramenta de escrita para quem não tem o inglês como língua materna. Ao noticiar o anúncio desta semana, a TechCrunch recorda uma terceira razão apontada na altura: o receio de que os utilizadores passassem para concorrentes sem marca de água.

À luz desse historial, a nova implementação revela quais destas preocupações a OpenAI conseguiu realmente resolver. O problema de contornar a marca continua a existir, segundo os próprios números da empresa. A questão comercial foi confinada a um único mercado.

Os números da OpenAI, não os dos seus críticos

Em condições favoráveis, com uma taxa de falsos positivos de 1%, o detetor identifica cerca de 80% dos textos com marca de água que têm 200 tokens e aproximadamente 95% dos que têm 400. Se 10% das palavras forem substituídas por sinónimos, a taxa de deteção cai de 92% para 66%. Se for substituído um quarto das palavras, desce para 17%. É muito difícil detetar respostas curtas, textos de matemática e textos traduzidos. A própria OpenAI avisa que um bom desempenho em condições ideais «não garante uma deteção fiável no uso quotidiano» e que a ausência de uma marca de água não prova que um texto tenha sido escrito por uma pessoa. A empresa afirma também que a marca não permite identificar o utilizador.

Assim, o textGrain é um sinal útil contra quem se limita a copiar e colar, mas pouco eficaz contra quem esteja disposto a perder um minuto a editar o texto. Num bloco onde se lê e escreve em muitas línguas, a falha na deteção de traduções não é um pormenor.

Porquê a UE e porquê agora

A base legal é o artigo 50.º do Regulamento da IA, cujas regras de transparência entraram em vigor a 2 de agosto. O artigo exige que os fornecedores de sistemas generativos assinalem texto, áudio, imagens e vídeo sintéticos de forma legível por máquina e disponibilizem um mecanismo de deteção. Os sistemas já disponíveis no mercado antes dessa data, entre eles o ChatGPT, têm até 2 de dezembro para cumprir as regras. As infrações podem custar até 15 milhões de euros ou 3% do volume de negócios anual mundial, consoante o valor mais elevado, segundo uma análise do escritório de advogados Cooley.

Dois pormenores mostram até que ponto a implementação segue a obrigação, e não um princípio. O primeiro é o detetor. A lei exige um mecanismo de deteção; a OpenAI criou um, mas só o disponibilizou a investigadores aprovados e a organizações especializadas, que têm de apresentar um pedido. A empresa diz que alargará o acesso «quando considerarmos que os resultados podem ser interpretados de forma responsável», como noticia o The Decoder, mas não indicou qualquer calendário. Hoje, um professor ou editor em Lisboa ou Varsóvia não consegue verificar um texto suspeito.

O segundo pormenor é o mapa. A Anthropic, que começou a aplicar uma marca de água aos textos do Claude em agosto, fá-lo a nível mundial, independentemente da forma como as pessoas acedem aos seus modelos, e recebeu críticas de alguns utilizadores por isso. A OpenAI escolheu o caminho oposto: ativada por predefinição onde um regulador a pode multar, opcional para programadores noutros locais e sem ativação mundial por predefinição no lançamento. Se o antigo receio de que os utilizadores migrassem para concorrentes sem marca de água tivesse desaparecido, haveria poucas razões para traçar o mapa desta forma.

O que vem a seguir

A OpenAI afirma que vai disponibilizar o textGrain como código aberto e que este iguala ou supera abordagens como o SynthID, da Google. Ambas as afirmações poderão ser testadas quando o código for público. Para Bruxelas, a questão é mais específica: saber se uma marca que desaparece com uma edição ligeira e é lida por um detetor que quase ninguém consegue usar cumpre uma regra concebida para permitir que outros sistemas reconheçam textos gerados por IA.

Depois de 2 de dezembro, os únicos utilizadores do ChatGPT cujas palavras terão, por predefinição, a assinatura da OpenAI serão aqueles cujo regulador lhe pode enviar a conta.

Etiquetas: , , , ,

Adicione-nos no Google

Discussão

Existem 0 comentários.