A OpenAI introduziu um sistema de marcas de água invisíveis para os textos gerados pelos modelos ChatGPT e Codex na União Europeia. A medida surge para cumprir as regras de transparência do Regulamento da Inteligência Artificial da União Europeia, que entraram em vigor a 2 de Agosto. Nas próximas semanas, os utilizadores europeus vão começar a utilizar esta funcionalidade, enquanto os programadores que utilizam a interface de programação da empresa em qualquer parte do mundo já podem activar a opção manualmente para modelos seleccionados.
O funcionamento do sistema textGrain
O método técnico, baptizado textGrain, não insere um símbolo visível, mas sim um padrão estatístico subtil nas escolhas de palavras do modelo. Os investigadores da Universidade da Pensilvânia e de Yale colaboraram na criação deste mecanismo, que utiliza uma chave secreta para ordenar as previsões das palavras seguintes. Ao acumular centenas de pequenas inclinações na construção das frases, um detector consegue identificar o conteúdo gerado por inteligência artificial. A empresa planeia disponibilizar a tecnologia subjacente em formato de código aberto, abrindo a porta a uma adopção mais ampla pela comunidade tecnológica.
As edições humanas reduzem a eficácia desta marca de água estatística. Durante os testes internos, o detector identificou cerca de 95% das passagens com 400 blocos de texto em áreas como a psicologia. No entanto, a substituição de 10% das palavras por sinónimos fez a taxa de detecção cair de 92% para 66%. A identificação torna-se ainda mais difícil em respostas matemáticas, textos curtos ou traduções. Devido a estas limitações, a empresa limitou o acesso inicial à ferramenta de detecção a investigadores aprovados e organizações especializadas. A transparência e a avaliação rigorosa continuam a ser temas centrais na indústria da inteligência artificial, especialmente porque a OpenAI ignorou avisos internos sobre falhas de segurança nos seus modelos.
Publicidade e autoria
A ausência da marca de água não serve como prova de autoria humana, porque o texto pode ter origem noutra inteligência artificial ou ter sofrido edições profundas. Paralelamente às alterações de transparência textual, a plataforma ChatGPT vai começar a apresentar mais anúncios publicitários nos próximos dias. Estas campanhas vão surgir ao lado das imagens que os utilizadores pedem ao sistema para gerar.
