OpenAI anunciou um sistema de «marca d’água» invisível para identificar textos e códigos gerados por suas
ferramentas de Inteligência Artificial na União Europeia. Tecnologia chamada textGrain será aplicada a conteúdos elegíveis do ChatGPT e do Codex para atender às novas regras europeias de transparência
extos produzidos pelo ChatGPT poderão carregar uma espécie de «marca d’água» invisível capaz de revelar que o conteúdo foi gerado por Inteligência Artificial. A novidade foi anunciada pela OpenAI como parte das medidas adotadas pela empresa para cumprir as novas regras de transparência da União Europeia.
A legislação europeia estabelece novas exigências relacionadas à identificação de determinados conteúdos produzidos ou manipulados por sistemas de Inteligência Artificial.
Para atender às regras, a OpenAI desenvolveu uma tecnologia própria chamada textGrain, destinada a permitir a identificação de conteúdos produzidos por seus modelos.
Como funciona a ‘marca d’água’ do ChatGPT?
Diferentemente de uma marca d’água convencional, o usuário não verá qualquer símbolo ou indicação no texto.
Segundo a OpenAI, o textGrain «adiciona um sinal estatístico invisível às escolhas de palavras do modelo».
Esse padrão pode posteriormente ser analisado por um detector desenvolvido para identificar o sinal e determinar se determinado texto ou código foi produzido com o uso das ferramentas de Inteligência Artificial da empresa.
Nos testes realizados pela OpenAI, o sistema «igualou ou excedeu» o desempenho de tecnologias semelhantes de identificação de textos disponíveis atualmente.
A própria empresa, porém, reconhece que a ferramenta não é infalível.
«Um forte desempenho sob condições ideais não garante uma detecção confiável no uso cotidiano», alerta a OpenAI.
Textos curtos e editados são um problema
Entre as principais limitações estão os textos muito curtos e aqueles que sofreram alterações depois de terem sido produzidos pela Inteligência Artificial.
Quanto mais um conteúdo é editado, por exemplo, mais difícil pode se tornar a identificação do sinal estatístico inserido pelo sistema.
Conteúdos matemáticos também representam um desafio. Segundo a empresa, em determinados casos pode não ser possível identificar com segurança que uma ferramenta de Inteligência Artificial foi utilizada para solucionar um problema.
Por isso, a presença ou ausência da identificação não deverá ser interpretada isoladamente como uma prova definitiva de que determinado conteúdo foi ou não produzido por IA.
Sistema não será ativado para todos
A OpenAI também esclareceu que as «marcas d’água» não serão aplicadas por padrão a todos os conteúdos produzidos pelo ChatGPT no mundo.
A implementação ocorrerá em «texto elegível do ChatGPT e do Codex na União Europeia».
Além disso, os usuários precisarão ativar o recurso em «determinados modelos», segundo a empresa.
Inicialmente, o acesso às ferramentas de detecção também será restrito. A OpenAI informou que elas estarão disponíveis para «pesquisadores aprovados e organizações especialistas», sem detalhar quais instituições poderão utilizar a tecnologia.
A medida faz parte da adaptação das empresas de tecnologia às novas exigências europeias para aumentar a transparência sobre conteúdos produzidos por sistemas de Inteligência Artificial











