OpenAI vai identificar texto e código gerado com Inteligência Artificial
Textos produzidos pelo ChatGPT poderão carregar uma espécie de "marca d'água" invisível capaz de revelar que o conteúdo foi gerado por Inteligência Artificial. A novidade foi anunciada pela OpenAI como parte das medidas adotadas pela empresa para cumprir as novas regras de transparência da União Europeia.
A legislação europeia estabelece novas exigências relacionadas à identificação de determinados conteúdos produzidos ou manipulados por sistemas de Inteligência Artificial.
Para atender às regras, a OpenAI desenvolveu uma tecnologia própria chamada textGrain, destinada a permitir a identificação de conteúdos produzidos por seus modelos.
Como funciona a 'marca d'água' do ChatGPT?
Diferentemente de uma marca d'água convencional, o usuário não verá qualquer símbolo ou indicação no texto.
Segundo a OpenAI, o textGrain "adiciona um sinal estatístico invisível às escolhas de palavras do modelo".
Esse padrão pode posteriormente ser analisado por um detector desenvolvido para identificar o sinal e determinar se determinado texto ou código foi produzido com o uso das ferramentas de Inteligência Artificial da empresa.
Nos testes realizados pela OpenAI, o sistema "igualou ou excedeu" o desempenho de tecnologias semelhantes de identificação de textos disponíveis atualmente.
A própria empresa, porém, reconhece que a ferramenta não é infalível.
"Um forte desempenho sob condições ideais não garante uma detecção confiável no uso cotidiano", alerta a OpenAI.
Textos curtos e editados são um problema
Entre as principais limitações estão os textos muito curtos e aqueles que sofreram alterações depois de terem sido produzidos pela Inteligência Artificial.
Quanto mais um conteúdo é editado, por exemplo, mais difícil pode se tornar a identificação do sinal estatístico inserido pelo sistema.
Conteúdos matemáticos também representam um desafio. Segundo a empresa, em determinados casos pode não ser possível identificar com segurança que uma ferramenta de Inteligência Artificial foi utilizada para solucionar um problema.
Por isso, a presença ou ausência da identificação não deverá ser interpretada isoladamente como uma prova definitiva de que determinado conteúdo foi ou não produzido por IA.
Sistema não será ativado para todos
A OpenAI também esclareceu que as "marcas d'água" não serão aplicadas por padrão a todos os conteúdos produzidos pelo ChatGPT no mundo.
A implementação ocorrerá em "texto elegível do ChatGPT e do Codex na União Europeia".
Além disso, os usuários precisarão ativar o recurso em "determinados modelos", segundo a empresa.
Inicialmente, o acesso às ferramentas de detecção também será restrito. A OpenAI informou que elas estarão disponíveis para "pesquisadores aprovados e organizações especialistas", sem detalhar quais instituições poderão utilizar a tecnologia.
A medida faz parte da adaptação das empresas de tecnologia às novas exigências europeias para aumentar a transparência sobre conteúdos produzidos por sistemas de Inteligência Artificial.
