ChatGPT copia o Claude e também começa a "carimbar" textos feitos por sua IA
O ChatGPT vai começar a colocar uma marca-d’água invisível em textos gerados pela inteligência artificial. A OpenAI anunciou nesta segunda-feira (5) o textGrain, tecnologia que altera discretamente as escolhas de palavras do modelo para criar um padrão identificável por ferramentas específicas. O recurso será implemen…
O ChatGPT vai começar a colocar uma marca-d’água invisível em textos gerados pela inteligência artificial. A OpenAI anunciou nesta segunda-feira (5) o textGrain, tecnologia que altera discretamente as escolhas de palavras do modelo para criar um padrão identificável por ferramentas específicas. O recurso será implementado nas próximas semanas para usuários do ChatGPT e do Codex na União Europeia.
A medida segue um caminho adotado recentemente pela Anthropic, dona do Claude, que anunciou sua própria marca-d’água para textos em agosto. Nos dois casos, a mudança busca atender às regras de transparência do AI Act europeu, que exige que conteúdos produzidos por sistemas de IA possam ser identificados por máquinas.
Por enquanto, usuários do ChatGPT no Brasil não devem receber o “carimbo” automaticamente. A OpenAI afirma que o lançamento ficará restrito à União Europeia em um primeiro momento, embora clientes da API em qualquer país já possam ativar a tecnologia voluntariamente em modelos compatíveis.
Como funciona o “carimbo” do ChatGPT?
A marca-d’água não aparece como uma etiqueta no texto e também não adiciona caracteres invisíveis, espaços extras ou informações escondidas ao copiar e colar uma resposta.
O textGrain atua durante a geração do conteúdo. Modelos de linguagem calculam diferentes possibilidades para a próxima palavra ou parte de palavra, conhecida como token. A tecnologia ajusta levemente essas probabilidades para que determinadas escolhas formem um padrão estatístico ao longo do texto.
Esse padrão pode ser procurado posteriormente por um detector da OpenAI. Segundo a empresa, a ferramenta consegue indicar se um sistema da companhia provavelmente participou da geração ou edição daquele conteúdo.
A abordagem é semelhante à utilizada pelo Claude. A Anthropic adotou uma versão do SynthID-Text, tecnologia criada pelo Google DeepMind, que também modifica a aleatoriedade envolvida na escolha das palavras sem inserir elementos visíveis no conteúdo.
A OpenAI desenvolveu uma solução própria e afirma que, em seus testes, o textGrain igualou ou superou a capacidade de detecção de outras técnicas avaliadas, incluindo o SynthID para textos. A companhia também pretende disponibilizar a tecnologia como código aberto.
Marca-d'água ainda pode ser burlada
A presença do carimbo não permite afirmar com certeza que um texto inteiro foi escrito pelo ChatGPT. A tecnologia indica que um modelo da OpenAI provavelmente participou da produção ou edição daquele conteúdo, mas não consegue medir quanto do material veio de uma pessoa.
Também existem limitações técnicas. Nos testes divulgados pela OpenAI, considerando uma taxa de 1% de falsos positivos, o detector encontrou a marca em aproximadamente 80% dos textos de 200 tokens analisados em uma categoria de conteúdo. Em passagens de 400 tokens, a taxa chegou a cerca de 95%. O desempenho varia conforme o tipo e o idioma do texto.