ChatGPT aplicará marca d’água em textos gerados. Veja!

O ChatGPT ganhará uma tecnologia para adicionar marcas d’água invisíveis a textos gerados por IA. Nesse sentido, anunciada pela OpenAI nesta segunda-feira (5), a ferramenta usa o sistema textGrain para inserir sinais estatísticos sem comprometer a qualidade das respostas. Vale ressaltar que, inicialmente, será disponibilizada apenas na União Europeia.

O contexto de que o ChatGPT aplicará marca d’água em textos gerados

A OpenAI anunciou a chegada de uma tecnologia de identificação para textos produzidos pelo ChatGPT. O recurso utiliza o textGrain, sistema desenvolvido para inserir marcas d’água invisíveis em conteúdos gerados por inteligência artificial. Como dito anteriormente, a implementação, neste primeiro momento, ficará restrita às conversas de usuários localizados na União Europeia.

Marcas d’água invisíveis

É importante destacar que a tecnologia funciona de maneira diferente de métodos que adicionam caracteres ocultos, pontuações incomuns ou outros elementos perceptíveis no conteúdo. Ao invés disso, o textGrain modifica estatisticamente determinadas escolhas de palavras realizadas pelos modelos responsáveis pela geração das respostas.

Dessa maneira, o texto continua apresentando características semelhantes às de uma resposta convencional do ChatGPT, sem alterações perceptíveis na qualidade ou na aparência para quem lê. Simultaneamente, o conteúdo passa a carregar um sinal estatístico invisível que pode fornecer indícios sobre sua origem.

Identificação de conteúdos de IA

A proposta acompanha uma discussão cada vez mais presente sobre a identificação de conteúdos produzidos por inteligência artificial. Com a expansão do uso de ferramentas generativas para escrever textos, produzir trabalhos e desenvolver diferentes tipos de conteúdo, mecanismos capazes de indicar a participação de uma IA passaram a receber maior atenção.

Como o textGrain preserva o texto

No caso do textGrain, a OpenAI optou por uma abordagem que não depende de elementos visíveis ou facilmente removíveis. O sistema incorpora a marca d’água às escolhas estatísticas feitas durante a geração, sem alterar a aparência original do conteúdo.

O ChatGPT passará a aplicar marca d'água nos textos gerados.
O ChatGPT passará a aplicar marca d’água nos textos gerados. | Foto: Nano Banana

Como será a aplicação de marca d’água em textos gerados pelo ChatGPT?

Segundo a OpenAI, o textGrain apresentou desempenho igual ou superior ao de técnicas avaliadas para identificação de textos produzidos por IA. Entre os sistemas considerados está o SynthID para texto, tecnologia utilizada pelo Google em conteúdos gerados pelo Gemini.

Limitações da detecção

Apesar dos resultados observados em condições controladas, a própria OpenAI destaca que a detecção não é algo que deve ser considerado completamente confiável em todas as situações. O comportamento do sistema pode mudar de acordo com o tamanho, o tipo e o nível de edição aplicado ao texto.

Uso na União Europeia

Nas próximas semanas, a OpenAI deverá aplicar obrigatoriamente o textGrain às respostas de texto elegíveis do ChatGPT e do Codex na União Europeia. A OpenAI pretende aproveitar a implementação limitada geograficamente para observar como o identificador funciona em situações reais e avaliar seu desempenho entre usuários.

Porém, até o momento, não existe uma previsão definida para que a tecnologia seja expandida para outras regiões. Logo, usuários fora da União Europeia não devem esperar a aplicação obrigatória da marca d’água nas respostas do ChatGPT neste primeiro momento.

Uso pela API

Sendo assim, para clientes que utilizam a API da OpenAI, entretanto, a situação será diferente. A ativação do recurso será opcional nos modelos compatíveis. Com isso, empresas e desenvolvedores de diferentes países poderão optar pela utilização da marca d’água ou implementá-la caso exista uma exigência determinada pela legislação local.

Finalmente, a iniciativa também ocorre em um cenário no qual outras empresas do setor desenvolvem mecanismos semelhantes. Em agosto deste ano, a Anthropic anunciou uma solução de marca d’água para textos produzidos por modelos recentes do Claude, mas adotou uma implementação obrigatória em escala internacional.

Mais detalhes sobre essa situação do ChatGPT

A identificação de textos gerados por inteligência artificial apresenta diferenças importantes em relação à detecção de imagens produzidas por modelos generativos. No caso do textGrain, a tecnologia depende de características estatísticas presentes na forma como as palavras são escolhidas durante a geração.

Por isso, usuários não devem interpretar a presença de uma marca d’água como prova absoluta da origem ou das características de determinado conteúdo. O recurso foi desenvolvido para fornecer um sinal de identificação, mas possui limitações que precisam ser consideradas.

Participação humana

A marca d’água, por exemplo, não permite determinar quanto de participação humana existiu na construção de um texto. Um conteúdo pode ter sido amplamente editado por uma pessoa depois da geração pela IA, mas a tecnologia não foi criada para medir essa proporção.

Da mesma forma, a presença do identificador não significa que o conteúdo pertence à OpenAI ou que a empresa assume responsabilidade pelo material. A marca d’água também não revela quem foi o autor humano de um texto que tenha passado por processos de edição.

O que o sistema não identifica

Outro ponto importante é que o sistema não foi desenvolvido para avaliar a veracidade das informações presentes no conteúdo. A identificação não determina se determinado texto é verdadeiro, enganoso, prejudicial ou apresentado fora de seu contexto original.

Juntamente com isso, a ausência da marca d’água não significa, necessariamente, que uma inteligência artificial não produziu o texto. Diferentes fatores podem impedir que o identificador seja reconhecido, principalmente quando o conteúdo é curto ou sofre alterações significativas.

Pontos de atenção sobre essa circunstância do ChatGPT

Mesmo sendo invisível para o leitor, a marca d’água pode apresentar limitações na identificação dos textos. Entre os principais problemas estão os falsos positivos, quando um conteúdo pode ser identificado incorretamente, e os falsos negativos, quando um texto produzido por IA não é reconhecido pelo sistema.

Um dos principais fatores é o tamanho do conteúdo analisado. Textos mais curtos ou submetidos a restrições maiores apresentam maior dificuldade de detecção. Nos testes divulgados pela OpenAI, o sistema identificou corretamente apenas 80% dos trechos com 200 tokens.

Quando o tamanho aumentou para 400 tokens, a taxa de detecção chegou a 95%. Os números mostram que a quantidade de texto disponível para análise exerce influência relevante sobre a capacidade de reconhecer o sinal estatístico.

Conteúdos matemáticos apresentam maior dificuldade

Mais um ponto de atenção envolve textos relacionados à matemática. Segundo a OpenAI, a capacidade de identificar a marca d’água nesse tipo de conteúdo foi substancialmente menor.

Isso ocorre porque textos matemáticos podem apresentar características diferentes da linguagem convencional, com fórmulas, símbolos, estruturas mais rígidas e menor variedade nas escolhas de palavras. Essas particularidades dificultam a aplicação de um sistema baseado em padrões estatísticos de linguagem.

Edições podem enfraquecer a identificação

Alterações realizadas depois da geração também podem reduzir a capacidade de reconhecimento da marca d’água. Nos testes apresentados pela OpenAI, a substituição de 10% das palavras por sinônimos em trechos de 400 tokens reduziu a detecção de aproximadamente 92% para 66%.

Quando a substituição chegou a 25% dos termos, o índice caiu ainda mais, para 17%. Os resultados mostram que modificações relativamente simples podem interferir no desempenho do sistema em determinadas circunstâncias.

A OpenAI também lançou os detectores relacionados às marcas d’água nesta segunda-feira. Dessa maneira, pesquisadores e organizações especializadas podem solicitar acesso por meio de uma lista de espera, mas cada pedido será analisado individualmente.

Por enquanto, a empresa decidiu não disponibilizar publicamente o detector para textos do ChatGPT. A medida considera os possíveis riscos de mau uso da ferramenta e a necessidade de avaliar com cuidado como o sistema poderá ser utilizado.

Lições a aprender com essa conjuntura do ChatGPT

Vale ressaltar que a adoção do textGrain mostra que a identificação de conteúdos gerados por inteligência artificial tende a avançar, mas também evidencia que nenhum método deve ser tratado como uma prova absoluta sobre a origem de um texto.

Nesse sentido, a principal lição é que uma marca d’água estatística pode funcionar como um indicador, mas não consegue responder sozinha a todas as perguntas relacionadas à autoria, à participação humana ou à confiabilidade das informações. A interpretação dos resultados precisa considerar o contexto em que o conteúdo foi produzido e posteriormente modificado.

Limitações técnicas

Mais um aprendizado está relacionado às limitações técnicas. O desempenho varia conforme o tamanho do texto, o tipo de conteúdo e o nível de edição realizado. Por isso, textos curtos, materiais matemáticos e conteúdos amplamente revisados podem apresentar desafios maiores para a identificação.

Avaliação na União Europeia

A implementação inicial na União Europeia também permitirá que a OpenAI observe o comportamento da tecnologia em situações reais antes de decidir sobre uma eventual expansão. Tal período de avaliação pode contribuir para identificar falhas e aperfeiçoar o sistema.

Em suma, no cenário atual, a marca d’água representa mais uma tentativa de aumentar a transparência sobre o uso de inteligência artificial na produção de conteúdo. Ao mesmo tempo, os resultados divulgados reforçam a necessidade de cautela antes de utilizar detectores de IA como única base para determinar a origem de um texto.

Portanto, a chegada da tecnologia representa uma nova etapa na discussão sobre identificação de conteúdos gerados por IA, mas não elimina os desafios relacionados à detecção. Logo, para conferir as próximas novidades e entender como o ChatGPT evolui nesse cenário, continue acompanhando as atualizações sobre a tecnologia.

*com uso de inteligência artificial

Artigos recentes