Pular para o conteúdo
Inteligëncia Artificial

OpenAI vai incluir marca-d’água invisível em textos do ChatGPT e Codex na União Europeia

4 min
OpenAI vai incluir marca-d’água invisível em textos do ChatGPT e Codex na União Europeia

A OpenAI anunciou que adicionará uma marca-d’água invisível a textos elegíveis produzidos pelo ChatGPT e pelo Codex na União Europeia. A implementação será feita nas próximas semanas, segundo a empresa, e busca atender às regras de transparência previstas no AI Act europeu.

O sinal não aparecerá como um texto escondido, espaço em branco extra ou caractere incomum. A tecnologia, chamada textGrain, altera de forma estatística a escolha entre palavras ou partes de palavras que o modelo poderia usar ao responder. Em uma passagem suficientemente longa, esse padrão pode ser procurado por um detector.

O anúncio vale para usuários elegíveis do ChatGPT e do Codex nos países da União Europeia, em todos os planos. A OpenAI deixou claro que a marca-d’água não será ativada globalmente por padrão nesta primeira etapa. Para clientes da API, o recurso ficará disponível de forma opcional em modelos selecionados e continuará desativado por padrão.

A mudança anunciada pela OpenAI chega depois de novas obrigações de transparência do AI Act. O artigo 50 da norma determina que provedores de sistemas de IA que geram texto sintético garantam que as saídas sejam marcadas de forma legível por máquina e detectáveis como conteúdo artificialmente gerado ou manipulado, dentro dos limites técnicos aplicáveis.

O sinal pode ajudar, mas não prova autoria humana ou artificial

A principal ressalva é que uma marca-d’água de texto não funciona como uma perícia definitiva. A OpenAI afirma que o textGrain pode indicar que seu sistema gerou ou processou parte de uma passagem, mas não revela quem usou a ferramenta, qual foi o prompt, quanto o texto foi editado por uma pessoa ou se o conteúdo está correto. Também não determina propriedade intelectual ou responsabilidade pela publicação.

A detecção fica mais difícil em respostas curtas e em conteúdos muito restritos, nos quais o modelo tem pouca liberdade para variar a redação. Nas avaliações divulgadas pela empresa, o detector encontrou o sinal em cerca de 80% de passagens de 200 tokens e em aproximadamente 95% de textos de 400 tokens, em um conjunto de conteúdo de psicologia e com taxa-alvo de falso positivo de 1%. Esses resultados são testes controlados, não uma garantia para cada texto publicado.

Alterações também podem enfraquecer o sinal. No mesmo material de avaliação, substituir 10% das palavras por sinônimos reduziu a detecção de cerca de 92% para 66%; com 25% das palavras trocadas, ela caiu para 17%. Traduções, paráfrases e reescritas substanciais podem ter efeito semelhante. Por isso, a ausência de uma marca identificada não prova que o texto foi escrito por uma pessoa.

Na fase inicial, o detector não será aberto ao público. O acesso ficará limitado a pesquisadores e organizações especializadas aprovadas pela OpenAI, que diz querer avaliar confiabilidade e usos responsáveis antes de ampliar a ferramenta. Isso significa que leitores, professores, veículos e empresas em geral não terão, por ora, um verificador público para colar um texto e receber uma resposta conclusiva.

O AI Act não exige que uma marca-d’água resolva sozinha o problema de transparência. A regra fala em marcação legível por máquina e detectável, levando em conta o estado da técnica, a robustez da solução e as limitações específicas de cada tipo de conteúdo. Para texto voltado a informar o público sobre assuntos de interesse público, a legislação também prevê obrigações de divulgação para quem publica, com exceções quando há revisão humana e responsabilidade editorial.

Essa diferença importa para quem usa IA em trabalho editorial ou corporativo. A marca técnica pode apontar uma origem possível, enquanto um rótulo visível esclarece ao leitor como aquele material foi produzido. Uma não substitui automaticamente a outra, e a necessidade de divulgação depende do contexto de uso e das regras aplicáveis.

A iniciativa da OpenAI deve ser acompanhada como um teste de transparência, não como uma solução universal para detectar textos de IA. A própria empresa reconhece a possibilidade de falsos positivos e falsos negativos. A utilidade prática da marca dependerá da resistência a edições, da qualidade do detector e de como plataformas, pesquisadores e publicadores adotarem sinais de procedência em conjunto com revisão humana.

Fontes: The Verge e OpenAI

Mais em Inteligência Artificial

Ver tudo sobre Inteligência Artificial →

Compartilhar

Redação

Escrito por