A OpenAI iniciou a implementação de uma tecnologia de marca d’água digital invisível em conteúdos gerados pelo ChatGPT e pelo modelo Codex. A medida, inicialmente restrita aos usuários localizados na União Europeia, visa atender às exigências de transparência estabelecidas pela legislação do bloco, permitindo que textos e códigos sejam identificados como produções de inteligência artificial por sistemas automatizados.
Funcionamento e tecnologia do sistema textGrain
O mecanismo, batizado pela empresa como textGrain, opera através da inserção de um sinal estatístico imperceptível ao olho humano, mas legível por máquinas. Segundo a OpenAI, essa tecnologia atua diretamente nas escolhas de palavras realizadas pelo modelo durante a geração do conteúdo. Em testes internos, a ferramenta demonstrou desempenho equiparável ou superior a outras soluções de mercado, como o SynthID.
Limitações técnicas e desafios de detecção
Apesar do avanço tecnológico, a própria desenvolvedora reconhece que a detecção não é infalível. A empresa alerta que o sistema está sujeito a falhas operacionais, podendo gerar tanto falsos positivos — quando o detector aponta uma marca d’água inexistente — quanto falsos negativos, nos casos em que o sinal presente não é identificado. A eficácia em ambientes controlados não garante, portanto, uma precisão absoluta no uso cotidiano.
Regras de transparência e conformidade legal
A iniciativa responde diretamente ao artigo 50 da Lei de IA da União Europeia, que impõe a obrigatoriedade de tornar conteúdos gerados por inteligência artificial identificáveis por meios técnicos. Grandes empresas do setor possuem um cronograma de adequação, com prazo limite estabelecido para o dia 2 de dezembro. Outras desenvolvedoras, como a Anthropic, já haviam anunciado medidas similares para alinhar suas operações às normas europeias.
Acesso restrito e uso em API’s
Para clientes que utilizam a interface de programação de aplicação (API), a marcação será disponibilizada como um recurso opcional, permanecendo desativada por padrão para conferir autonomia aos desenvolvedores. Além disso, a ferramenta de detecção não será disponibilizada ao público geral neste momento. O acesso será concedido de forma seletiva a pesquisadores e organizações especializadas, com relatórios que indicarão apenas a presença da marca, sem expor dados de usuários ou históricos de conversas.