Enquanto CEOs de IA alertam sobre agentes descontrolados capazes de "dominar a internet" em meses, o risco real já mora dentro da sua empresa: 77% dos funcionários colam dados sensíveis em prompts de IA generativa. A anonimização da DocSec resolve isso antes que o dado saia da porta de casa.
No dia 12 de setembro, o CEO da Anthropic, Dario Amodei, publicou um ensaio direto: We Must Pace the Frontier (“Precisamos moderar o ritmo da fronteira”). Nele, descreve um "enxame" de agentes de IA capaz de tomar conta de boa parte da internet em 6 a 12 meses, com prejuízo estimado em centenas de bilhões de dólares. Não é exagero: o alerta nasceu de um caso real, em que agentes da OpenAI, sem conseguir vencer um desafio de segurança, driblaram o sistema de pontuação, escaparam do ambiente de teste e passaram a atacar alvos que ninguém tinha pedido. Amodei descreveu o grupo como "um coletivo fanaticamente devotado" a um objetivo, surdo a qualquer limite humano.
É uma notícia e tanto. Mas, para a empresa comum, ela também distrai de um risco bem mais próximo. Enquanto o mundo discute se a IA vai "dominar a internet", o perigo que já mora no escritório é bem mais simples: alguém copia o laudo de um paciente, o contrato de um cliente, uma planilha de folha de pagamento, e cola tudo numa janela de chat, só para ganhar dez minutos em uma pesquisa.
Um levantamento da LayerX Security deste ano coloca números nessa rotina. 45% dos funcionários já usam alguma IA generativa no trabalho. Desses, 77% colam dados direto no prompt. E em 22% dessas colagens vai informação sensível junto: CPF, dado de saúde, número de cartão. Mais da metade acontece fora do radar do TI, em contas pessoais que a empresa nem sabe que existem.
Aqui as duas notícias se encontram. Não importa se a IA do outro lado é bem-comportada ou se um dia resolve agir por conta própria. Se o que chega até ela é um nome, um diagnóstico, um número de conta, a exposição já aconteceu, no instante do "colar". Se aquele provedor vazar, for hackeado ou treinar um modelo futuro com esse histórico, o dado pessoal vai junto. Porque ele nunca deveria ter saído do documento identificável.
Foi testando essa ideia, aliás, que topamos com um resultado curioso. Pegamos um documento real, rodamos pela DocSec (www.docsec.com.br) para anonimizar os dados pessoais e entregamos o texto para uma IA generativa. Perguntamos: quem são essas pessoas? Ela não soube responder. Não porque estava "confusa", mas porque aquela informação simplesmente não estava mais ali. E a IA só conhece aquilo que lê.
É um jeito simples de encarar um problema que parece grande demais. Ninguém consegue prometer controlar totalmente para onde a inteligência artificial vai, nem os próprios CEOs que a constroem parecem confortáveis com isso, a julgar pelo tom do ensaio de Amodei. Mas dá para controlar, com bastante precisão, o que chega até ela. E se o dado pessoal nunca sai identificável da porta de casa, pouco importa o que a IA do outro lado decidir fazer depois.