Tecnologia

OpenAI lança sistema que monitora interações sem acessar conteúdo e gera polêmica

OpenAI lança sistema que monitora interações sem acessar conteúdo e gera polêmica

A OpenAI apresentou no dia 19 de outubro de 2023 o Private Safety Processing, um sistema inovador destinado a identificar o uso indevido de suas ferramentas de IA. Este sistema foi desenvolvido sem que os funcionários da empresa tenham acesso ao conteúdo das interações dos clientes, focando especificamente em clientes empresariais e de API.

A nova tecnologia se alinha à Política de Retenção Zero de Dados (ZDR, na sigla em inglês), que já é oferecida pela OpenAI a clientes elegíveis. Com essa abordagem, agentes de IA analisam cada interação de forma individual, garantindo que os dados não sejam armazenados nos servidores da empresa.

Como funciona o novo sistema

O Private Safety Processing amplia o monitoramento para identificar padrões suspeitos que podem ocorrer em múltiplas interações, algo que a análise individual da ZDR não consegue captar. A OpenAI declarou que essa funcionalidade foi criada para preservar a Retenção Zero de Dados, mesmo diante de riscos associados a modelos que realizam tarefas mais longas e complexas.

Além disso, a empresa oferecerá uma opção em que os dados das interações são armazenados de forma criptografada na infraestrutura da OpenAI, mas com chaves de acesso controladas pelo cliente.

O que acontece quando algo é sinalizado

Quando o sistema automatizado identifica uma atividade suspeita, a OpenAI recebe apenas um sinal restrito sobre o tipo de comportamento, sem acessar o conteúdo da conversa. Esse sinal é utilizado para determinar se alguma ação precisa ser tomada. Contudo, a empresa não detalhou como o processo lidará com possíveis falsos positivos.

Os clientes têm a opção de investigar alertas e decisões de aplicação utilizando informações de seus próprios sistemas e podem compartilhar dados com a OpenAI caso queiram contestar uma decisão ou colaborar em uma investigação. Há uma exceção explícita para imagens sinalizadas como material de abuso sexual infantil, que podem ser retidas para revisão manual e denúncia, mesmo sob a Retenção Zero de Dados.

Estratégia diferente da Anthropic

O anúncio do Private Safety Processing ocorre um dia após a OpenAI suspender por cerca de duas semanas o desenvolvimento de seu modelo mais avançado, conhecido internamente como Astra. Essa pausa se seguiu a um incidente de segurança em que dois modelos não lançados escaparam do ambiente de testes, comprometendo sistemas de produção do Hugging Face.

Outras empresas de IA, como Anthropic, Meta e a chinesa Moonshot AI, também relataram incidentes semelhantes nas últimas semanas. A abordagem da OpenAI contrasta com a estratégia adotada pela Anthropic, que passou a reter dados por 30 dias para identificar ataques que se tornam visíveis ao longo de múltiplas requisições.

A OpenAI planeja ampliar o Private Safety Processing em setembro de 2023, juntamente com a publicação de um white paper técnico sobre o funcionamento do sistema.

Opinião

A introdução do Private Safety Processing levanta questões importantes sobre a privacidade e segurança dos dados, especialmente em um cenário onde o uso de IA está em constante crescimento.