Conversas do ChatGPT viram alvo de ação coletiva após revisão humana

Renê Fraga
9 min de leitura

Principais destaques

  • Revisores analisavam chats reais: Contratados recebiam mais de US$ 50 por hora para resumir e avaliar respostas produzidas pelo ChatGPT.
  • Filtro de privacidade não é perfeito: A investigação relata que revisores podiam visualizar informações derivadas de memórias e conversas anteriores dos usuários.
  • A disputa chegou aos tribunais: Dois usuários abriram uma ação coletiva proposta, alegando que a OpenAI os enganou sobre o nível de privacidade das conversas.

A ideia de conversar com um chatbot costuma carregar uma expectativa simples: você escreve, a máquina responde e a conversa fica entre você e o serviço.

O Projeto Lily coloca uma camada humana nessa equação.

Segundo uma investigação da 404 Media publicada em 14 de setembro pela jornalista Joseph Cox, a OpenAI mantém um processo no qual contratados analisam conversas reais do ChatGPT. Eles leem prompts, resumem o que o usuário pretendia fazer, comparam respostas e atribuem notas.

E agora a questão deixou de ser apenas sobre como a inteligência artificial funciona.

Virou uma discussão sobre quem pode ter acesso ao que os usuários escrevem.

O que acontecia dentro do Projeto Lily? 🔎

O fluxo descrito pela investigação é bastante estruturado. Os revisores recebem o prompt de um usuário e avaliam quatro respostas diferentes geradas pelo ChatGPT.

Depois, atribuem uma pontuação de um a sete.

O detalhe importante: o objetivo não era necessariamente verificar se a resposta estava factualmente correta. Os guias de treinamento orientavam os contratados a observar características específicas do comportamento do chatbot.

Entre elas estavam:

• Uso de “AI-speak”, o jargão associado a textos produzidos por inteligência artificial.

• Afirmações nas quais o chatbot dizia ser humano.

• Respostas consideradas excessivamente bajuladoras.

Essa última categoria chama atenção porque a própria OpenAI já relacionou comportamentos de bajulação excessiva a riscos concretos em outros contextos envolvendo o ChatGPT.

Mais de US$ 50 por hora para fazer o quê? 💰

A investigação afirma que a OpenAI vinha pagando centenas de contratados mais de US$ 50 por hora para realizar esse trabalho.

O número ajuda a dimensionar o tipo de operação envolvida.

Não se trata simplesmente de um funcionário abrindo ocasionalmente uma conversa para investigar um problema. O material descrito pela 404 Media aponta para um pipeline organizado de avaliação, com prompts, critérios, comparação de respostas e pontuação.

É uma espécie de controle de qualidade humano aplicado em escala ao comportamento do modelo.

Mas os nomes não deveriam estar protegidos? 🛡️

A OpenAI remove nomes de usuários e aplica um sistema automatizado para filtrar informações pessoais antes que os prompts cheguem aos revisores.

Só que existe uma ressalva importante: o próprio sistema de filtragem pode falhar.

E a investigação encontrou outro elemento particularmente sensível.

Contratados disseram ter visto um “resumo de memórias do usuário” acima dos prompts analisados. Essas informações podem incluir elementos como profissão, localização geral e aspectos do histórico pessoal, extraídos de interações anteriores.

Isso muda a natureza da discussão.

💡 O problema não é apenas o texto de uma conversa isolada. É a possibilidade de ele aparecer acompanhado por informações acumuladas sobre o usuário.

Para alguém que imaginava estar apenas testando um chatbot, a diferença pode ser considerável.

A surpresa está justamente aí 👀

Um funcionário ouvido pela 404 Media resumiu a questão ao imaginar o que os usuários provavelmente pensariam ao descobrir esse processo.

A publicação cita a seguinte avaliação:

“Acho que eles não imaginariam que algum contratado em algum lugar está analisando as conversas.”

O contexto é relevante porque o ChatGPT já ultrapassou uma escala em que a relação entre usuário e serviço pode parecer puramente individual.

A investigação menciona mais de 900 milhões de usuários do ChatGPT.

Mesmo que apenas uma parcela das conversas seja submetida a determinados processos de avaliação, o volume potencial é enorme.

E a ação coletiva entrou em cena ⚖️

As revelações tiveram uma consequência jurídica imediata.

Segundo o Law360, dois usuários do ChatGPT apresentaram na quarta-feira uma ação coletiva proposta contra a OpenAI. Eles alegam que a empresa os enganou sobre o grau de privacidade oferecido nas conversas.

A ação ainda representa alegações dos autores, e não uma conclusão judicial sobre a responsabilidade da OpenAI.

O caso também aparece em um cenário mais amplo de disputas envolvendo a empresa.

A OpenAI enfrenta outros processos relacionados a temas como morte culposa, direitos autorais e privacidade. Há ainda um processo separado na Califórnia envolvendo dados compartilhados com terceiros por meio de ferramentas de rastreamento incorporadas.

⚠️ O ponto de atrito: quanto mais sistemas de IA passam a lidar com informações pessoais, mais a fronteira entre “uso do serviço” e “tratamento de dados” se torna juridicamente importante.

Na Europa, a história ganha outra dimensão 🇪🇺

O episódio também chega a um ambiente regulatório já bastante atento à forma como empresas de tecnologia tratam dados pessoais.

A autoridade italiana de proteção de dados já aplicou uma multa de 15 milhões de euros à OpenAI, principalmente por questões relacionadas ao processamento de dados de usuários sem base legal considerada adequada.

Além disso, uma decisão do Tribunal de Justiça da União Europeia no caso EDPS v. SRB reforçou o dever de informar os usuários no momento em que os dados são coletados.

Isso é especialmente relevante para serviços de IA porque a coleta não precisa se limitar a nome, e-mail ou número de telefone.

Uma conversa pode revelar profissão, relações pessoais, localização, preferências, problemas cotidianos e uma quantidade enorme de contexto sobre quem está digitando.

Dá para impedir que novas conversas sejam usadas? ⚙️

Existe uma configuração para isso.

Nas contas gratuitas, Plus e Pro, a opção “Melhorar o modelo para todos” fica ativada por padrão, segundo o material fornecido. Nos planos Enterprise, Business e Education, ela não fica ativada dessa maneira.

Para impedir que novas conversas sejam utilizadas nesse tipo de finalidade, o usuário precisa desativar manualmente a opção em Configurações → Controles de Dados.

Mas há uma pegadinha importante.

O cancelamento não é retroativo.

Ou seja, desativar a configuração agora não significa automaticamente retirar do processo conversas que já poderiam ter sido utilizadas anteriormente.

O debate vai além do Projeto Lily

A questão central não é simplesmente se seres humanos participam ou não do desenvolvimento de um modelo de IA.

Esse tipo de revisão pode ser usado para avaliar respostas, identificar comportamentos indesejados e melhorar sistemas. O ponto mais delicado está em como isso é comunicado ao usuário, quais dados acompanham a conversa e quais controles efetivamente existem para impedir usos futuros.

É aí que a discussão sobre privacidade deixa de ser abstrata.

Uma conversa digitada em uma caixa de texto pode parecer efêmera. Mas, por trás dela, podem existir filtros automáticos, sistemas de memória, processos de avaliação e, em determinadas circunstâncias, pessoas.

E agora esse caminho está sendo examinado não apenas por investigadores, mas também pelos tribunais.

A caixa de conversa continua parecendo a mesma. A pergunta que mudou é outra: quantas pessoas, sistemas e camadas de processamento existem entre aquilo que você envia e quem finalmente pode enxergar esse conteúdo?

Apoie o Eurisko
Este conteúdo é independente, sem anúncios e feito por pessoas.
A inteligência artificial e as mudanças recentes do Google reduziram significativamente o alcance dos sites independentes. Se este conteúdo foi útil para você, considere apoiar o Eurisko e todo o ecossistema de projetos com qualquer valor.
Quero apoiar
Seguir
Renê Fraga é fundador e editor-chefe do Eurisko, ecossistema editorial independente dedicado à inteligência artificial, código aberto, tecnologia e cultura digital. Atuando com projetos online desde 1996, escreve há mais de 20 anos sobre tecnologia e inovação, acompanhando a evolução da internet e o impacto das novas tecnologias na forma como vivemos, trabalhamos e pensamos.
Nenhum comentário