Google Cloud e Mysten Labs criam “caixa-preta” verificável para agentes de IA

Renê Fraga
9 min de leitura

Principais destaques

  • Agentes sob auditoria: VAA cria provas criptográficas para verificar se agentes de IA respeitaram as permissões que receberam.
  • Dados continuam privados: prompts, respostas e chamadas de ferramentas ficam no Google Cloud, enquanto as provas de integridade são registradas na infraestrutura da Mysten Labs.
  • Responsabilidade entre empresas: a tecnologia mira transações entre agentes, incidentes de segurança e exigências regulatórias em um cenário no qual a IA ganha cada vez mais autonomia.

A inteligência artificial está começando a fazer coisas que antes exigiam uma pessoa apertando botões. Negocia pagamentos, chama APIs, conversa com outros agentes e pode tomar decisões dentro de limites previamente definidos.

O problema aparece quando alguém pergunta: ela realmente ficou dentro desses limites?

É justamente essa pergunta que o Google Cloud e a Mysten Labs querem responder com o Verifiable Agent Arbiter (VAA), um sistema anunciado pela Mysten Labs em 6 de outubro para criar evidências verificáveis sobre as ações executadas por agentes de IA.

A proposta é transformar o histórico de um agente em algo que empresas, auditores e reguladores possam verificar sem necessariamente receber acesso aos dados internos da companhia.

Não basta mais guardar logs 🧾

Logs tradicionais registram o que aconteceu. O problema é provar que esses registros continuam exatamente como foram produzidos.

A Mysten Labs resumiu a preocupação ao afirmar que “logs padrão não são suficientes” quando agentes começam a operar entre diferentes organizações.

O VAA tenta separar duas coisas: o registro detalhado da atividade e a prova criptográfica de que esse registro não foi adulterado.

🔐 A ideia central: a telemetria continua privada. Prompts, respostas do modelo, chamadas de ferramentas e decisões relacionadas a políticas ficam armazenados no Google Cloud Storage, sob controle do cliente.

Já as provas criptográficas são armazenadas na Walrus, plataforma descentralizada de dados da Mysten Labs, enquanto a blockchain Sui coordena o processo.

Na prática, uma empresa poderia demonstrar que determinado agente tomou uma decisão específica e que o registro apresentado posteriormente corresponde ao histórico original, sem precisar abrir toda a sua operação interna.

💡 O ponto mais importante do VAA não é registrar o que a IA fez. É permitir provar que o registro sobre o que ela fez não foi alterado depois.

E se dois agentes discordarem? 🤖

O problema fica mais interessante quando a IA deixa de trabalhar isoladamente.

O Google Cloud vem promovendo o Agent2Agent (A2A), protocolo desenvolvido pela empresa e doado à Linux Foundation para permitir que agentes de diferentes sistemas se comuniquem.

Imagine dois agentes representando empresas diferentes negociando uma contratação, uma compra ou o acesso a uma API.

Se alguma coisa der errado, surge uma pergunta bastante humana:

Quem autorizou o quê?

O VAA pretende permitir que os participantes reconstruam esse fluxo usando os mesmos recibos verificáveis.

Segundo a proposta apresentada pelas empresas, isso poderia reduzir disputas que hoje exigiriam a comparação manual de logs produzidos por sistemas diferentes.

Em vez de passar dias tentando descobrir qual registro está correto, as partes poderiam verificar as evidências criptográficas associadas à operação.

Segurança também entra na conta 🚨

O mesmo mecanismo pode ser útil quando um agente aparentemente sai do controle.

Uma ação inesperada pode ter várias explicações:

• um ataque de injeção de prompt;

• uma falha do próprio modelo;

• uma decisão que violou uma política;

• uma alteração posterior nos registros.

Sem evidências confiáveis, esses cenários podem parecer praticamente iguais.

🔎 O detalhe que interessa às equipes de segurança: o VAA pretende permitir a reconstrução do contexto de uma execução e ajudar a identificar se o agente realmente ultrapassou sua autoridade.

Isso muda o tipo de investigação. Em vez de apenas perguntar “o que o agente fez?”, a empresa consegue investigar também “o que ele estava autorizado a fazer naquele momento?”.

A IA vai começar a mexer com dinheiro 💸

O projeto também está sendo conectado ao Sui Agent Payments, sistema voltado a pagamentos realizados por agentes.

Nesse cenário, um agente pode localizar um serviço, contratar uma chamada de API e efetuar o pagamento usando o protocolo x402.

O VAA acrescentaria uma camada de comprovação ao processo, registrando elementos como:

• a autorização para realizar a operação;

• a decisão de gastar;

• a execução do pagamento;

• a confirmação de que o serviço contratado foi entregue.

É uma diferença importante.

Quando uma IA apenas escreve um e-mail, um log convencional talvez seja suficiente para investigar um problema. Quando ela começa a gastar dinheiro em nome de uma empresa, a exigência de rastreabilidade fica muito maior.

E a regulamentação? 🇪🇺

Esse movimento também conversa diretamente com a evolução das regras para inteligência artificial.

A Mysten Labs apresenta o VAA como uma ferramenta que pode ajudar empresas a lidar com futuras exigências de auditoria e registro, incluindo aquelas relacionadas à Lei de IA da União Europeia.

O material fornecido cita a possibilidade de multas de até € 15 milhões ou 3% do faturamento anual global para determinadas violações relacionadas ao registro de logs a partir de 2027.

Aqui existe uma distinção importante: o VAA não elimina a necessidade de cumprir regulamentações. A proposta é oferecer uma infraestrutura técnica que torne mais fácil demonstrar o que aconteceu dentro de um sistema de IA.

E isso pode se tornar especialmente relevante quando agentes passarem a tomar decisões que atravessam diferentes empresas, serviços e jurisdições.

Uma espécie de “caixa-preta” para agentes ✈️

A analogia com aviões ajuda a entender o conceito.

Um avião possui sistemas que registram informações importantes durante o voo. Se algo dá errado, investigadores precisam confiar nesses registros para reconstruir os acontecimentos.

O VAA tenta levar uma ideia parecida para agentes de IA, mas acrescentando uma camada criptográfica para comprovar a integridade das evidências.

A diferença é que, nesse caso, a “caixa-preta” não precisa necessariamente entregar todo o seu conteúdo a terceiros.

A empresa mantém os dados detalhados sob seu controle e compartilha a prova necessária para demonstrar que determinada informação é autêntica.

Ainda não é produto para todo mundo

Por enquanto, o VAA está em fase de implantação inicial com clientes corporativos.

A Mysten Labs ainda não revelou quais empresas participarão desses primeiros testes e também não divulgou uma data para disponibilidade geral.

O anúncio aconteceu durante o Sui Basecamp, em Singapura, evento no qual agentes de IA aparecem como uma das apostas da plataforma.

A empresa também afirmou ter demonstrado mais de 40 milhões de transações por segundo usando seus “tunnels”, número que ainda deverá passar por revisão independente da CertiK.

O que muda se isso funcionar?

O avanço dos agentes cria um problema curioso: quanto mais úteis eles ficam, mais difícil se torna tratá-los simplesmente como chatbots.

Um agente que consulta informações é uma coisa. Um agente que pode contratar serviços, negociar com outro agente, gastar dinheiro e tomar decisões dentro de uma organização é outra completamente diferente.

🧠 A consequência é inevitável: autonomia precisa vir acompanhada de responsabilidade verificável.

É aí que o VAA tenta ocupar espaço. Não como mais uma ferramenta para fazer a IA trabalhar, mas como uma espécie de trilha criptográfica para explicar e provar suas decisões depois que elas acontecerem.

Se os agentes realmente caminharem para um mundo em que centenas de sistemas automatizados negociam entre si, a pergunta talvez deixe de ser apenas “o que a IA fez?”.

Será cada vez mais importante saber “como podemos provar que ela tinha autorização para fazer isso?”

Apoie o Eurisko
Este conteúdo é independente, sem anúncios e feito por pessoas.
A inteligência artificial e as mudanças recentes do Google reduziram significativamente o alcance dos sites independentes. Se este conteúdo foi útil para você, considere apoiar o Eurisko e todo o ecossistema de projetos com qualquer valor.
Quero apoiar
Seguir
Renê Fraga é fundador e editor-chefe do Eurisko, ecossistema editorial independente dedicado à inteligência artificial, código aberto, tecnologia e cultura digital. Atuando com projetos online desde 1996, escreve há mais de 20 anos sobre tecnologia e inovação, acompanhando a evolução da internet e o impacto das novas tecnologias na forma como vivemos, trabalhamos e pensamos.
Nenhum comentário