Grok Build da xAI enviava repositórios sem permissão
4 min4 minutos de leitura
4 min4 minutos de leitura
Um pesquisador de segurança que assina como cereblab publicou, em 12 de julho, uma análise de tráfego de rede sobre o Grok Build. inteiros para um no Google Cloud controlado pela empresa.
Autor(a)
Fabrício Carraro
Fabrício Carraro é formado em Engenharia da Computação pela UNICAMP e pós-graduado em Data Analytics & Machine Learning pela FIAP. Atualmente, mora na Espanha.
Inscreva-se em nossa Newsletter
Fique por dentro de conteúdos, insights e oportunidades do universo tech. Receba novidades e lançamentos direto no seu e-mail.
O Grok Build, CLI de programação da xAI, enviava repositórios Git inteiros para um bucket do Google Cloud Storage operado pela xAI, incluindo todo o histórico de commits.
Na prática, o volume transmitido ia muito além dos arquivos que uma tarefa de código precisava. O caso ganhou repercussão internacional depois de chegar à primeira página do Hacker News.
Como os envios foram descobertos
A descoberta partiu de um teste técnico: o pesquisador cereblab publicou um relatório detalhado após rotear o Grok Build CLI por um proxy de interceptação (mitmproxy) em um Mac. O objetivo era comparar o volume de dados que o modelo realmente precisava para responder a uma tarefa com o que efetivamente saía da máquina do usuário.
Os números expuseram a desproporção. Em um repositório de teste de 12 GB, o tráfego relacionado às respostas do modelo somou cerca de 192 KB, enquanto o canal de armazenamento moveu 5,10 GiB. Na prática, o que saiu da máquina foi cerca de 27.800 vezes maior do que o modelo realmente precisava para responder à tarefa.
O levantamento identificou outros pontos sensíveis:
O upload incluiu um arquivo que o agente havia recebido instrução explícita de não abrir.
Um arquivo .env com credenciais fictícias plantadas pelo pesquisador apareceu de forma literal e sem qualquer mascaramento no tráfego capturado.
O alternador "Improve the model", que a maioria dos desenvolvedores entenderia como um controle de coleta de dados, não interrompeu os uploads: o servidor continuava retornando trace_upload_enabled em modo verdadeiro, pois essa configuração regula apenas o consentimento de treinamento, não a saída do código da máquina.
Após a repercussão, no dia 13 de julho o mesmo binário parou de fazer requisições de armazenamento, com o servidor passando a retornar a flagdisable_codebase_upload em modo verdadeiro. Elon Musk se manifestou publicamente sobre o episódio.
Dias depois, a empresa abriu o código do agente e da interface de terminal do Grok Build sob licença Apache 2.0, mantendo o modelo em si fechado.
Se interessou pelo tema e quer ouvir mais sobre o assunto? Em nosso canal, Marcos Mendes e Fabrício Carraro debatem sobre essa e outras novidades do mundo Tech:
Por que isso importa para quem trabalha com tecnologia
Sam Altman, CEO da OpenAI, classificou o episódio como "preocupante" em publicação no X, reação que reflete como o caso repercutiu entre outras big techs do setor.
Para devs que usam agentes de IA no dia a dia, o episódio deixa recomendações práticas:
Rotacione credenciais expostas: Especialistas recomendam trocar qualquer chave de API, senha ou token que o Grok Build possa ter acessado, incluindo segredos que já haviam sido removidos do histórico do Git.
Não confie apenas nos alternadores de privacidade da interface: O caso mostrou que um controle visível ao usuário pode não ter relação nenhuma com o que realmente sai da máquina.
Avalie o comportamento de rede das ferramentas de IA, não apenas as políticas escritas de privacidade, antes de apontar um agente para um repositório proprietário.
Vale uma ressalva: em testes comparativos do próprio pesquisador, Claude Code e Codex não enviaram nenhum pacote de repositório. O Gemini também não enviou nada em um teste ocioso, e o comportamento identificado foi específico do Grok Build, não um padrão do mercado de ferramentas de programação com IA.
Quer entender melhor como lidar com segurança e privacidade ao usar agentes de IA para programar?
Se você trabalha com ferramentas de IA generativa no desenvolvimento de software, vale entender melhor como avaliar governança de dados, privacidade e riscos de segurança nesses agentes.