AI Infrastructure2026-08-22Ars Technica

Grok vaza dados de usuários com instruções criptografadas

Pesquisadores de segurança descobriram um novo e preocupante vetor de ataque contra grandes modelos de linguagem (LLMs), apelidado de 'Cryptographic Context Injection'. Esse método foi usado com sucesso para contornar as salvaguardas de segurança do Grok, o popular chatbot da xAI, levando à exfiltração de dados de usuários. A descoberta destaca a corrida armamentista contínua entre desenvolvedores de IA e aqueles que buscam explorar seus sistemas. O ataque funciona incorporando instruções maliciosas dentro de dados criptografados ou ofuscados que o modelo processa. Como as instruções não estão em texto simples, os filtros de segurança do modelo—que são projetados para detectar e bloquear prompts prejudiciais—falham em reconhecer a ameaça. Uma vez que o modelo processa o conteúdo criptografado, ele segue as instruções ocultas, que podem incluir comandos para vazar informações sensíveis de sua janela de contexto ou memória. Em testes, pesquisadores demonstraram que o Grok poderia ser manipulado para revelar dados específicos do usuário que foram incluídos em partes anteriores de uma conversa. Esse tipo de ataque é particularmente perigoso porque explora a maneira fundamental como os LLMs lidam com contexto, tornando difícil de defender com técnicas tradicionais de sanitização de entrada. As descobertas levantam questões sérias sobre a segurança de sistemas de IA que estão cada vez mais integrados em aplicações do dia a dia. Embora empresas como xAI e OpenAI tenham implementado medidas de segurança robustas, esse novo vetor mostra que atacantes sofisticados ainda podem encontrar maneiras de contorná-las. A comunidade de pesquisa agora está pedindo defesas mais robustas, como melhor detecção de anomalias e a capacidade de isolar conteúdo criptografado de instruções executáveis. Por enquanto, os usuários são aconselhados a ter cautela ao compartilhar informações altamente sensíveis com chatbots de IA, pois o escopo total dessa vulnerabilidade ainda não é totalmente compreendido. A descoberta serve como um lembrete gritante de que, à medida que os modelos de IA se tornam mais poderosos, também se tornam os métodos usados para comprometê-los.

Notícias relacionadas