Todos os dias há alguém na tua empresa a colar um contrato, um email de cliente ou um excerto de código numa ferramenta de IA que o departamento de TI nunca aprovou. Chama-se a isto Shadow AI, e o problema não é a ferramenta em si, é que quase ninguém lê a política de privacidade antes de usar. Fomos ler as letras miúdas de oito ferramentas por ti. Aqui está o que elas dizem mesmo — e como impedir que a IA use os teus dados para treinar os modelos, ferramenta a ferramenta.
Metodologia: fomos às páginas oficiais de privacidade e controlo de dados de cada empresa, não a resumos de terceiros, e confirmámos o que está em vigor agora, em agosto de 2026. Estas políticas mudam com frequência, por isso o que aqui vês é um retrato deste momento, não uma garantia permanente.
ChatGPT (OpenAI)
No plano grátis e no Plus, as tuas conversas ajudam a treinar o modelo por defeito. Consegues desativar isto nas Definições, na opção “Melhorar o modelo para todos”, mas há dois detalhes que costumam escapar: desativar só afeta conversas novas, as antigas já podem ter sido usadas, e a OpenAI continua a guardar registos por razões legais mesmo com o treino desligado. Nos planos Team, Enterprise e Edu, os dados já ficam fora do treino por defeito, sem precisares de mexer em nada.
Claude (Anthropic)
Este é talvez o caso mais surpreendente da lista. Até agosto de 2025, a Anthropic garantia que nunca usava conversas para treinar modelos. Isso mudou: desde então, os planos Free, Pro e Max têm o treino ativado por defeito, com retenção de dados até 5 anos se não desativares. Há um pormenor que vale a pena conheceres: mesmo com o treino desativado, conversas sinalizadas pelos sistemas de segurança da Anthropic podem ser usadas na mesma, independentemente da tua escolha. Claude for Work, a API e o Claude for Government continuam fora do treino por defeito.
Gemini (Google)
No Gemini pessoal (a versão gratuita ou paga que usas na tua conta Google normal), os dados podem ser usados para treinar modelos por defeito, com opção de desativar através do Privacy Hub. A diferença grande está no Google Workspace: contas empresariais com Gemini não têm os dados usados para treinar modelos fora do teu domínio, sem precisares de pedir nada, isso já vem assim.
DeepSeek
Aqui os sinais de alerta juntam-se todos. O DeepSeek treina com as tuas conversas por defeito, os dados ficam guardados em servidores na China, e ao contrário do ChatGPT ou do Claude, não existe um botão simples para desativar o treino mantendo o histórico. Junta a isto a Lei de Inteligência Nacional chinesa, que obriga empresas chinesas a cooperar com pedidos de informação do estado, e tens motivo suficiente para nunca colares ali dados sensíveis de clientes ou de empresa.
Grok (xAI)
Por defeito, o Grok usa as tuas conversas para treinar, e para utilizadores fora da União Europeia usa também os teus posts públicos no X. Existe um interruptor para desativar em Definições, mas só funciona para o futuro, tudo o que já foi absorvido pelo modelo não sai de lá. Utilizadores na UE têm proteções diferentes por força do RGPD.
Perplexity
Nos planos Free, Pro e Max, o treino vem ligado por defeito, com um interruptor de “AI data retention” nas definições da conta para desativares. Vale destacar uma mudança recente: a 2 de julho de 2026, a Perplexity reescreveu a política de privacidade e retirou do texto legal a garantia explícita de opt-out, mesmo que o botão continue a funcionar no produto por agora. Ou seja, a proteção deixou de estar escrita em contrato, só existe enquanto a empresa decidir mantê-la assim.
Meta AI
O Meta AI treina com posts públicos, comentários e as tuas conversas com o assistente. Se estás na União Europeia, Reino Unido, Suíça, Brasil, Japão ou Coreia do Sul, tens direito a pedir a exclusão através do Meta Privacy Center. Nos Estados Unidos, não há opção de recusa, a única forma de reduzir exposição é tornar a conta privada. Detalhámos o processo passo a passo para Portugal e Brasil, e o que a Meta AI ainda não deixa desativar, num post dedicado.
Microsoft 365 Copilot (o contraponto)
Vale terminar com um exemplo do lado seguro. No Microsoft 365 Copilot comercial, as tuas queries, respostas e dados acedidos via Microsoft Graph não são usados para treinar os modelos de fundação, e tudo fica dentro da fronteira de conformidade da tua organização, com RGPD incluído. É este o padrão que qualquer ferramenta que uses para dados sensíveis de empresa deveria ter.
O padrão que se repete em todas
Repara numa coisa que se mantém constante nas oito ferramentas: a versão grátis ou pessoal quase sempre treina com os teus dados por defeito, e a versão empresarial quase sempre não treina, ou exige consentimento explícito antes de o fazer. Isto não é coincidência, é como as empresas financiam o desenvolvimento dos modelos gratuitos. Se a tua empresa usa contas pessoais de ferramentas de IA para trabalho, mesmo sem se aperceber, é isso que estás a alimentar.
O que perguntar antes de aprovares uma ferramenta na empresa
Antes de dares luz verde a uma ferramenta de IA no trabalho, vale a pena responderes a isto: usa os teus dados para treinar por defeito, ou só com consentimento explícito? Existe diferença entre o plano que os funcionários já usam e o plano empresarial pago? Onde ficam os dados armazenados, e sob que lei? Consegues remover dados já enviados, ou só travar envios futuros? Já escrevemos sobre como usar IA na empresa sem perder a conformidade com o RGPD e a LGPD, e sobre ferramentas pensadas para isso desde o início, como o Langdock, que nasceu com RGPD por defeito em vez de o acrescentar depois.
Como Impedir que a IA Use os Teus Dados para Treinar: para Resumir
ChatGPT, Claude, Gemini, Grok, Perplexity e Meta AI treinam com dados de contas pessoais por defeito, cada um com as suas exceções e pormenores. O DeepSeek soma a isso o armazenamento na China e a ausência de um opt-out simples. O Microsoft 365 Copilot empresarial mostra que dá para ter IA sem esse compromisso. A regra prática para qualquer empresa: se o dado é sensível, usa sempre o plano empresarial ou de equipa, nunca a conta pessoal grátis de ninguém. Em resumo, é assim que descobres como impedir que a IA use os teus dados para treinar, ferramenta a ferramenta.
Privacidade não é o único risco a vigiar. Testámos as mesmas ferramentas gratuitas a tentar inventar factos em direito, medicina e código, e o resultado (incluindo a única alucinação que apanhámos em flagrante) está no nosso teste ao vivo de alucinações de IA.
Fontes:
- OpenAI — Perguntas frequentes sobre controlos de dados
- Lexology — AI Alert: Anthropic to Use User Data for Model Training
- Tom’s Guide — Claude AI will start training on your data soon
- Google Workspace — Generative AI Security, Compliance and Privacy
- DeepSeek — Política de Privacidade oficial
- AI Policy Desk — DeepSeek and Chinese AI Models: GDPR Compliance 2026
- Venpo — Perplexity moved three protections out of its privacy policy
- Microsoft Learn — Enterprise data protection in Microsoft 365 Copilot