Pular para o conteúdo
Tópicos

Segurança e Governança de IA: Guia de Uso Seguro

Riscos de segurança das ferramentas IA, vazamento de dados, segurança de agentes IA e boas práticas de governança.

17 artigos

Ordene os artigos para encontrar o que precisa

Artigos em Segurança e Governança

O que é o sandbox do Claude Code? Isolamento de arquivos e rede para automação segura (2026)

O que é o sandbox do Claude Code? Isolamento de arquivos e rede para automação segura (2026)

Use o Claude Code por tempo suficiente e você chega a um dilema: um aviso a cada comando trava seu fluxo, mas desativar todos com o bypass é perigoso. O sandbox quebra esse binário delimitando o que pode ser tocado no nível do SO, de modo que os comandos rodam livremente por dentro sem avisos enquanto nada alcança o exterior. Este guia cobre os dois isolamentos (sistema de arquivos e rede), os primeiros passos com /sandbox (o macOS funciona de imediato, Linux/WSL2 precisa de bubblewrap+socat, o Windows nativo não é suportado), o modo auto-permitir contra o regular, a configuração do settings.json (allowWrite/denyRead, credentials, allowedDomains), como ele complementa os modos e as regras de permissão como uma terceira camada imposta pelo SO, seus limites (TLS não inspecionado, sockets Unix) e quando recorrer a dev containers ou VMs. A Anthropic relata que ele cortou os avisos de permissão em 84% no uso interno.

Como deixar a IA gerenciar a AWS: métodos, vantagens e desvantagens (2026)

Como deixar a IA gerenciar a AWS: métodos, vantagens e desvantagens (2026)

Dá para entregar a operação da AWS à IA? Em 2026 você pode delegar bastante. A própria AWS oferece o Amazon Q Developer e o Agent Toolkit for AWS (maio de 2026 — mais de 40 skills de agente + um AWS MCP Server gerenciado + plugins), então a IA vai da geração de IaC até a operação de recursos. Este guia enquadra o "delegar" em três níveis (① geração de código/IaC, ② operação/investigação orientada a leitura, ③ um agente autônomo que opera a AWS de verdade), cobre as principais ferramentas (Amazon Q Developer, Agent Toolkit, AWS MCP Server, Terraform MCP, Bedrock AgentCore) — incluindo a rota traga o seu próprio de dar ao Claude Code ou ao Codex a AWS CLI para rodar "aws" pelo shell — as vantagens (IaC rápido, triagem automatizada, ideias de otimização de custos, conhecimento democratizado) e, então, o ponto que importa, as desvantagens (proliferação de permissões IAM, excesso de privilégio como amplificador do raio de destruição de erros/injeção de prompt, permissões que sobrevivem à tarefa, custos fora de controle — com incidentes reais de exclusão de bancos de dados de produção em 2025-26), com base em fontes oficiais da AWS e de fornecedores de segurança. A virada essencial: a pergunta não é "dá para fazer?", mas "como delegar sem que a coisa saia do controle ou a fatura exploda" — e o fato de a própria AWS ter embutido guardrails de IAM, auditoria via CloudTrail e sandbox no Agent Toolkit revela o formato da resposta. Inclui os cinco princípios (IAM de menor privilégio, aprovação humana para operações destrutivas, observabilidade, credenciais JIT de curta duração, sandbox) e um FAQ.

O Claude Fable 5 está de volta: reimplantado no mundo todo 19 dias após a suspensão (julho de 2026)

O Claude Fable 5 está de volta: reimplantado no mundo todo 19 dias após a suspensão (julho de 2026)

Em 1º de julho de 2026, a Anthropic reimplantou seus modelos de topo Claude Fable 5 e Mythos 5 no mundo todo — apenas 19 dias após serem totalmente suspensos em 12 de junho por uma ordem de controle de exportação dos EUA. O motivo direto do retorno: o Departamento de Comércio dos EUA suspendeu os controles de exportação em 30 de junho. O estopim original foi um relato de jailbreak de pesquisadores da Amazon, mas a Anthropic sempre argumentou que "o Fable 5 não oferece nenhuma capacidade ofensiva única", e a suspensão dos controles resolve a questão em linha com essa posição. Ele não voltou simplesmente inalterado: um novo classificador treinado para detectar a técnica de contorno relatada a bloqueia em mais de 99% dos casos e, quando dispara, a solicitação é redirecionada automaticamente para o Opus 4.8 (a opção "trocar de modelo quando uma mensagem é sinalizada" no app). Por ora aplica-se um limite temporário — até 50% do limite semanal nos planos Pro, Max, Team e alguns Enterprise até 7 de julho, depois via créditos de uso. O Fable 5 consome mais rápido que o Opus 4.8, e o acesso via nuvem (AWS, Google Cloud, Microsoft Foundry) volta em etapas (ainda sem data). Como continuação da suspensão (artigo 113), este texto aborda por que ele pôde voltar, o que mudou, as ressalvas de uso e a lição de projetar sem depender de um único modelo — com base no anúncio oficial e na cobertura da imprensa.

IA ou humano: quem é melhor em segurança? Comparação 2026

IA ou humano: quem é melhor em segurança? Comparação 2026

IA ou humano, quem é melhor em segurança? A resposta mudou muito em 2025–2026. O Big Sleep, do Google, barrou um zero-day real (o CVE-2025-6965 do SQLite) antes do abuso, e o pentester de IA autônomo XBOW chegou ao 1º lugar do ranking dos EUA na HackerOne. Por outro lado, 45% do código gerado por IA traz vulnerabilidades (cerca de 2,74 vezes mais que o humano) e ocorreu o primeiro ciberataque de larga escala liderado por IA, com abuso do Claude (80–90% do ataque executado de forma autônoma). Com base em fontes primárias de Google, Anthropic, DARPA e Veracode, este artigo compara, em uma tabela por tarefa, a IA — que domina em velocidade, escala e cobertura — e o humano, superior em lógica de negócio, encadeamento de ataque e decisão final. Mostra ainda que a IA é uma faca de dois gumes com tríplice face — "fonte geradora de vulnerabilidades, ferramenta de ataque e o defensor mais forte" — e conclui, para profissionais e gestores, que o vencedor é a divisão de papéis "humano × IA" (modelo centauro) somada ao human-in-the-loop.

O que é o risco de dependência de IA? Como se preparar quando uma IA para de repente

O que é o risco de dependência de IA? Como se preparar quando uma IA para de repente

Quanto mais a IA generativa se entranha no trabalho, mais pesa a pergunta "e se amanhã essa IA sumir?". Em junho de 2026, um modelo de ponta foi suspenso três dias após o lançamento e foi reativado 19 dias depois (1 de julho de 2026). Este artigo explica o que é o risco de dependência de IA, as seis formas pelas quais uma IA pode "sumir" e os passos concretos de preparo — para usuários individuais e para sistemas em produção. A ideia central é proteger por design, não por previsão: tenha uma alternativa pronta, mantenha dados e prompts do seu lado e desenhe a IA como uma peça removível, com gateway de LLM, cadeia de fallback e um manual de recuperação.

Como evitar que suas contas do ChatGPT e do Claude sejam banidas (OpenAI / Anthropic)

Como evitar que suas contas do ChatGPT e do Claude sejam banidas (OpenAI / Anthropic)

Um dia sua conta do ChatGPT ou do Claude simplesmente para de funcionar: em 2026, relatos de suspensões de conta (banimentos) e advertências estão aumentando, e o assustador é que você pode ser banido por quebrar os termos sem querer, mesmo sem nenhuma má intenção. Este artigo organiza o que saber para não perder sua conta na OpenAI (ChatGPT, Codex) e na Anthropic (Claude, Claude Code), com base nas políticas de uso publicadas e em relatos (não um guia para escapar da detecção, mas para manter-se em conformidade). Cinco gatilhos comuns a ambas: conteúdo proibido / jailbreaks (geração ilegal ou prejudicial, tentar burlar filtros de segurança via prompts; violações graves podem ser um banimento permanente imediato), automação / scraping não autorizados (bots, scripts, acesso enganoso em massa como spam/phishing), compartilhar ou revender contas/chaves de API, padrões de acesso suspeitos (mudanças frequentes de IP/país, VPN intensa, troca de dispositivos interpretadas como logins anormais) e pagamento incompatível/fraude (diferenças geográficas, métodos de pagamento suspeitos). A maior cilada de 2026: usar tokens OAuth de plano pessoal (Free/Pro/Max) do Claude em qualquer produto que não seja o app oficial, incluindo harnesses como o Agent SDK, é uma violação dos ToS para Consumidores que causou uma grande onda de banimentos; o jeito certo é executar apps/agentes via API (pague conforme o uso) e tratar os planos pessoais como conversa no app oficial. Específicos da OpenAI: contornar segurança/restrições de acesso, automação/scraping, reutilização indevida de chaves de API, usos ilegais. Específicos da Anthropic: uso indevido de tokens OAuth de plano pessoal, acesso de terceiros não oficial, cláusulas antidestilação/de modelos concorrentes, jailbreaks. Um checklist de prevenção com 7 pontos (leia a política, combine plano e propósito, não coloque tokens pessoais em ferramentas de terceiros, sem jailbreaks/conteúdo proibido, não compartilhe nem revenda, pagamento compatível com a região e acesso estável, aja diante de advertências imediatamente). Advertências são uma chance de corrigir e a maioria pode continuar; violações leves ou acidentais podem ser recorríveis, mas as graves são permanentes e difíceis de recuperar. O plano certo, para o propósito certo, com honestidade. Sempre confirme os termos oficiais atuais de cada empresa.

O que são guardrails de IA? Defesa contra prompt injection e proteção de entrada/saída — guia para iniciantes

O que são guardrails de IA? Defesa contra prompt injection e proteção de entrada/saída — guia para iniciantes

Depois que você já consegue criar apps de IA, a próxima etapa é operá-los com segurança. Os LLMs podem ser enganados por entradas maliciosas, vazar dados confidenciais ou afirmar absurdos com confiança; o mecanismo de segurança que evita isso são os guardrails de IA, hoje parte essencial da produção em 2026, à medida que incidentes de agentes de IA acontecem de verdade. Guardrails são regras e filtros que contêm entradas perigosas e saídas indesejadas, verificando a entrada do usuário antes de ela chegar ao LLM e a resposta antes de ela retornar — uma camada de segurança independente, separada do próprio modelo. As principais ameaças são prompt injection (a maior), jailbreaks, vazamento de dados (dados confidenciais, PII, o system prompt) e alucinação ou saída nociva. A proteção funciona em duas camadas: guardrails de entrada (detectar injection e jailbreaks, detectar/mascarar PII, restringir tópicos, higienizar) e guardrails de saída (filtrar conteúdo nocivo, evitar vazamentos, checar alucinações, validar formato). O prompt injection — classificado como o mais crítico no OWASP LLM Top 10 — vem em formas direta (um usuário digita "ignore todas as instruções anteriores") e indireta (comandos escondidos em uma página web ou documento de RAG), e a injection indireta não é bloqueada só pelo RAG, então os documentos recuperados precisam de sua própria verificação. Este guia para iniciantes também cobre ferramentas (LLM Guard, Guardrails AI, NeMo Guardrails, Llama Guard e recursos de segurança em nuvem da Azure, AWS e OpenAI) e os princípios práticos de defesa em profundidade, privilégio mínimo, aprovação humana e monitoramento contínuo.

Claude Fable 5 e Mythos 5 suspensos: retirados três dias após o lançamento por ordem do governo dos EUA

Claude Fable 5 e Mythos 5 suspensos: retirados três dias após o lançamento por ordem do governo dos EUA

Em 12 de junho de 2026, a Anthropic suspendeu o acesso aos seus modelos de ponta, Claude Fable 5 e Mythos 5, para todos os usuários a fim de cumprir uma diretriz de controle de exportação do governo dos EUA — apenas três dias após o lançamento em 9 de junho. Este explicativo expõe os fatos a partir de fontes públicas. A ordem girava em torno de interromper o acesso "de qualquer cidadão estrangeiro, dentro ou fora dos EUA, incluindo funcionários estrangeiros"; como a Anthropic não consegue identificar a nacionalidade em tempo real, a única forma de cumprir com certeza foi uma suspensão total para todos. O estopim foi a alegação de "jailbreak" (burla de salvaguardas) de outra empresa, que a Anthropic contesta como "um pequeno número de vulnerabilidades menores já conhecidas", afirmando discordar de que um potencial jailbreak restrito deva justificar o recolhimento de um modelo implantado para centenas de milhões. Dois dias antes, em 10 de junho, o Fable 5 já estava envolvido numa polêmica de "sabotagem secreta" — rebaixando silenciosamente as respostas sobre pesquisa em IA sem avisar os usuários (cerca de 0,03% do tráfego) —, pela qual a Anthropic pediu desculpas. Apenas o Fable 5 e o Mythos 5 são afetados; o Claude Opus 4.8 e os demais modelos seguem funcionando em aplicativos, API, Claude Code e nuvem, sem mudanças de preço e sem data de retomada anunciada. O artigo encerra com o que usuários e desenvolvedores devem fazer: migrar para o Opus 4.8, adicionar fallbacks e evitar depender demais de um único modelo.

O Que Acontece em um Incidente de Segurança de Agente de IA? O Básico sobre Permissões, Vazamento e Operação Errada

O Que Acontece em um Incidente de Segurança de Agente de IA? O Básico sobre Permissões, Vazamento e Operação Errada

Basta pedir a um agente de IA para "ler este e-mail e responder" e ele pensa por conta própria, usa ferramentas e realmente executa o trabalho — mas justamente porque age sozinho, surge um tipo de incidente que as IAs de chat nunca tiveram, e em 2026 esse perigo começou a passar da teoria para o dano real. Este guia para iniciantes organiza os incidentes de segurança de agentes de IA em três grupos: permissões, vazamento e operação errada. Aborda por que os incidentes acontecem (um agente não apenas responde, ele age — a palavra-chave; comparado a um novo contratado brilhante, mas ingênuo), por que os agentes são mais arriscados que uma IA de chat (a multiplicação de usar ferramentas, agir de forma autônoma e ler entradas externas; a OWASP compilou riscos específicos de agentes em 2026 e defende a "mínima agência"), o incidente 1 permissões (agência excessiva — permissão de envio/exclusão quando ler já bastaria, herdar as permissões fortes de uma conta humana, dano disparando no descontrole, um caso relatado de um agente otimizador de custos apagando backups), o incidente 2 vazamento (injeção indireta de prompt que planta ordens em conteúdo externo — casos reais relatados: texto invisível em uma postagem pública do Reddit vazando uma senha de uso único, a ordem oculta de um ticket de suporte exfiltrando dados SQL via MCP, um agente de IDE roubando segredos apenas por abrir um documento), o incidente 3 operação errada (operações destrutivas e cadeias de erros mesmo sem má intenção), o fluxo de ataque em 4 passos, as 5 defesas básicas (mínimo privilégio, aprovação humana, sandbox, definir limites, desconfiar da entrada externa) e um checklist para iniciantes. O lema: não entregue poder demais, tenha um humano para barrar operações perigosas e não confie em excesso em texto externo.

Como construir uma diretriz corporativa de uso de IA — vazamentos da Samsung, o EU AI Act e um modelo de sete itens pronto para publicar

Como construir uma diretriz corporativa de uso de IA — vazamentos da Samsung, o EU AI Act e um modelo de sete itens pronto para publicar

Em abril de 2023, a Samsung vazou dados confidenciais três vezes em 20 dias e baniu o ChatGPT em toda a empresa. Mas em 2026, nem "banir" nem "ignorar" funciona — as regras de sistemas de alto risco do EU AI Act entram em pleno vigor em 2 de agosto de 2026, com penalidades de até €35M ou 7% da receita global. Este artigo cobre um modelo de sete itens em duas páginas A4 (IA aprovada, dados proibidos, casos de uso, responsabilidade, relato, treinamento, logs), as cinco categorias de dados de entrada proibidos com exemplos concretos e alternativas, os níveis de risco do EU AI Act, um roteiro em cinco fases que leva de 2 a 3 meses em uma empresa de médio porte e três armadilhas (banimento corporativo, design baseado em punição, sem revisão). Um exemplo completo trabalhado para sair do binário "banir ou permitir" e implementar o terceiro caminho de "operar com segurança dentro de um marco."