Cibersegurança
A Anthropic Coloca a Prevenção de Perda de Dados em Linha Dentro da Empresa Claude

A Anthropic lançou ganchos de inferência em 5 de agosto de 2026, um recurso beta para a Empresa Claude que roteia cada prompt de funcionário por meio do próprio servidor de segurança da organização para um veredito de permitir ou negar antes que o modelo o veja. O sistema, descrito no anúncio da Anthropic, estende o tipo de prevenção de perda de dados em linha que as equipes de segurança já executam em e-mails e tráfego da web para sessões de chat, Claude Code e Claude Cowork, com uma configuração de nível de organização única.
Até agora, a única execução nativa em linha da Anthropic vivia nos ganchos do lado do cliente do Claude Code, que são executados na máquina do usuário. Os ganchos de inferência movem o ponto de verificação para os servidores da Anthropic, após um pedido deixar o cliente e antes que a inferência seja executada, então um controle cobre todas as superfícies governadas sem que nada seja instalado nos dispositivos do usuário.
Como funciona o caminho de execução
Quando um usuário em uma superfície governada envia um prompt, a Anthropic envia a transcrição da conversa para o servidor de segurança da organização por meio de uma conexão assinada e aguarda um veredito. Em caso de permissão, a inferência prossegue. Em caso de negação, o pedido nunca atinge o modelo e o usuário vê uma mensagem bloqueada por política construída a partir do motivo pelo qual o servidor de segurança retornou, além de um aviso permanente que os administradores da organização configuram, como o local para solicitar uma exceção. Cada negação é registrada no Feed de Atividades da organização.
A mesma inspeção é executada em chamadas de ferramentas. Quando o Claude invoca uma ferramenta, incluindo ferramentas conectadas por meio de conectores MCP, habilidades e plug-ins, a resposta da ferramenta é verificada antes de ser enviada de volta ao modelo. Isso fecha a outra metade do problema de movimento de dados: material sensível que entra em uma conversa a partir de um sistema conectado, e não apenas o que um funcionário cola. As respostas das ferramentas se tornaram uma superfície de ataque observada por exatamente esse motivo, pois elas transportam dados para o contexto do modelo a partir de fora do perímetro da organização, como pesquisas recentes sobre escapes de sandbox de agente destacaram.
O veredito em si é um pequeno objeto JSON e o servidor deve responder dentro de um tempo limite configurável, cinco segundos por padrão, de acordo com a documentação do produto. Os pedidos são assinados de acordo com a especificação de Webhooks Padrão assim que a organização gera um segredo de assinatura, para que o servidor de segurança possa verificar se o tráfego realmente veio da Anthropic.
O servidor de segurança vê o texto da transcrição, chamadas de ferramentas e seus resultados, e texto extraído de anexos. Ele nunca recebe bytes de arquivo ou imagem brutos, prompts do sistema, ou definições de ferramentas. Pedidos auxiliares, como a geração de títulos de conversa, pulam o endpoint e o modo de voz não é coberto.
Construído para ficar na frente da pilha de DLP existente
A Anthropic não está vendendo o mecanismo de digitalização. O protocolo é baseado em Webhooks com um esquema publicado e o anúncio nomeia Netskope, Palo Alto Networks (PANW ), Proofpoint e Zscaler como destinos que as organizações podem apontar o gancho, ao lado de servidores internos. Os fornecedores de segurança podem construir integrações contra o esquema documentado e ter clientes mútuos que roteiam vereditos para suas plataformas. A arquitetura inverte a implantação usual de DLP: em vez de o appliance do fornecedor perseguir tráfego de IA na rede, o provedor de IA chama a API de veredito do fornecedor em cada pedido. A Check Point adotou a abordagem espelhada dias antes, movendo a inspeção de prompt de IA para os seus firewalls para que a camada de rede intercepte o tráfego destinado ao modelo.
Os controles de rollout reconhecem que bloquear funcionários no primeiro dia é como os programas de DLP morrem. O modo de sombra observa os vereditos no tráfego ao vivo sem bloquear nada, um percentual de rollout inspeciona uma fração escolhida de pedidos e as exclusões isentam membros de papéis escolhidos por completo. Se o servidor de segurança for inacessível, cometer erros ou exceder o tempo limite, a organização escolhe a postura de falha: bloquear o pedido ou deixá-lo passar sem inspeção.
A documentação lista a DLP como a implantação mais comum, mas descreve outras três: arquivamento de transcrição em tempo real como uma alternativa baseada em push para a API de Conformidade da Anthropic, telemetria de prompt capturada no momento do uso e motores de política personalizados que impõem regras como listas de permissão de modelo ou restrições com escopo de projeto antes da inferência.
O que o beta não cobre
Os limites declarados na documentação definem o envelope atual. Os vereditos são binários: o servidor pode permitir ou negar um prompt, mas não pode reescrever ou redigir um. Os anexos chegam como metadados e texto extraído, então o conteúdo de apenas imagem, como uma captura de tela de um documento, por exemplo, não é inspecionado. O único evento de gancho no lançamento é acionado no prompt antes da inferência; a execução do lado da resposta, que verifica o que o modelo retorna, está planejada como um evento posterior. E o recurso governa apenas as superfícies da Empresa Claude: o acesso à API por meio da Plataforma Claude está fora do escopo e as organizações que executam o Claude no Amazon Bedrock ou no Google Cloud não recebem nada.
Isso deixa a disputa do ponto de inspeção com dois modelos ao vivo. Os controles de camada de rede veem qualquer coisa que cruze o fio, mas se esforçam contra o tráfego de IA criptografado e disperso; os ganchos do lado do provedor, como este, veem exatamente o que o modelo veria, mas apenas dentro do perímetro de um fornecedor. A documentação limita os ganchos às superfícies da Empresa Claude e exclui o Bedrock e o Google Cloud, enquanto a abordagem de firewall da Check Point inspeciona o tráfego na camada de rede.
Os ganchos de inferência estão disponíveis em beta para organizações da Empresa Claude, com configuração controlada atrás dos papéis de administrador da organização. O evento de prompt está ao vivo em todas as sessões da web, desktop e CLI do claude.ai, Cowork e Claude Code, e a documentação da Anthropic descreve a execução do lado da resposta como o próximo ponto de verificação a chegar.












