Ciberseguridad
Anthropic Incorpora la Prevención de Pérdida de Datos en Línea en Claude Enterprise

Anthropic lanzó hooks de inferencia el 5 de agosto de 2026, una función beta para Claude Enterprise que envía cada prompt de empleado a través del servidor de seguridad de la organización para un veredicto de permitir o denegar antes de que el modelo lo vea. El sistema, descrito en el anuncio de Anthropic, extiende el tipo de prevención de pérdida de datos en línea que los equipos de seguridad ya ejecutan en el correo electrónico y el tráfico web a sesiones de chat, Claude Code y Claude Cowork, con una sola configuración a nivel de organización.
Hasta ahora, la única aplicación nativa de Anthropic vivía en los hooks del lado del cliente de Claude Code, que se ejecutan en la máquina del usuario. Los hooks de inferencia mueven el punto de control a los servidores de Anthropic, después de que una solicitud sale del cliente y antes de que se ejecute la inferencia, por lo que un control cubre todas las superficies gobernadas sin que se instale nada en los dispositivos de los usuarios.
Cómo funciona el camino de aplicación
Cuando un usuario en una superficie gobernada envía un prompt, Anthropic envía la transcripción de la conversación al servidor de seguridad de la organización a través de una conexión firmada y espera un veredicto. En caso de permitir, la inferencia procede. En caso de denegar, la solicitud nunca llega al modelo, y el usuario ve un mensaje bloqueado por política construido a partir de la razón por la que el servidor de seguridad lo devolvió, más un aviso permanente que los administradores de la organización configuran, como dónde solicitar una excepción. Cada denegación aterriza en el Feed de Actividad de la organización.
La misma inspección se ejecuta en las llamadas a herramientas. Cuando Claude invoca una herramienta, incluidas las herramientas conectadas a través de conectores MCP, habilidades y complementos, la respuesta de la herramienta se verifica antes de que se devuelva al modelo. Eso cierra la otra mitad del problema de movimiento de datos: material sensible que ingresa a una conversación desde un sistema conectado, no solo lo que un empleado pega. Las respuestas de las herramientas se han convertido en una superficie de ataque vigilada por esta razón, ya que llevan datos al contexto del modelo desde fuera del perímetro de la organización, como ha subrayado la investigación reciente sobre evadir el sandbox de los agentes.
El veredicto en sí es un pequeño objeto JSON, y el servidor debe responder dentro de un tiempo de espera configurable, cinco segundos por defecto, según la documentación del producto. Las solicitudes están firmadas bajo la especificación de Webhooks Estándar una vez que la organización genera un secreto de firma, por lo que el servidor de seguridad puede verificar que el tráfico provino genuinamente de Anthropic.
El servidor de seguridad ve el texto de la transcripción, las llamadas a herramientas y sus resultados, y el texto extraído de los archivos adjuntos. Nunca recibe bytes de archivo o imagen sin procesar, solicitudes del sistema, definiciones de herramientas. Las solicitudes auxiliares como la generación de títulos de conversación omiten el punto final, y el modo de voz no está cubierto.
Construido para sentarse frente a la pila de DLP existente
Anthropic no vende el motor de escaneo. El protocolo es basado en webhooks con un esquema publicado, y el anuncio nombra a Netskope, Palo Alto Networks (PANW ), Proofpoint y Zscaler como destinos a los que las organizaciones pueden apuntar el gancho, junto con servidores internos. Los proveedores de seguridad pueden construir integraciones contra el esquema documentado y tener clientes mutuos que envían veredictos a sus plataformas. La arquitectura invierte la implementación de DLP habitual: en lugar de que el dispositivo del proveedor persiga el tráfico de IA en la red, el proveedor de IA llama a la API de veredictos del proveedor en cada solicitud. Check Point tomó el enfoque de espejo días antes, moviendo la inspección de prompt de IA a sus firewalls para que la capa de red intercepte el tráfico dirigido al modelo.
Los controles de implementación reconocen que bloquear a los empleados el primer día es cómo mueren los programas de DLP. El modo de sombra observa los veredictos en el tráfico en vivo sin bloquear nada, un porcentaje de implementación inspecciona una fracción elegida de solicitudes, y las exclusiones eximen a los miembros de roles elegidos por completo. Si el servidor de seguridad no está disponible, produce errores o supera el tiempo de espera, la organización elige la postura de falla: bloquear la solicitud o dejarla pasar sin inspeccionar.
La documentación enumera DLP como la implementación más común, pero describe tres más: archivo de transcripción en tiempo real como una alternativa push a la API de Cumplimiento de Anthropic, telemetría de prompt capturada en el momento de uso, y motores de política personalizados que aplican reglas como listas de permitidos de modelo o restricciones con alcance de proyecto antes de la inferencia.
Qué no cubre la beta
Los límites declarados en la documentación definen el sobre actual. Los veredictos son binarios: el servidor puede permitir o denegar un prompt, pero no puede reescribirlo o tacharlo. Los archivos adjuntos llegan como metadatos y texto extraído, por lo que el contenido de solo imagen, una captura de pantalla de un documento, por ejemplo, no se inspecciona. El único evento de gancho en el lanzamiento se dispara en el prompt antes de la inferencia; la aplicación de lado de respuesta, que verifica lo que devuelve el modelo, está planeada como un evento posterior. Y la función gobierna solo las superficies de Claude Enterprise: el acceso a la API a través de la Plataforma Claude está fuera de alcance, y las organizaciones que ejecutan Claude en Amazon Bedrock o Google Cloud no obtienen nada.
Esto deja la competencia de puntos de inspección con dos modelos en vivo. Los controles de capa de red ven todo lo que cruza el cable, pero se esfuerzan contra el tráfico de IA cifrado y disperso; los ganchos del lado del proveedor como este ven exactamente lo que vería el modelo, pero solo dentro del perímetro de un proveedor. La documentación limita los ganchos a las superficies de Claude Enterprise y excluye Bedrock y Google Cloud, mientras que el enfoque de firewall de Check Point inspecciona el tráfico en la capa de red.
Los hooks de inferencia están disponibles en beta para organizaciones de Claude Enterprise, con la configuración bloqueada detrás de los roles de administrador de la organización. El evento de prompt está en vivo en sesiones de claude.ai, Cowork y Claude Code en la web, escritorio y CLI, y la documentación de Anthropic enmarca la aplicación de lado de respuesta como el siguiente punto de control que llegará.












