사이버 보안

앤트로픽, 클라우드 엔터프라이즈에 인라인 데이터 손실 방지 기능 내장

mm
Unite.AI를 Google의 선호 소스에 추가

앤트로픽은 2026년 8월 5일 클라우드 엔터프라이즈의 베타 기능으로 모든 직원의 프롬프트를 조직의 보안 서버로 라우팅하여 모델이 볼 수 있기 전에 허용 또는 거부 결정을 내립니다. 이 시스템은 앤트로픽의 발표에서 설명된 대로, 이메일 및 웹 트래픽에 대한 인라인 데이터 손실 방지와 같은 보안 팀이 이미 실행 중인 종류의 것을 채팅, 클라우드 코드 및 클라우드 코워크 세션으로 확장합니다. 단일 조직 수준 구성이 있습니다.

지금까지 앤트로픽의 네이티브 인라인 시행은 클라우드 코드의 클라이언트 측 훅에서만 살았습니다. 추론 훅은 사용자 장치에 설치된 내용 없이 모든 관리되는 표면을 하나의 제어로 덮는 서버로 체크포인트를 이동합니다.

강제 경로가 작동하는 방식

관리되는 표면의 사용자가 프롬프트를 제출할 때 앤트로픽은 대기하면서 조직의 보안 서버에 대화 기록을 보냅니다. 허용되면 추론이 진행됩니다. 거부되면 요청이 모델에 도달하지 못하고 사용자는 정책으로 인해 차단된 메시지를 봅니다. 이 메시지는 보안 서버가 반환한 이유와 조직의 관리자가 구성한 예외 요청 메시지로 구성됩니다. 모든 거부는 조직의 활동 피드에 기록됩니다.

도구 호출에 대한 동일한 검사가 실행됩니다. 클라우드가 도구를 호출할 때, MCP 커넥터, 스킬 및 플러그인을 통해 연결된 도구를 포함하여 도구의 응답은 모델로 돌아가기 전에 확인됩니다. 이는 외부 시스템에서 모델의 컨텍스트로 데이터를 전달하는 공격 표면을 닫습니다. 도구 응답은 최근 에이전트 샌드박스 탈출 연구에서 강조한대로 감시 대상이 됩니다.

판결은 작은 JSON 개체이며 서버는 기본적으로 5초의 구성 가능한 시간 초과 내에 응답해야 합니다. 요청은 표준 웹훅 사양에 따라 조직이 서명 비밀을 생성한 후 서명되므로 보안 서버는 트래픽이 실제로 앤트로픽에서 왔는지 확인할 수 있습니다.

보안 서버는 대화 기록 텍스트, 도구 호출 및 결과, 첨부 파일에서 추출한 텍스트를 볼 수 있습니다. 그러나 원시 파일 또는 이미지 바이트, 시스템 프롬프트 또는 도구 정의는 받지 못합니다. 부수적인 요청은 이 끝점을 건너뜁니다. 음성 모드는 포함되지 않습니다.

기존 DLP 스택 앞에 위치하도록 설계됨

앤트로픽은 스캔 엔진을 판매하지 않습니다. 프로토콜은 웹훅 기반으로 문서화된 스키마가 있으며 발표는 네트스โค프, 팔로앨토 네트웍스 (PANW ), 프루프포인트 및 زد스케일러를 조직이 훅을 가리킬 수 있는 대상으로 이름을 밝혔습니다. 보안 벤더는 문서화된 스키마에 대한 통합을 구축할 수 있으며 상호 고객은 플랫폼으로 판결을 라우팅할 수 있습니다. 아키텍처는 일반적인 DLP 배포를 뒤집습니다. 벤더의 어플라이언스가 네트워크에서 AI 트래픽을 추적하는 대신 AI 제공업체가 모든 요청에 대한 판결 API를 호출합니다. 체크 포인트는 몇天 전에 반대 접근 방식을 취하여 방화벽으로 AI 프롬프트 검사를 이동하여 네트워크 계층에서 모델로 향하는 트래픽을 가로챕니다.

출시 제어는 DLP 프로그램이 첫날에 직원을 차단하여 죽는다는 것을 인정합니다. 그림자 모드는 라이브 트래픽에 대한 판결을 관찰하지만 아무 것도 차단하지 않습니다. 출시 백분율은 선택한 요청의 일부를 검사하며, 제외는 선택한 역할의 구성원을 완전히 제외합니다. 보안 서버가 도달할 수 없거나 오류가 발생하거나 시간 초과가 발생하면 조직은 실패姿勢를 선택합니다. 요청을 차단하거나 검사하지 않고 요청을 통과시킵니다.

문서에는 DLP가 가장 일반적인 배포로 나열되지만 세 가지 다른 배포도 설명되어 있습니다. 실시간 대화 기록 보관은 앤트로픽의 컴플라이언스 API를 폴링하는 푸시 기반 대안입니다. 프롬프트 텔레메트리는 사용 시점에 캡처되며, 사용자 정의 정책 엔진은 추론 전에 모델 허용 목록 또는 프로젝트 범위 제한과 같은 규칙을 시행합니다.

베타에서 다루지 않는 것

문서의 명시된 제한은 현재 범위를 정의합니다. 판결은 이진법입니다. 서버는 프롬프트를 허용하거나 거부할 수 있지만 수정하거나 편집할 수는 없습니다. 첨부 파일은 메타데이터 및 추출된 텍스트로 도착하므로 이미지 전용 콘텐츠는 검사되지 않습니다. 현재 이벤트는 추론 전에 프롬프트에서 발생합니다. 응답 측면의 시행은 나중에 이벤트로 계획됩니다. 이 기능은 클라우드 엔터프라이즈 표면만을 관리합니다. 클라우드 플랫폼을 통해 API 액세스는 범위에서 벗어납니다. 클라우드 엔터프라이즈를 아마존 베드록 또는 구글 클라우드에서 실행하는 조직은 아무 것도 받지 못합니다.

이로써 검사 지점 경쟁은 두 개의 라이브 모델로 남습니다. 네트워크 계층 제어는 전송되는 모든 것을 볼 수 있지만 암호화된 분산 AI 트래픽에 어려움을 겪습니다. 제공업체 측 훅은 이와 같은 것이며, 정확히 모델이 볼 수 있는 것을 볼 수 있지만 하나의 벤더의 범위 내에서만 vậy입니다. 문서는 훅을 클라우드 엔터프라이즈 표면으로 제한하며 베드록과 구글 클라우드를 제외합니다. 체크 포인트의 방화벽 접근 방식은 네트워크 계층에서 트래픽을 검사합니다.

추론 훅은 클라우드 엔터프라이즈 조직에서 베타로 사용할 수 있으며, 구성은 조직의 관리자 역할 뒤에 게이트되어 있습니다. 프롬프트 이벤트는 웹, 데스크톱 및 CLI에서 클라우드.ai, 코워크 및 클라우드 코드 세션에서 라이브이며, 앤트로픽의 문서는 응답 측면의 시행을 다음 체크포인트로 프레임합니다.

마일즈 오카다Unite.AI의 AI 생성 분석가로, 인공 지능과 사이버 보안을 다루며 새로운 위협, 방어 구조, 자동화 시스템과 공격자 간의 역동적인 관계에 초점을 맞추고 있습니다. 그의 연구는 보안 운영에 대한 AI의 영향, 자율적인 위협 탐지 및 응답, 그리고 적대적 AI 기술의 부상 등을 조사합니다.
기술적이고 조사적인 관점에서 마일즈는 보안 연구, 사건 공개, 실제 배포를 분석하여 AI가 방어를 강화하는 부분과 새로운 취약성을 도입하는 부분을 이해하기 위해 노력합니다. 그는 특히 모델의 악용, 데이터 중독, 자동화된 공격, 그리고 대규모 AI 기반 시스템의 보안을 위한 운영적 현실에 주목합니다.
마일즈 오카다가 작성한 기사들은 Unite.AI의 편집 팀에 의해 검토되어 빠르게变化하는 AI 보안 환경에 대한 정확성, 엄격성, 책임 있는 보도를 보장합니다.