홍드로이드의 야매코딩

회사 AI 요청 실시간 차단 — 스크린샷은 검사에서 빠집니다 본문

AI & Vibe Coding

회사 AI 요청 실시간 차단 — 스크린샷은 검사에서 빠집니다

홍드로이드 2026. 9. 2. 15:29
반응형

회사가 "직원이 AI에 회사 자료를 넣는 것"을 막고 싶을 때 쓰는 공식 방법이 생겼습니다. 프롬프트가 모델에 닿기 전에 회사 보안 서버가 먼저 받아 보고 통과·거부를 정하는 구조죠. 그런데 문서의 한계 항목을 보다가 도입 목적을 통째로 흔드는 문장을 발견했습니다 — 원본 이미지 파일은 보안 서버로 아예 안 갑니다. 즉 문서를 찍어서 올리면 검사를 지나갑니다.

📌 30초 요약

  • ★★스크린샷은 검사 대상이 아닙니다 — 원본 이미지가 안 갑니다.
  • ★서버가 죽었을 때 어떻게 할지를 미리 정해 둬야 합니다.
  • ★고칠 수는 없습니다 — 통과 아니면 거부 둘뿐이에요.
  • ⚠️ 음성 모드는 아직 대상 밖입니다.
  • 도구 결과가 돌아올 때도 한 번 더 검사합니다.
  • 기다리는 시간이 기본 5초 — 그동안 사용자는 멈춰 있습니다.

회사 서버가 통과·거부를 정합니다

방향이 특이합니다. 흔히 쓰는 사내 중계 서버는 회사가 요청을 받아 대신 보내 주는 구조인데, 이건 반대예요 — 사용자가 보낸 프롬프트를 앤트로픽 쪽에서 받아 두었다가, 회사가 운영하는 보안 서버로 한 번 물어보고 그 답에 따라 진행합니다. 통과라고 하면 그대로 돌고, 거부라고 하면 모델에 아예 닿지 않습니다.

장점이 분명합니다. 사용자 컴퓨터에 뭘 깔 필요가 없습니다. 요청이 클라이언트를 떠난 뒤 모델이 돌기 전에 걸리니, 웹이든 데스크톱 앱이든 명령줄 도구든 하나의 설정이 전부에 똑같이 적용되죠. 거부당하면 사용자는 "정책에 걸렸다"는 안내를 보는데, 그 문구가 두 조각으로 조립됩니다 — 보안 서버가 그때그때 준 사유 + 관리자가 미리 적어 둔 상시 안내. 후자를 안 적어 두면 기본 문구가 나가니, 문의처를 꼭 채워 두세요. 거부 기록은 조직 활동 기록에도 남습니다.

검사 지점이 하나가 아닙니다. 프롬프트가 들어올 때 한 번, 그리고 AI가 도구를 불러 결과가 돌아올 때 또 한 번 물어봅니다. 사내 문서 도구를 붙여 쓴다면 회의록이 자동으로 만들어지는 흐름에서도 그 결과물이 검사를 거친다는 뜻이죠.

스크린샷은 검사에서 빠집니다

보안 서버가 받는 것은 사용자가 보는 것과 같은 범위입니다 — 대화 글, 도구 호출과 그 결과, 그리고 첨부에서 뽑아낸 글자. 여기서 마지막이 함정입니다.

🚨 이미지로만 된 내용은 아무도 안 봅니다

문서가 한계 항목에 직접 적어 뒀습니다 — 원본 파일과 이미지의 실제 바이트는 절대 전송되지 않습니다. 첨부는 정보 표기와 추출된 글자로만 대신하죠. 그래서 대외비 문서를 화면째 찍어서 올리면 검사 대상이 아닙니다. 정보 유출 차단이 가장 흔한 도입 목적인데, 정작 가장 흔한 우회 경로가 열려 있는 셈입니다. 이 기능만 믿지 말고 파일 첨부 자체를 제한하는 정책과 같이 써야 합니다.

반대로 안심할 대목도 있습니다. 지시문이나 도구 정의처럼 내부에서만 쓰는 내용은 보안 서버로 안 갑니다. 앤트로픽 쪽도 이 기능을 위해 대화 내용을 따로 보관하지 않고 판정 결과·시각·요청 식별 같은 흔적만 남깁니다.

서버가 죽으면 무엇이 됩니까

운영에서 가장 중요한 질문입니다. 보안 서버가 안 뜨거나, 오류를 내거나, 제한 시간 안에 답을 못 하면 어떻게 될까요. 답은 "조직이 미리 정해 둔 대로"입니다. 막을지, 검사 없이 통과시킬지를 설정 하나로 정해 두게 돼 있어요.

항목 내용
판정 대기 시간 기본 5초 — 조직이 조절
서버 장애 시 막기 또는 통과 — 미리 정해야
점진 도입 관찰만 하는 모드, 비율 적용, 역할별 제외
요청 진위 확인 공개 규격 방식으로 서명돼 옴

이 두 값이 곧 보안과 업무 연속성 사이의 저울입니다. 막는 쪽으로 두면 보안 서버가 잠깐 흔들려도 회사 전체가 AI를 못 씁니다. 통과 쪽으로 두면 그 시간 동안 검사 없이 다 나갑니다. 어느 쪽도 공짜가 아니니, 먼저 관찰만 하는 모드로 실제 트래픽을 며칠 지켜보고 정하는 게 안전합니다. 비율을 조금씩 올리거나 특정 역할을 빼 둘 수도 있고요.

못 하는 것들이 꽤 있습니다

기대를 미리 낮춰 둘 항목이 넷입니다. ①답은 통과 아니면 거부 둘뿐이라 "이 부분만 가리고 보내라"는 식의 수정은 안 됩니다. 민감한 단어 하나 때문에 요청 전체가 막히는 상황이 생기죠.

②AI가 내놓은 답은 아직 검사 못 합니다. 지금 있는 검사 지점은 요청이 들어올 때뿐이고, 응답 쪽은 나중에 붙일 계획이라고만 적혀 있습니다. ③음성 모드는 대상이 아닙니다. 대화 제목을 자동으로 짓는 것처럼 곁다리로 도는 요청도 안 갑니다. ④개발자용 조직은 범위 밖이라, 기업 계약 쪽에서만 됩니다.

쓰임새는 유출 차단만이 아닙니다. 항상 통과로 답하면서 대화를 그때그때 받아 보관하는 용도로도 씁니다. 사후에 조회해 꺼내 오는 방식과 달리 밀어 넣는 방식이라 실시간이죠. 모델 허용 목록이나 근무 시간 제한 같은 자체 규칙을 거는 데도 쓸 수 있습니다. 메일을 자동으로 처리하는 흐름을 사내에 깔았다면, 그 요청들도 전부 이 검사를 지나간다는 점을 기억해 두세요.

자주 묻는 질문 (FAQ)

Q. 사내 중계 서버를 두는 것과 뭐가 다른가요?

방향이 반대입니다. 중계는 회사가 요청을 받아 대신 보내는 구조라 기능이 조용히 빠지는 문제가 따라옵니다. 이건 앤트로픽이 회사 서버에 물어보는 구조라 사용자 쪽에 설치할 게 없고 모든 창구에 똑같이 적용됩니다.

Q. 5초씩 기다리면 느리지 않나요?

그 시간은 상한이고 보통은 훨씬 빨리 답합니다. 다만 검사 서버가 무거우면 그대로 체감 지연이 되니, 규칙 검사는 가볍게 짜고 무거운 분석은 뒤로 미루는 설계가 필요합니다.

Q. 누가 켤 수 있나요?

조직 관리 권한을 가진 역할만 설정할 수 있습니다. 아직 시험 단계이고 기업 계약 조직 전용이에요. 주요 클라우드를 통해 쓰는 경우엔 지원되지 않습니다.

Q. 직원 입장에서는 뭐가 달라지나요?

내가 친 프롬프트가 회사 보안 서버를 한 번 거칩니다. 대화 내용과 도구 결과, 첨부에서 뽑은 글자가 대상이에요. 개인적인 이야기를 회사 계정에 쓰지 않는 것이 여전히 최선입니다.

✨ 정리하면

설치할 게 없고 모든 창구에 한 번에 걸린다는 점이 강력합니다. 다만 이것만으로 유출이 막히지는 않습니다 — 이미지로 된 내용은 검사 대상이 아니니까요. 도입한다면 관찰 모드로 며칠 지켜보고, 서버 장애 시 정책을 먼저 정하고, 첨부 제한과 함께 걸 것. 사후 감사 쪽과 짝을 지으면 앞뒤가 맞습니다. 비용과 권한을 함께 설계하는 흐름은 AI 지출 관리 허브에 정리해 두었습니다.

출처: Claude 공식 문서 「인퍼런스 훅」 (2026-09-02 열람). 시험 단계 기능이며 대상 범위·기본값·지원 플랫폼은 2026년 기준으로 변동될 수 있습니다.

반응형
Comments