홍드로이드의 야매코딩

AI 정보 유출 차단, 켜면 스트리밍이 죽습니다 본문

AI & Vibe Coding

AI 정보 유출 차단, 켜면 스트리밍이 죽습니다

홍드로이드 2026. 8. 21. 23:29
반응형

회사에서 AI를 쓸 때 가장 걱정되는 건 누군가 실수로 민감한 걸 붙여넣는 상황입니다. 그래서 오가는 내용을 실시간으로 훑어 걸러내는 장치가 있습니다. 코드를 안 고쳐도 켤 수 있다고 하고요. 그런데 문서를 열어보니 켜는 순간 잃는 것이 또렷하게 적혀 있었습니다 — 응답 쪽 검사를 켜면 글자가 한 자씩 흐르지 않고, 이미지 안에 든 정보는 아예 검사하지 않습니다.

📌 30초 요약

  • 응답 검사를 켜면 스트리밍이 사실상 사라집니다. 다 만들어질 때까지 모아뒀다가 한 번에 나갑니다.
  • 요청만 검사하면 지연이 없습니다. 들어가는 것만 막을지, 나오는 것도 볼지가 갈림길입니다.
  • 이미지와 첨부는 검사하지 않습니다. 문서가 "디코딩하지 않는다"고 명시합니다.
  • 캐시에 걸린 요청은 검사를 건너뜁니다. 정책을 바꿔도 예전 판정이 그대로 나갑니다.
  • 요청 하나만 예외로 빼는 방법이 없습니다. 다르게 하려면 통로를 따로 만들어야 합니다.
  • 도구 호출 인자와 결과도 검사 대상입니다 — 본문에 텍스트로 들어 있다면요.

켜면 글자가 안 흐릅니다

AI가 답할 때 글자가 타자 치듯 흘러나오는 것에 익숙하실 겁니다. 기다리는 체감이 크게 줄어드니까요. 그런데 나가는 답을 검사하려면 그 답이 다 완성돼 있어야 합니다.

모아놓고 검사한 뒤에야 보냅니다

문서 설명을 옮기면 — 응답 검사가 켜진 상태에서 스트리밍을 요청하면 제공자 응답 전체를 모아둔 뒤 검사를 돌립니다. 그래서 첫 글자가 나오기까지의 시간이 답 전체를 만드는 시간만큼 늘어납니다.

긴 답일수록 손해가 큽니다. 3초 만에 첫 줄이 뜨던 게 30초 뒤 통째로 뜨는 식이죠. 기능이 사라지는 건 아니지만 사용자가 느끼는 속도는 완전히 달라집니다.

다행히 빠져나갈 길을 문서가 같이 적어놨습니다. 검사 범위를 요청 쪽만으로 두면 응답을 모아둘 필요가 없어 지연이 생기지 않습니다. 또는 속도가 중요한 통로와 검사가 중요한 통로를 나눠 운영하라고 권합니다.

검사 범위 막는 것 속도 영향
요청만 사용자가 보내는 내용 — 주민번호·카드번호·사내 문서 같은 것 없음
요청 + 응답 위에 더해 AI가 뱉는 내용까지 스트리밍 소멸

이미지 속 정보는 그냥 지나갑니다

이게 가장 오해하기 쉬운 대목입니다. 검사 장치를 켜두면 무엇이든 걸러줄 것 같지만, 문서는 범위를 좁게 못박습니다.

🔍 무엇을 보고 무엇을 안 보나

보는 것은 요청과 응답 본문의 글자입니다. 도구 호출에 실린 인자와 결과도 본문에 텍스트로 들어 있다면 함께 봅니다. 반면 안 보는 것이 분명합니다 — 이미지처럼 인코딩된 내용은 풀어보지 않고, 외부 주소를 따라가지도 않습니다. 여러 조각으로 나눠 보내는 형식이면 글자 부분만 보고 이진 데이터는 건너뜁니다. 실무로 옮기면 이런 뜻입니다 — 계약서를 복사해 붙이면 걸리지만, 같은 계약서를 사진 찍어 올리면 안 걸립니다.

그러니 "장치를 켰으니 안심"은 위험한 결론입니다. 이런 도구는 실수를 줄여주는 그물이지 모든 경로를 막는 벽이 아닙니다. 무엇을 넣으면 안 되는지는 사람이 먼저 아는 게 여전히 중요합니다.

캐시에 걸리면 검사를 건너뜁니다

같은 질문이 또 오면 저장해둔 답을 바로 내주는 캐시가 있는데, 이 둘이 만나면 규칙이 생깁니다. 캐시에서 꺼내 주는 요청은 검사를 다시 돌리지 않습니다.

검사 결과 캐시 저장 사용자가 받는 것
이상 없음 평소대로 답이 나갑니다.
표시만 원래 답이 그대로 갑니다. 기록과 응답 헤더에만 남습니다.
차단 안 함 답이 버려지고 오류가 대신 갑니다.

가운데 줄이 함정입니다. "표시만" 판정은 답이 그대로 나가고 캐시에도 저장됩니다. 즉 나중에 규칙을 조여서 "이건 막아야겠다"로 바꿔도, 이미 캐시에 들어간 답은 검사를 안 거치고 계속 나갑니다. 문서가 대응책을 적어뒀는데 — 정책 변경을 바로 반영하려면 캐시를 건너뛰는 표시를 붙여 요청하라는 겁니다. 캐시가 언제 어떻게 걸리는지는 청구서를 묶는 값을 정리한 글에 함께 적어뒀습니다.

한 건만 예외로 빼는 건 안 됩니다

규칙은 통로 단위로 걸립니다. 그 통로를 지나는 모든 요청에 똑같이 적용되고, 문서 표현으로 특정 요청만 다른 규칙을 고르거나 검사를 건너뛰게 하는 방법이 없습니다.

그래서 부서마다 다른 기준을 적용하려면 통로를 여러 개 만들어 나눠 보내는 것이 문서가 권하는 방법입니다. 자동화 흐름을 짤 때 이 구조를 미리 알아두면 좋습니다 — 코딩 없이 자동화를 만드는 도구로 여러 부서 흐름을 묶어 쓰신다면, 어느 통로로 보낼지가 곧 어떤 규칙을 적용받을지가 됩니다.

켜기 전에 정할 것 세 가지

정리하면 결정해야 할 게 셋입니다. 기술 문제가 아니라 무엇을 포기할지의 문제에 가깝습니다.

정할 것 따져볼 점
응답도 볼까 보면 스트리밍을 잃습니다. 사내 도구라 조금 느려도 괜찮은지, 고객이 보는 화면인지로 갈립니다.
막을까 표시만 할까 막으면 일이 끊기고, 표시만 하면 내용은 이미 나간 뒤입니다. 처음엔 표시로 시작해 무엇이 걸리는지 보는 편이 안전합니다.
통로를 몇 개 둘까 규칙이 하나뿐이라 기준이 다른 팀이 있으면 통로를 나눠야 합니다. 나중에 쪼개는 것보다 처음에 정하는 게 쉽습니다.

🚧 흐름 도중에 끼어드는 것이 하나 더 있습니다

검사 장치만 스트리밍을 흔드는 게 아닙니다. 정책 검사에 걸리면 글이 흘러나오다가 그 자리에서 거절로 끝납니다이때 이미 화면에 나온 조각은 그대로 남으니, 거절 표시를 받는 순간 그 답변 영역을 안내 문구로 바꿔야 합니다. 게다가 거절은 오류가 아니라 정상 응답이라 오류율 감시로는 안 잡힙니다.

🔁 규칙으로 막는 것에는 그물 밖이 있습니다

유출을 막는 장치를 고를 때 알아 둘 경계가 하나 있습니다. 파일 권한 규칙은 도구가 파일을 여는 것과 클로드가 알아보는 셸 파일 명령, 결과를 파일로 흘려보내는 자리까지 닿습니다. 반면 파이썬이나 노드 스크립트가 제 손으로 파일을 여는 경우, 파일 이름을 대지 않고 폴더를 훑는 명령은 걸리지 않습니다. 즉 규칙은 의도한 접근을 막는 울타리지 모든 프로세스를 세우는 벽이 아닙니다. 거기까지 막아야 한다면 운영체제 수준의 격리를 켜는 쪽이 맞습니다.

🔁 끝까지 켜도 안 막히는 쪽

유출 차단을 켜면 스트리밍이 죽는 대가가 있다고 적었는데, 대가를 치르고도 안 막히는 자리가 따로 있습니다. 클라우드 세션의 망 설정을 「없음」으로 내려도 앤트로픽 API로는 계속 연결되고, 문서도 「데이터가 가상 기계 밖으로 나갈 수 있다」고 분명히 적어 뒀습니다. 모델에 말을 걸어야 하니 당연한 구조인데, 「망을 끊었으니 아무것도 안 나간다」는 이해는 성립하지 않습니다. 차단 기능을 검토하실 때 「끄는 대가」와 함께 「꺼도 남는 경로」를 같이 보세요.

자주 묻는 질문

Q. 개인이 쓰는 챗봇에도 이런 게 있나요?

이건 회사가 중간에 세우는 장치라 개인 계정에는 해당하지 않습니다. 개인이라면 애초에 안 넣는 것이 유일한 방법입니다. 다만 회사 계정으로 쓰신다면 이런 게 켜져 있을 수 있다는 건 알아두실 만합니다 — 답이 느리게 나온다면 그 이유일 수도 있고요.

Q. 이걸 켜면 규정을 지킨 게 되나요?

도움은 되지만 그것만으로는 아닙니다. 문서도 "규제 요구사항을 충족하는 데 도움을 준다"는 표현을 씁니다 — 충족시킨다가 아니라 돕는다입니다. 게다가 이미지 경로가 열려 있으니 이 장치만으로 유출을 막았다고 보고하기는 어렵습니다. 교육과 규정이 여전히 필요합니다.

Q. 비용이 더 드나요?

토큰 요금이 늘지는 않습니다 — 검사는 오가는 글자를 훑는 것이지 모델을 한 번 더 부르는 게 아니니까요. 다만 이 기능 자체가 상위 요금제에 묶여 있을 수 있어 조건은 따로 확인하셔야 합니다. 그리고 응답 검사를 켜면 속도라는 비용을 치릅니다. 구독과 종량제 중 무엇이 싼지 따지는 방법은 손익분기점 찾는 글에 정리해뒀습니다.

🧭 정직하게 덧붙이면

공식 문서를 읽은 것이고 제가 직접 켜서 지연을 측정하지 않았습니다. "스트리밍이 사라진다"는 문서가 밝힌 동작입니다. ②특정 회사 제품의 문서를 기준으로 썼고, 같은 역할을 하는 다른 제품과 비교하지 않았습니다.이용 조건과 요금제 편입 여부는 확인하지 못했습니다 — 도입 전 직접 보셔야 합니다. ④"이미지를 검사하지 않는다"는 이 제품의 현재 동작이고 앞으로 바뀔 수 있습니다. ⑤개인정보·규제 준수는 법적 판단이 필요한 영역이고 저는 변호사가 아닙니다.

✨ 붙여넣으면 걸리고, 사진 찍어 올리면 안 걸립니다

AI를 쓸 때 드는 비용과 조건을 항목별로 뜯어본 글들은 AI 지출 정리 허브에 모아두고 있습니다. 오늘 건은 "안전을 켜면 무엇을 내주는가" 쪽에 한 줄을 보탠 셈입니다.

출처: Cloudflare 공식 개발자 문서 AI Gateway의 정보 유출 방지 섹션(2026-08-19 직접 열람). 인용 항목 = 검사 대상 범위와 제외 대상, 스트리밍 응답 버퍼링 동작과 지연, 캐시와의 상호작용 표(통과·표시·차단), 요청 단위 예외 불가와 권장 대안, 규제 관련 표현. 기능 제공 조건과 요금제는 확인하지 못했으며 동작은 변경될 수 있습니다. 법률 자문이 아닙니다.

반응형
Comments