프라이버시 실무 ·

문의 원문을 대화형 AI에 붙이기 전에, 형식 마스킹이 왜 같은 고객을 다시 가리키나

상담원이 컴플레인 원문을 대화형 AI에 그대로 넣고 답변 초안을 부탁합니다. 휴대전화에 별표를 쳤다고 해서, 그 문장이 한 사람을 더 이상 가리키지 못하게 된 것은 아닙니다. 형식 마스킹은 전화, 신분증 번호, 이메일처럼 대조할 수 있는 모양을 가립니다. 이름, 주소, 접수번호, 「어제 오후 네 시 그 통화」는 문맥에 남습니다. 아래에서는 「가리는 층 / 남는 층」을 가르고, 그 자리에서 대조할 수 있는 단계를 적습니다. URL 클리너 폼의 조작 안내가 아닙니다.

마스킹 결과 대조 그 자리에서 확인 가능 가입 없이 바로 사용
00 / 목차

먼저 가리는 층을 가르세요

이 글은 「문의 원문을 대화형 AI에 붙이기 전에, 형식 마스킹이 왜 같은 고객을 다시 가리키는가」만 답합니다. URL 클리너의 폼 설명도 아니고, 특정 모델 업체의 전체 개인정보 처리방침도 아닙니다.

01 / 이전

붙여 넣으면 어떤 층이 넘어가나

「답변을 어떻게 쓸지 물은 것」이 아닙니다. 문의 원문 전체가 다른 처리자의 입력이 됩니다. 사본은 더 이상 상담 시스템에만 있지 않습니다.

상담, 운영, 당직 개발이 대화형 AI를 초안 도구로 쓰는 일은 이미 일상입니다. 컴플레인을 붙이고, 로그를 붙이고, 회의 요지를 붙인 뒤 더 다듬어진 문장을 기다립니다. 붙여넣기 칸은 여전히 브라우저 안에 있는 것처럼 보입니다. 보내기를 누른 뒤 글자는 현재 탭을 떠납니다. 모델 업체는 자사 약관에 따라 학습에 쓰는지, 기록에 남기는지, 안전 검토를 위해 한 부를 더 두는지 정합니다. 이 기기에서 친 별표는, 보내기 전에 이미 들어가 있어야 그 한 번의 요청에 유효합니다.

2023년 4월, 삼성전자 반도체 사업부 엔지니어들이 약 스무 날 동안 ChatGPT에 나가면 안 되는 자료를 세 번 붙였습니다. 반도체 데이터베이스 소스, 장비 불량 검출 코드, 내부 회의 요지입니다. PCMag이 《이코노미스트》 한국어 보도를 옮긴 기록에 세 건이 남아 있고, 이어 블룸버그는 2023년 5월 회사가 업무 기기에서 생성형 AI를 막았다고 썼습니다. 세 건 가운데 「휴대전화에 별표를 깜빡한 경우」는 없습니다. 나간 것은 소스, 알고리즘, 회의 내용입니다.

같은 해 Cyberhaven은 자사 제품을 쓰는 약 160만 명의 직장 행동을 집계했습니다. 2023년 6월 무렵 갱신에는, ChatGPT가 공개된 뒤 직원 중 약 4.7%가 기밀 자료를 한 번 이상 붙였고, 직원이 ChatGPT에 붙인 내용 중 약 11%가 기밀로 표시됐다고 적혀 있습니다. 숫자는 Cyberhaven 자체 블로그에 있습니다. 보안 업체 한 곳의 텔레메트리이지 전 산업 전수조사가 아니며, 2026년의 모든 상담석에 그대로 얹을 수도 없습니다. 그 자리에서 대조할 수 있는 사실은 더 좁습니다. 업무 원문을 개인용 대화창에 붙이는 일은 2023년에도 이미 흔했고, 「붙이기 전에 무엇을 가렸는가」를 따로 가를 이유가 됩니다.

이것은 「새 키를 채팅창에 다시 보내면 안 되는 이유」와 같은 층이 아닙니다. 그 글은 키를 교체한 뒤 API Key를 검색되는 채널에 다시 붙이는 이야기입니다. 클라우드 환경변수가 유출된 뒤, 새 키를 채팅창에 다시 보내면 안 되는 이유를 보세요. 이 글이 메우는 것은 그 옆의 일상 통로입니다. 문의 티켓, 메일, 로그가 대화형 AI에 들어가기 전에, 형식 마스킹이 어느 신원 층을 바꾸고 어느 층은 그대로 남는가입니다.

먼저 이 문장만

대화형 AI에 붙이기 전에 물을 것은 「모델이 다음 이용자에게 이 문장을 큰 소리로 읽어 주느냐」가 아닙니다. 「이번 요청 본문에, 같은 고객으로 다시 이을 수 있는 필드와 경과가 얼마나 남았느냐」입니다. 별표는 규칙이 실제로 맞힌 구간만 덮습니다.

02 / 범위

형식 마스킹이 가리는 여섯 종류

알아보는 것은 모양이지, 「이 문장이 개인정보처럼 보이느냐」가 아닙니다. 여섯 종류는 예시로 그 자리에서 맞출 수 있습니다. 여섯을 벗어나면 자동으로 손댄다고 기대하지 마세요.

UsePwd의 민감정보 마스킹은 현재 탭에서 가립니다. 가입 없이 바로 사용합니다. 인식 유형은 여섯으로 고정되어 있습니다. 전화, 신분증 번호, 은행 카드, 이메일, API Key, IP입니다. 원문은 HTTP 요청으로 나가지 않고 analytics에도 쓰지 않습니다. 한 번에 붙일 수 있는 텍스트는 512 KB까지이며, 넘으면 나눠 처리합니다. 자연어 이해가 아닙니다. 「김민서」에 점수를 매기지 않고, 「예시로 12」가 집 주소인지도 판단하지 않습니다.

전화는 중국 대륙 휴대전화, +로 시작하는 국제번호, 흔한 북미 표기를 잡습니다. 신분증 번호에서는 18자리 주민신분증을 검사 숫자까지 계산한 뒤에야 손대므로, 주문 숫자 한 줄을 신분증으로 오인할 가능성을 줄입니다. 옛 15자리, 미국 사회보장번호의 123-45-6789 형태, 일부 여권식 알파벳+숫자도 인정합니다. 카드는 13–19자리 숫자와 Luhn 검사를 요구하며, 15자리와 18자리 통째는 건너뛰어 신분증 규칙과 같은 줄을 다투지 않게 합니다. 이메일은 로컬부 @ 도메인입니다. 키는 공개 접두사 목록을 보며, 예로는 sk-, sk_live_, sk_test_, AKIA, ghp_, github_pat_, xoxb-, Bearer 가 있습니다. IP는 IPv4와 일부 IPv6 표기를 봅니다.

국내 상담 티켓에서 흔한 010-1234-5678은 하이픈이 3-4-4입니다. 위의 전화 규칙은 대륙 11자리, + 국제형, 북미식 3-3-4를 보도록 짜여 있어, 국가번호 없는 010 표기는 그대로 남을 수 있습니다. 주민등록번호 YYMMDD-1XXXXXX도 18자리 신분증도, 123-45-6789도 아닙니다. 여섯 종류를 「한국 개인정보 전부」로 읽으면 안 됩니다. 국제형 +821012345678처럼 +가 붙은 숫자는 전화 규칙에 걸리는 편입니다. 붙이기 전에 어떤 표기로 적혀 있는지를 사람이 한 번 봐야 하는 이유입니다.

기본은 스마트 마스킹입니다. 전화, 신분증, 카드는 뒤 네 자리를 남기고, 이메일은 로컬부 첫 글자와 도메인 전체를 남기며, 키는 접두사와 뒤 네 자리를 남기고, IPv4는 앞 두 구간을 남깁니다. 전체 마스킹은 맞힌 구간을 같은 길이의 별표로 바꿉니다. 이메일은 ***@***이 되고, 키는 알아볼 수 있는 접두사를 남긴 뒤 ***을 붙입니다. 두 방식 모두 맞힌 구간만 바꿉니다. 오른쪽에는 이번에 인식한 유형과 개수가 나와, 「이미 익명이다」는 말 대신 대조에 쓰입니다.

전화 / 신분증 / 카드
기본은 뒤 네 자리를 남김

+821012345678은 별표 뒤에 5678이 붙습니다. 뒤 네 자리는 여전히 이음 실마리입니다.

이메일
기본은 첫 글자와 도메인을 남김

minseo@example.comm***@example.com이 됩니다. 회사 메일은 로컬부보다 도메인이 더 잘 가리키는 경우가 많습니다.

키 / IP
접두사나 망 구간을 남김

sk_test_는 그대로입니다. IPv4 앞 두 구간도 그대로입니다. 「어떤 종류의 것인지」는 알 수 있고, 비밀 전체가 사라졌다고 볼 수는 없습니다.

페이지의 인식 스위치는 종류별로 끌 수 있습니다. 전화를 끄면 휴대전화가 그대로 남습니다. 대조를 위한 것이지, 「적게 켤수록 안전하다」가 아닙니다. 대화형 AI로 내보내기 전에는 여섯을 모두 켠 뒤, 다음 절에서 남은 글자가 같은 고객으로 다시 이을 만큼인지를 보세요.

03 / 이음

뒤 네 자리가 남아도 다시 이어지는 이유

법령은 「누구인지 알아볼 수 없다」와 「직접 식별자를 뺐다」를 나눕니다. 문의 본문은 대개 후자만, 그것도 절반만 합니다.

「개인정보 보호법」 제2조 제1호는 개인정보를 살아 있는 개인에 관한 정보로서 알아볼 수 있는 정보로 둡니다. 같은 조 제1호 다목의 가명정보는, 가명처리하여 원래 상태로 되돌리기 위한 추가 정보의 사용·결합 없이는 특정 개인을 알아볼 수 없는 정보입니다. 제2조 제1호의2의 가명처리는 일부를 삭제하거나 대체하는 등의 방법으로, 추가 정보 없이는 특정 개인을 알아볼 수 없게 하는 처리입니다. 국가법령정보센터의 법령 본문에서 이 정의를 대조할 수 있습니다. 제58조의2는 시간·비용·기술 등을 합리적으로 고려할 때 다른 정보를 사용해도 더 이상 개인을 알아볼 수 없는 정보에는 이 법을 적용하지 않는다고 씁니다. 흔히 익명정보로 부르는 층입니다. 개인정보보호위원회의 가명정보 설명도 가명정보를 「추가 정보 없이는 특정 개인을 알아볼 수 없는 정보」로 두고, 통계·연구·공익 기록 보존 목적의 처리 틀을 따로 적습니다. +821012345678*********5678로 바꾸는 일은 가명처리에 가까운 일상 기법이지, 익명처리가 아닙니다. 완전한 티켓, 통화 녹음, 주문 장부를 가진 사람은 뒤 네 자리, 이메일 도메인, 컴플레인 경과를 다시 맞출 수 있습니다.

스마트 마스킹이 뒤 네 자리와 도메인을 남기는 것은, 상담원 본인이 「방금 손댄 줄이 의도한 줄인지」를 이 기기에서 확인하게 하려는 것이지, 그 문장을 임의의 제3자에게 넘겨도 된다는 근거가 아닙니다. 전체 마스킹은 그 남은 조각을 지워 이음 비용을 올립니다. 이름, 주소, 접수번호, 경과는 스위치를 바꿨다고 사라지지 않습니다. 「별표가 늘었다」를 「더 이상 알아볼 수 없다」로 읽는 것은 가명처리를 익명처리로 착각하는 일입니다. 제3조 제7항이 익명처리가 가능하면 익명을, 그렇지 않으면 가명을 쓰라고 한 것도, 두 층을 같은 말로 쓰지 말라는 뜻에 가깝습니다.

이메일 도메인은 로컬부보다 위험한 경우가 많습니다. 개인용 @example.com은 가리키는 힘이 약합니다. 직원 스무 명인 회사 도메인에 「어제 오후 네 시에 환불을 요구했다」가 붙으면, 그 회사 안에서는 거의 지목입니다. IPv4를 203.0.*.*로 남겨도 공중망에서는 의미가 얇지만, 사내가 한 서브넷이라면 그 구간 자체가 실마리입니다. 키가 sk_test_ghp_로 남으면, 아래쪽 독자에게 「어떤 종류의 자격 증명이 한 번 거기 있었는지」가 전달됩니다. 접두사는 비밀 자체가 아닙니다. 분류 라벨입니다.

거꾸로 읽지 마세요

이 글이 「개인정보 보호법」을 인용하는 것은 「알아볼 수 있음 / 가명처리 / 익명정보」를 세 말로 나눠 두기 위해서입니다. UsePwd는 같은 법, GDPR, ISMS-P 인증을 주장하지 않으며 준법 감사도 제공하지 않습니다. 마스킹은 이 기기의 보조입니다. 중요한 외부 문장은 사람이 한 번 더 봐야 합니다.

04 / 빈칸

이름, 주소, 접수번호는 가리지 못함

규칙은 한글 이름을 읽지 않고, 「문 앞 박스가 찢겨 도착했다」도 이해하지 않습니다. 이 칸들은 휴대전화보다 쓸모가 큰 경우가 많습니다.

두 글자, 세 글자 한글 이름에는 공통 검사 숫자가 없습니다. 주소는 도로명, 동, 호수의 조합이지 자리 수가 정해져 있지 않습니다. 접수번호, 주문번호, 송장번호는 사업자마다 만듭니다. 오늘은 WO-20260903-8842, 내일은 다른 접두사입니다. 대화형 AI에 답변 초안을 맡길 때 필요한 것은 바로 그 경과입니다. 언제 전화했는지, 물건이 어디에 도착했는지, 무엇을 약속했는지. 형식 엔진이 이를 모두 가리면 초안은 쓸 수 없게 됩니다. 남기면 신원 층이 그대로입니다.

그래서 사람이 지워야 하는 줄은, 종종 휴대전화가 아닙니다. 휴대전화는 규칙이 닿기 쉽습니다. 다만 위에서 적었듯, 010-1234-5678이나 주민등록번호처럼 국내에서 흔한 표기는 여섯 규칙 밖에 남을 수 있습니다. 두 번 볼 가치는 여기에 있습니다. 연락처를 어떻게 부르는지, 주소가 통째로 있는지, 검색되는 번호가 있는지, 시각과 내용만으로 한 통화를 고정할 수 있는지. 이 네 가지를 모델에 넘기는 본문에 남겨 두고 「마스킹했다」고 하면, 보여줄 수 있는 것은 전화 한 줄이 짧아진 것뿐입니다.

호칭과 관계 01 「김민서」「아이 엄마」「옆 가게 박 대리」는 여섯 규칙에 걸리지 않습니다.
주소와 위치 02 호수, 아파트 동, 선반 번호, 회의실 이름은 평범한 한글로 남습니다.
접수번호와 사번 03 접수번호, 주문번호, 상담원 사번은 내부 검색 키입니다. 규칙은 신분증으로 보지 않습니다.
경과와 시각 04 「어제 오후 네 시 녹취」는 건수가 적은 창구에서 한 통의 대화에 닿습니다.

모델에 말투 조정이나 답변 요점 정리만 맡긴다면, 호칭은 「고객」, 주소는 「배송지」, 번호는 「주문 A」, 시각은 「지난 통화」로 바꾸세요. 형식 규칙의 별표는 이 층을 처리하지 못합니다. 실제 번호로 운영 시스템을 조회하게 하려면, 이미 「마스킹한 뒤 밖으로 보낸다」를 벗어난 것입니다. 모델 쪽이 식별자를 다시 봅니다. 이 기기의 마스크는 의미가 없습니다.

05 / 대조

그 자리에서 마스킹을 대조하는 법

목표는 「모델이 아무도 보지 못한다」를 증명하는 것이 아닙니다. 여섯 종류가 규칙대로 바뀌고, 이름과 경과가 남아 있으며, 이번 입력이 UsePwd 요청 본문에 들어가지 않았음을 확인하는 것입니다.

  1. 01
    실제 티켓이 아닌 가짜 예시 문의를 준비하세요

    운영 티켓을 쓰지 마세요. 예를 들어 접수번호 WO-20260903-8842, 연락처 김민서, 전화 +821012345678, 이메일 minseo@example.com, 카드 4111111111111111(공개 테스트 번호), 배송지 서울시 강남구 예시로 12입니다. 요청은 어제 오후 네 시 녹취에서 약속한 환불이 들어오지 않았다는 것이고, 주문번호는 EX20260903001입니다. 디버그 메모에는 콜백이 sk_test_ExampleNotARealKey01을 썼고 원본 호스트는 203.0.113.10이라고 적습니다. 같은 본문에 010-1234-5678을 한 줄 더 넣어 두면, 국제형과 국내형 가운데 어느 쪽이 통계에 잡히는지도 갈라 볼 수 있습니다.

  2. 02
    민감정보 마스킹을 열고 입력을 비우세요

    URL 클리너의 민감정보 마스킹으로 들어가세요. 페이지는 열자마자 쓸 수 있습니다. 필요하면 입력칸을 먼저 비워, 지난번 붙여 넣기와 섞이지 않게 하세요. 여섯 인식은 모두 켠 채로, 기본인 스마트 마스킹부터 씁니다.

  3. 03
    인식 통계와 남은 글자를 대조하세요

    결과 통계에는 전화, 이메일, 은행 카드, API Key, IP가 나와야 합니다. 휴대전화는 5678을 남기고, 이메일은 m***@example.com처럼 보이며, 키는 sk_test_와 뒤 네 자리를 남기고, IPv4는 203.0.*.*처럼 보여야 합니다. 김민서, 예시로 12, WO-20260903-8842, EX20260903001, 「어제 오후 네 시」는 그대로여야 합니다. 010-1234-5678을 넣었다면 그 줄이 통계에 잡혔는지도 보세요. 이름과 경과가 남아 있으면, 이 문장을 「더 이상 이을 수 없다」고 보고 대화형 AI에 넘길 단계는 아닙니다.

  4. 04
    전체 마스킹을 한 번 더 돌려 차집합을 보세요

    전체 마스킹으로 바꿉니다. 뒤 네 자리와 이메일 도메인은 더 이상 읽히지 않아야 합니다. 이름, 주소, 접수번호, 경과는 그대로입니다. 이 차집합으로 모델에 맡기는 일이 「말투 수정」인지, 「실제 번호로 계속 조회」인지를 가르세요.

  5. 05
    네트워크 패널에서 원문이 나가는지 보세요

    F12를 누르고 네트워크로 전환하세요. 마스킹하는 동안, 문의 원문 전체를 요청 본문으로 보내는 인터페이스는 보이지 않아야 합니다. 운영 환경에서는 /tj/로 가는 접속 분석이 있을 수 있습니다. 적재는 페이지와 버튼 이름, 예를 들어 마스킹 횟수이며, 붙여 넣은 원문이 아닙니다. 로컬 미리보기는 분석을 보내지 않습니다.

이 단계는 보안 안내와 맞물립니다. 보안 안내는 평문이 브라우저를 떠나는지를 답하고, 이 글은 떠나기 전에 별표가 어느 층을 가리는지만 답합니다. 두 페이지 모두 클리너 폼을 대신하지 않습니다. 티켓에 캠페인 링크가 붙어 있으면, 같은 페이지의 URL 클리너로 utm_*와 click ID를 먼저 뗄 수 있습니다. 그것은 다른 층입니다. 캠페인 링크를 다시 보낼 때 UTM과 click_id가 어떤 신원을 함께 가져가나를 보세요.

06 / 경계

마스킹이 막지 못하는 몇 가지

「별표를 쳤다」를 「대화형 AI에 붙이면 익명이다」로 읽으면, 마찬가지로 대조할 수 있는 경계를 빠뜨립니다.

이미 보낸 대화 01 이 기기의 마스킹은 모델 기록, 업체 로그, 상담원 본인이 저장한 원문을 고치지 못합니다.
임시 채팅도 한동안 남습니다 02 OpenAI는 Temporary Chat이 학습에 쓰이지 않고 기록에도 들어가지 않는다고 쓰면서, 안전 검토를 위해 최대 30일 보관할 수 있다고 적습니다.
개인 계정의 학습 기본값 03 개인용은 업체가 안내하는 대로 거부하지 않으면 대화를 모델 개선에 쓸 수 있습니다. 학습을 거부하는 것과 요청이 상대에게 도달하지 않은 것은 다릅니다.
이 기기가 이미 장악된 경우 04 확장이 페이지를 읽거나, 원격 제어가 클립보드를 볼 수 있으면, 이 기기의 마스크는 더 이상 경계가 아닙니다.

OpenAI의 Temporary Chat 안내는 「기록에 나타나지 않고 학습에 쓰이지 않는다」와 「안전을 위해 최대 30일 보관할 수 있다」를 같은 페이지에 둡니다. 데이터를 모델 성능 개선에 쓰는 방식은 개인 서비스의 내용이, 거부하지 않으면 학습에 쓰일 수 있다고 적습니다. 다른 업체 약관은 다릅니다. 한 회사의 버튼을 모든 대화창의 같은 약속으로 읽지 마세요. 그 자리에서 보이는 공통 사실은 더 단순합니다. 보낸 뒤 본문은 이 컴퓨터만의 통제 아래 있지 않습니다.

먼저 마스킹한 뒤 모델에 맡기기에 맞는 것은, 말투를 고치거나 요점을 나열하거나 오탈자를 보는 텍스트입니다. 직접 식별자를 뺀 뒤에도 경과가 충분할 때입니다. 키 전체, 비밀번호, 미공개 소스, 회의 녹취 전체를 「별표를 쳤으니 붙여도 된다」고 보는 용도가 아닙니다. 비밀 전체는 일회용 링크로 가세요. 평문은 이 기기에서 AES-256-GCM으로 암호화하고, 번호는 ?id=, 키는 #에 두며, 만들기와 읽기 모두 가입 없이 바로 사용하고, 서버는 암호문만 잠시 보관합니다. 키가 접속 로그에 들어가지 않는 이유는 URL의 # 이후가 서버 로그에 안 남는 이유를 보세요. 두 도구를 같은 약속으로 섞지 마세요.

파일 백업은 세 번째 길입니다. 파일 하나 5 GB 이하의 로컬 암복호화는 파일 암호화로 가며, 출력은 .lock / .enc이고 파일은 기본으로 업로드되지 않습니다. 비밀번호 자체의 강도는 비밀번호 생성기로 6–128자 사이를 만든 뒤, 비밀번호 강도 검사로 이 기기에서 강도를 보고 페이지와 함께 제공되는 유출된 약한 비밀번호 공개 목록과 대조하세요. 검사는 전역 유출 조회가 아니며, 검사할 비밀번호는 업로드되지 않습니다. 이 페이지들도 이 글과 같이 가입 없이 바로 사용하며, 상단 바 오른쪽에는 언어 전환만 있습니다.

대화형 AI에 붙이기 전에, 규칙이 가린 것이 여섯 종류인지, 당신이 숨겼다고 생각한 「사람 전체」인지를 보세요. 형식에 걸린 것과 경과로 다시 잇는 것을 가를 수 있어야, 마스킹 원리 글을 「씻었으니 아무 모델에나 넘겨도 된다」는 보증으로 읽지 않습니다.

07 / 질문

붙이기 전에 자주 나오는 물음

아래 네 가지는 이 글의 경계만 답합니다. 클리너 페이지의 버튼 설명을 반복하지 않습니다.

별표를 치면 붙여도 되나요 01 별표만 보지 마세요. 이름, 주소, 접수번호, 경과가 남아 있는지 보세요. 남아 있으면 같은 사람으로 다시 이을 수 있습니다.
임시 채팅은 저장되지 않나요 02 OpenAI를 기준으로 하면, 기록에 들어가지 않고 학습에도 쓰이지 않지만 안전 검토를 위해 최대 30일 남을 수 있습니다. 보내는 단계는 이미 일어났습니다.
마스킹이 하나도 빠지지 않나요 03 아닙니다. 흔한 형식 여섯 종류를 인식합니다. 중요한 외부 문장은 사람이 한 번 더 보세요. UsePwd는 개인정보 보호법이나 GDPR 인증을 주장하지 않습니다.
마스킹하려면 가입해야 하나요 04 필요 없습니다. 가입 없이 바로 사용합니다. 원문은 업로드되지 않고 통계에도 쓰지 않습니다. 계정이나 비밀번호 보관함은 없습니다.
08 / 다음 단계

읽고 나서 마스킹 결과를 대조하세요

글은 「형식 마스킹이 왜 같은 고객을 다시 가리키는가」를 답합니다. 가려진 유형과 남은 경과를 그 자리에서 대조하려면 민감정보 마스킹을 열면 됩니다. 먼저 가입할 필요는 없습니다.