Agentforce가 레코드를 검색하면, 자신이 읽는 필드 안의 모든 것이 AI 맥락에 들어갑니다. 여기에는 자유 텍스트 필드에 숨어 있는 모든 개인 식별 정보(PII)가 포함되며, 그 필드가 애초에 민감한 데이터를 담도록 의도된 적이 없더라도 마찬가지입니다. 케이스 코멘트에 붙여넣어진 주민등록번호는 에이전트가 읽고, 추론하고, 생성된 응답에서 노출할 수 있는 것의 일부가 됩니다.
이 가이드는 PII가 어떻게 Agentforce 맥락에 도달하는지, Salesforce 내 어디에 축적되는지, 그리고 가동 전에 이를 찾고 해결하는 방법을 설명합니다. 이 가이드는 관련된 두 가이드를 기반으로 합니다. 전체 배포 준비도를 위한 Agentforce 준비 허브, 그리고 DQS 패턴 매칭이 어떻게 작동하는지에 대한 PII 탐지입니다.
PII는 어떻게 Agentforce 맥락에 들어갑니까?
Agentforce 에이전트는 일관된 흐름을 따릅니다. Salesforce 레코드를 검색하고, 자신이 읽는 필드 값에 추론을 근거하며, 그 맥락에서 응답을 생성합니다. PII는 검색 단계에서 들어갑니다. 에이전트는 민감한 데이터를 위해 의도된 필드와 민감한 데이터가 우연히 떨어진 자유 텍스트 필드를 구분하지 않습니다. 둘 다 읽습니다.
세 가지 소스가 시간이 지나면서 텍스트 필드를 PII로 채웁니다.
- 이메일-투-케이스. 수신 메시지가 Case Description과 Comments에 그대로 캡처됩니다. 고객은 문제를 설명할 때 SSN, 계좌 번호, 카드 정보를 포함합니다. 그 모든 것이 텍스트 필드에 떨어집니다.
- 지원 및 영업 노트. 상담원은 통화 중에 신원 확인 정보, 결제 정보, 연락처 데이터를 노트에 붙여넣습니다. 그 노트는 상호작용이 끝난 후에도 오래 남습니다.
- 가져온 데이터와 연동된 데이터. 마이그레이션과 연동은 연락처 정보, 생년월일, 식별자를 검증이 실행되지 않는 description 및 comment 필드에 씁니다.
그 데이터가 검색 가능한 필드에 자리 잡으면, 해당 오브젝트를 읽도록 범위가 지정된 어떤 에이전트든 그것을 맥락으로 끌어올 수 있습니다. 노출은 단 하나의 에이전트를 배포하기 전에 이미 존재합니다. 배포는 잠복해 있던 데이터 문제를 활성 문제로 바꿉니다.
PII는 Salesforce 내 어디에 숨어 있습니까?
PII는 비정형 텍스트 필드에 집중됩니다. 구조화된 필드(Email, Phone)는 설계상 PII를 포함하며 그에 따라 관리됩니다. 위험은 사용자가 임시 공간처럼 다루는 자유 텍스트 필드에 있습니다.
| 오브젝트 | 고위험 필드 | 축적되는 이유 |
|---|---|---|
| Case | Description, Comments | 이메일-투-케이스가 고객 메시지를 그대로 씀 |
| Lead | Description | 가져온 목록과 폼 제출이 여기에 떨어짐 |
| Contact | Description | 확인 및 계정 정보에 관한 노트 |
| Account | Description | 관계 노트와 청구 맥락 |
| Task / Event | Description, Comments | 확인 데이터를 캡처하는 통화 노트 |
| Opportunity | Description | 결제 조건을 언급하는 거래 노트 |
| Note (Content) | Body | 모든 레코드에 대한 자유 형식 첨부 |
Case의 Description 및 Comments 필드는 이메일-투-케이스가 자동으로, 그리고 대량으로 공급하기 때문에 가장 높은 위험을 수반합니다. 어떤 스캔에서든 이 두 필드를 첫 번째 우선순위로 다루십시오. 숨어 있는 위치에 대한 전체 시나리오는 PII 탐지 시나리오를 참조하십시오.
어떤 규제가 적용됩니까?
검색 가능한 필드 안의 PII는 여러분의 조직이 이미 운영하고 있는 개인 정보 보호 및 보안 프레임워크에 연루될 수 있습니다. 구체적인 사항은 여러분의 데이터, 관할권, 계약상 의무에 따라 달라지므로, 아래 사항을 법률 자문이 아니라 컴플라이언스 팀과 함께 검토할 출발 목록으로 다루십시오.
- GDPR. 데이터 최소화 및 목적 제한과 같은 원칙은 일반적으로 PII가 의도된 용도를 벗어난 필드에 있어서는 안 됨을 의미합니다. description 필드에서 생년월일을 읽는 에이전트는 그 데이터가 수집된 목적의 범위를 벗어날 수 있습니다.
- HIPAA. 보호 대상 건강 정보(PHI)가 지원 노트나 케이스 텍스트에 나타나는 경우, 그 필드를 처리하는 모든 시스템에 처리 규칙이 적용될 수 있으며, 여기에는 AI 에이전트도 포함됩니다.
- PCI DSS. 자유 텍스트 필드 안의 카드 데이터는 일반적으로 저장 및 처리 요구사항의 적용을 받습니다. Case Comments 안의 카드 번호는 흔하고 우선순위가 높은 결과입니다.
DQS는 전적으로 Salesforce 내부에서 실행되므로, PII를 스캔해도 새로운 데이터 전송이 발생하거나 데이터가 외부 서비스로 이동하지 않습니다. 어떤 데이터도 조직 밖으로 나가지 않습니다. 그래서 탐지 단계 자체가 국경 간 전송 및 처리자 관련 우려의 범위에서 벗어납니다. 배포 전에 여러분의 상황에 대한 규제 매핑을 컴플라이언스 팀과 확인하십시오.
DQS로 PII를 어떻게 스캔합니까?
DQS는 여덟 가지 사전 정의된 정규식 패턴으로 텍스트 필드를 스캔하고 노출을 단일 메트릭으로 보고합니다. 탐지는 결정론적이고 투명합니다. 적용된 모든 패턴을 볼 수 있으며, 동일한 입력은 항상 동일한 결과를 반환합니다.
여덟 가지 패턴은 네 가지 카테고리를 다룹니다.
| 카테고리 | 패턴 |
|---|---|
| Financial(금융) | 주민등록번호, 신용카드 번호, IBAN |
| Contact(연락처) | 이메일 주소, 미국 전화번호, 국제 전화 |
| Technical(기술) | IP 주소 |
| Identity(신원) | 생년월일 |
세 가지 제어 항목으로 스캔을 구성하십시오.
- 사전 설정. Critical 사전 설정은 SSN과 신용카드만 활성화합니다. 오탐이 거의 없는 빠른 금융 PII 검사에 사용하십시오. Standard 사전 설정은 이메일과 미국 전화를 추가합니다. Extended 사전 설정은 여덟 가지를 모두 실행합니다.
- 필드별 재정의. 다른 필드에 다른 패턴 세트를 적용하십시오. Email 필드에서는 이메일 일치가 예상되므로 SSN과 신용카드만 스캔하십시오. Description과 Comments에서는 어떤 PII 유형도 나타날 수 있으므로 전체 Extended 세트로 스캔하십시오.
- PII 노출 비율. 이것이 대표 메트릭입니다. 최소 하나의 패턴 일치를 포함하는 스캔된 레코드의 백분율입니다. PII가 있는 레코드 개수와 함께 사용하여 정리 범위를 정하십시오.
Definition Builder에서 각 고위험 오브젝트에 대한 정의를 작성하고, Description 및 Comments 필드를 지정한 다음, 금융 PII를 분리하기 위해 Critical 사전 설정을 먼저 실행하십시오. 그런 다음 완전한 인벤토리를 위해 Extended를 실행하십시오.
해결 플레이북은 어떤 모습입니까?
PII 스캔은 일치 항목 목록을 만들어냅니다. 해결은 그 목록을 해결된 결과로 바꿉니다. 순서대로 진행하십시오.
- 일치 항목을 검토하십시오. 일부 패턴은 오탐 위험을 수반합니다. 생년월일은 미국 형식의 모든 날짜와 일치하며, 신용카드는 긴 주문 번호와 일치할 수 있습니다. 각 일치 항목을 PII로 취급하기 전에 확인하십시오. 패턴 카테고리를 사용하여 분류하십시오. 금융 결과가 먼저입니다.
- 필드별로 조치를 결정하십시오. 확인된 각 결과에 대해 세 가지 대응 중 하나를 선택하십시오.
- 마스킹. 주변 텍스트를 에이전트가 쓸 수 있도록 유지하면서 민감한 값을 대체합니다.
- 삭제. 비즈니스 목적이 없는 값을 제거합니다.
- 에이전트 범위에서 필드 제외. 에이전트가 필요로 하지 않는 PII를 필드가 일관되게 담고 있는 경우, 그 필드를 에이전트의 검색 범위에서 제거하여 데이터가 절대 맥락에 들어가지 않게 합니다.
- 다시 실행하여 검증하십시오. 해결 후 동일한 스캔을 다시 실행하십시오. PII 노출 비율을 해결 전 기준선과 비교하십시오. 그 수치가 정리가 효과적이었음을 확인해 줍니다. 모든 차원에 걸친 구조화된 정리 순서는 Agentforce를 위한 Salesforce 데이터 정리 가이드를 따르십시오.
에이전트 범위에서 필드를 제외하는 것은 필드에 AI 가치가 없을 때 가장 빠른 제어 방법입니다. 마스킹과 삭제는 에이전트가 여전히 읽어야 하는 필드를 다룹니다.
배포 전 PII 안전 목표
데이터가 Agentforce가 접근할 모든 텍스트 필드에서 다음 목표를 충족할 때까지 배포를 보류하십시오.
- 에이전트 범위의 텍스트 필드에서 PII 노출 비율 1% 미만.
- Case Description 및 Comments에서 SSN 일치 0건.
- Case Description 및 Comments에서 신용카드 일치 0건.
- Email 및 Phone 필드가 비율을 부풀리지 않도록 예상 내용 필드에 대해 필드별 재정의 구성.
이 기준치는 Agentforce 데이터 준비도 체크리스트에서 가져온 것입니다. 가동 전에 이 기준에 대해 컴플라이언스 팀의 승인을 받고, 해결된 데이터로 에이전트 응답을 테스트하여 생성된 내용에 PII가 나타나지 않는지 확인하십시오.
가동 후 PII를 어떻게 차단합니까?
PII 노출은 일회성 정리가 아닙니다. 이메일-투-케이스는 고객 메시지를 계속해서 Case 필드에 쓰고, 사용자는 확인 정보를 계속해서 노트에 붙여넣습니다. 깨끗한 데이터셋도 몇 주 안에 새로운 노출을 축적합니다.
회귀를 일찍 포착하도록 반복 스캔을 예약하십시오.
| 스캔 | 빈도 | 오브젝트 |
|---|---|---|
| PII 탐지 (Critical 사전 설정) | 주간 | Cases, Leads (대량 텍스트 필드) |
| PII 탐지 (Extended 사전 설정) | 월간 | 에이전트 범위의 모든 오브젝트 |
상승 추세가 에이전트에 도달하기 전에 검토를 촉발하도록 시간에 따른 PII 노출 비율을 추적하십시오. Case와 Lead에 대한 주간 스캔은 새 PII가 가장 빠르게 떨어지는 필드를 다룹니다. 스캔 결과가 조치로 이어지도록 결과 검토 담당을 지정하십시오.
탐지되지 않은 PII는 에이전트가 비준수 출력을 생성하는 가장 흔한 이유 중 하나입니다. 더 넓은 실패 패턴은 Agentforce 에이전트가 실패하는 이유를 참조하십시오.
다음 단계
- PII 탐지: 여덟 가지 패턴, 사전 설정, 필드별 구성 상세
- Agentforce 준비: 여섯 차원 전반에 걸친 전체 배포 준비도
- Agentforce 데이터 준비도 체크리스트: 완전한 배포 전 목표 목록
- Agentforce 데이터 품질 FAQ: 에이전트용 데이터 준비에 관한 흔한 질문
- AI 준비 평가: 현재 준비도 점수 확인
