컴백부터 K-뷰티까지 — K-컬쳐의 모든 것을 메일로 받아보세요메일로 받아보기

METAL MEDIA

AI 챗봇에 넣기 전에 이름·주소를 자동으로 지워주는 오픈소스 도구, 지워도 성능은 그대로였다

arXiv:2608.182602026-08-20

Redakto - The Incognito Tab for LLMs

AI 챗봇에 넣기 전에 이름·주소를 자동으로 지워주는 오픈소스 도구, 지워도 성능은 그대로였다

Redakto는 텍스트를 대형언어모델(LLM)에 넣기 전에 이름, 주소 같은 개인식별정보(PII)를 자동으로 찾아 가리거나 다른 이름으로 바꿔주는 오픈소스 도구다. 이메일, 임상 기록, 법률 문서 세 분야 데이터로 성능을 검증했고, 웹 화면과 개발자용 API, LLM 비서가 바로 쓸 수 있는 연결 규격(MCP)까지 제공한다. 실험 결과 정보를 지운 텍스트로도 의료 의도 분류나 인권 침해 판정 같은 후속 작업의 정확도가 원본과 큰 차이 없이 유지됐다.

METAL MEDIA 해설 도표

AI 챗봇에 넣기 전에 이름·주소를 자동으로 지워주는 오픈소스 도구, 지워도 성능은 그대로였다

  1. 01독일 이메일 데이터(CodE Alltag)와 법률 문서(LER)에서는 개인정보 탐지 정확도(macro F1)가 약 0.95에 달했고, 데이터가 적은 임상 문서(GraSCCo)에서는 성능이 더 낮았는데, 이는 모델 구조보다 학습 데이터 부족이 원인으로 분석됐다
  2. 02이름·날짜·기관명 등을 지우는 방식을 의미상 비슷한 말로 바꾸기, 무작위 마스킹, 일반 마스킹 세 가지로 나눠 비교했고, 의미상 비슷한 말로 바꾸는 방식이 원본 성능을 가장 잘 유지했다
  3. 03의료 대화에서 의사의 발화 의도를 분류하는 과제와 유럽인권재판소 판결문에서 인권 침해 여부를 예측하는 과제 두 가지로 '정보를 지운 텍스트가 실제로 쓸모 있는지'를 직접 검증했다
  4. 04문서 안에 개인정보가 아주 많이 섞여 있어도(문서당 평균 86개, 많으면 수백 개) 성능 저하는 주로 문서 길이 때문이지 정보를 지우는 작업 자체 때문은 아니었다
  5. 05Streamlit 화면과 FastAPI 서버로 이루어진 시스템을 Docker와 쿠버네티스로 자체 서버에 설치할 수 있고, 코드와 모델을 모두 공개했다
METAL MEDIA이 원문을 바탕으로 재구성한 해설 도표이며, 논문 저자의 원문 figure가 아닙니다.

무엇을 했나

  1. 독일 이메일 데이터(CodE Alltag)와 법률 문서(LER)에서는 개인정보 탐지 정확도(macro F1)가 약 0.95에 달했고, 데이터가 적은 임상 문서(GraSCCo)에서는 성능이 더 낮았는데, 이는 모델 구조보다 학습 데이터 부족이 원인으로 분석됐다
  2. 이름·날짜·기관명 등을 지우는 방식을 의미상 비슷한 말로 바꾸기, 무작위 마스킹, 일반 마스킹 세 가지로 나눠 비교했고, 의미상 비슷한 말로 바꾸는 방식이 원본 성능을 가장 잘 유지했다
  3. 의료 대화에서 의사의 발화 의도를 분류하는 과제와 유럽인권재판소 판결문에서 인권 침해 여부를 예측하는 과제 두 가지로 '정보를 지운 텍스트가 실제로 쓸모 있는지'를 직접 검증했다
  4. 문서 안에 개인정보가 아주 많이 섞여 있어도(문서당 평균 86개, 많으면 수백 개) 성능 저하는 주로 문서 길이 때문이지 정보를 지우는 작업 자체 때문은 아니었다
  5. Streamlit 화면과 FastAPI 서버로 이루어진 시스템을 Docker와 쿠버네티스로 자체 서버에 설치할 수 있고, 코드와 모델을 모두 공개했다
Figure 1: PII-detection performance on GraSCCo
Figure 1: PII-detection performance on GraSCCo
Table 1: PII-detection performance on CodE Alltag
ModelPrecRecF1
xlm-roberta-large0.9442 ±0.00.9358 ±0.00.9399 ±0.0
gelectra-large0.9433 ±0.00.9371 ±0.00.9401 ±0.0
bert-base-german-cased0.9251 ±0.00.9160 ±0.00.9204 ±0.0
Figure 2: Medical Intent classification on anonymized texts
Figure 2: Medical Intent classification on anonymized texts
Table 2: PII-detection performance on LER
ModelPrecRecF1
xlm-roberta-large0.940.950.94
gelectra-large0.950.960.95
bert-base-german-cased0.950.940.95
Figure 3: Entity density wise performance (Macro-F1) comparison for different redaction strategies (xlm-roberta-large)
Figure 3: Entity density wise performance (Macro-F1) comparison for different redaction strategies (xlm-roberta-large)
Table 3: Examples of redaction strategies applied to a clinical text
VersionText
Originalmiss edwards is here for evaluation of facial pain this is a 54-year-old female
Semantic Label Maskingmiss [PERSON] is here for evaluation of facial pain this is a [DATE] female
Random Maskingmiss lhyZXSX is here for evaluation of facial pain this is a vejE4fPRUxkG female
Generic Maskingmiss XXXX is here for evaluation of facial pain this is a XXXX female
Figure 4: Entity density wise performance (Macro-F1) comparison for different redaction strategies (bert-large-cased)
Figure 4: Entity density wise performance (Macro-F1) comparison for different redaction strategies (bert-large-cased)
Table 4: Binary Violation prediction on anonymized texts
Redaction Strategyxlm-roberta-largebert-large-casedelectra-large-discri.
No Redaction0.86 ±0.010.85 ±0.010.84 ±0.01
Semantic Label Masking0.86 ±0.010.84 ±0.010.82 ±0.02
Random Masking0.85 ±0.010.82 ±0.020.82 ±0.01
Generic Masking0.84 ±0.020.85 ±0.010.82 ±0.02
Figure 6: System design of Redakto
Figure 6: System design of Redakto

왜 중요한가

유럽연합의 개인정보 관련 법 때문에 병원, 법률, 행정 기관이 LLM을 쓰기 꺼려하는 상황에서, 정보를 지워도 작업 품질이 떨어지지 않는다는 근거를 실제 실험으로 보여준 점이 의미가 있다. 자체 서버에 설치 가능한 오픈소스로 공개되어 있어 개인정보를 외부로 보내지 않고도 LLM을 안전하게 활용하려는 개발자와 연구자가 바로 가져다 쓸 수 있다.

이 논문의 용어

  • 개인식별정보(PII) · 이름, 주소, 생년월일처럼 특정 개인을 알아볼 수 있게 하는 정보
  • 대형언어모델(LLM) · 방대한 텍스트로 학습되어 문장을 이해하고 생성하는 AI 모델
  • 가명처리(pseudonymization) · 개인정보를 지우는 대신 다른 이름이나 표시로 바꿔 원문 흐름은 유지하는 방식
  • Model Context Protocol(MCP) · LLM 비서나 에이전트가 외부 도구를 직접 호출해 쓸 수 있게 해주는 연결 규격
  • macro F1 · 여러 항목 각각의 정확도를 평균 낸 값으로, 특정 항목에 치우치지 않고 전체 성능을 재는 지표

본문에 싣지 못한 그림

  • Figure 5: Entity density wise performance (Macro-F1) comparison for different redaction strategies (electra-large-discriminator)
원문에서 그림 보기 →

저자 · Saurav Kumar Saha, Tom R\"ohr, Felix Bie{\ss}mann

arXiv에서 원문 보기

최신 논문

논문 전체 보기 →

METAL MEDIA 최신 기사

그림 출처: Saurav Kumar Saha et al., arXiv:2608.18260, CC BY-SA 4.0