실험 · 실시간 필터

EN

욕설 필터 깨보기

Obscenity는 오픈소스 욕설 필터입니다. 변형을 일일이 적지 않습니다. leetspeak·유니코드 닮은꼴·반복 축소 같은 transformer로 문장을 고친 뒤 단어 목록과 맞춥니다. 깨보세요.

무엇인지

ML 모델이 아닙니다. 여기서 transformer는 텍스트 변환입니다. 소문자화, 닮은꼴 문자, leet 해석, 잡기호 건너뛰기, 반복 글자 축소. 영어 프리셋에 블랙리스트와 권장 변환이 들어 있습니다.

도전

사람이면 막을 문장인데 필터는 통과시키는 쪽을 찾아보세요. 혹은 무해한 문장으로 오탐을 내보세요. Leet·특수 유니코드는 자주 걸립니다. 창의적인 우회가 가끔 먹힙니다.

기본 transformer

  • ASCII 소문자매칭 전에 대소문자를 맞춥니다.
  • 닮은꼴 문자닮은 유니코드를 라틴 문자로 되돌립니다.
  • Leetspeak0→o, 1→i, @$→a/s 등을 해석합니다.
  • 반복 축소글자를 늘여 쓴 형태(f***kk 식)를 줄입니다.
  • 비알파벳 건너뛰기글자 사이에 끼운 기호를 무시합니다.

워밍업

보통은 잡힙니다. 여기서 시작해서 직접 만들어 보세요. 영어 단어 목록만 사용합니다.

입력하면 결과가 바로 나옵니다.

npm 패키지 obscenity(영어 프리셋)를 사용합니다. 휴리스틱일 뿐, 모더레이션 정책이 아닙니다. npm의 obscenity·실험 목록

욕설 필터 깨보기