top of page

온라인 종합 텍스트 필터기(데이터 정제기) 사용법 (RegEx 지원)

본 웹 애플리케이션은 대용량 텍스트 데이터, 소스 코드, 서버 로그 파일 등을 사용자가 원하는 규칙에 따라 빠르고 정확하게 편집·정제할 수 있는 웹 기반 무료 텍스트 필터 툴입니다.

 

불필요한 문자 삭제, 특정 줄 추출, 공백 제거는 물론 강력한 정규 표현식(RegEx) 필터링까지, 복잡한 프로그램 설치 없이 브라우저에서 즉시 처리할 수 있습니다.

💡 주요 기능 및 효율적인 사용법

1. 본문 문자 찾아 바꾸기 (대체 및 일괄 삭제)
 텍스트 안에서 바꾸고자 하는 특정 단어나 기호를 입력하여 다른 문자로 일괄 전환합니다.
 

  • 일반 모드: 컴마(,)로 구분하여 여러 단어를 동시에 지정하고 다른 문자로 치환하거나 일괄 삭제할 수 있습니다. (※ 특정 단어를 통째로 제거하고 싶을 때는 '바꿀 문자' 칸을 완전히 비워두세요.)
     

  • 정규식 모드: 컨트롤 패널의 '정규식 모드 전환'을 켜면 입력한 문자가 정규식 패턴으로 컴파일되어 작동합니다.


2. 각 줄 N번째 글자 기준 영역 삭제 (텍스트 슬라이스)
각 행(Line)의 특정 글자 수를 기준으로 앞 영역 또는 뒤 영역을 전면 삭제합니다.
예를 들어 숫자 '3'을 입력하고 '뒤'를 선택하면, 각 줄에서 앞에서 딱 3글자만 남기고 그 뒤의 모든 텍스트는 깨끗하게 지워집니다.

일정한 규격의 고정 가중치 데이터나 텍스트 머리말을 잘라낼 때 유용합니다.

3. 특정 단어 포함/미포함 줄(Line) 제어
불필요한 데이터가 포함된 행을 통째로 지우거나(3번), 반대로 반드시 남겨야 하는 핵심 키워드가 포함된 행만 필터링하여 남길 수 있습니다(4번).

일반 모드에서는 컴마(,)로 복수 단어를 지정할 수 있고, 정규식 모드를 켜면 특정 패턴(예: 숫자로 시작하는 줄 등)을 감지해 라인 단위로 완벽하게 정제합니다.

4. [고급] 정규식 전용 필터 (치환 및 매칭 삭제)
프로 유저와 개발자를 위한 독립형 순수 정규 표현식(RegEx) 엔진 영역입니다.
컨트롤 패널의 토글 여부와 상관없이 항상 자바스크립트 표준 정규식 문법을 100% 가공 없이 실행합니다.

텍스트 내부의 이메일 주소, 전화번호, IP 주소 같은 유동적인 포맷의 데이터나 문맥적 패턴을 정밀하게 타겟팅하여 치환하거나 일괄 삭제할 수 있습니다.
 
5. 원클릭 데이터 자동 정제 옵션
하단의 체크박스를 활용해 줄공백(빈 줄) 제거, 들여쓰기(앞공백) 제거는 물론, 텍스트 내의 영어·한글·숫자·특수문자(모든 기호)를 종류별로 선택하여 단 한 번의 클릭으로 자동 삭제할 수 있습니다.

🚀 연속 작업 및 생산성을 위한 편의 기능

1. 결과물 입력 기능

변환이 완료된 결과 텍스트를 버튼 하나로 상단 원본 입력창에 자동으로 다시 채워 넣습니다.

정제된 결과물을 바탕으로 2차, 3차 추가 필터링 및 다중 정규식 작업을 이어갈 때 작업 시간을 획기적으로 단축해 줍니다.

2. 변환 후 옵션 초기화

변환 실행 즉시 1~5번의 세부 입력 필드 값을 자동으로 비워줍니다.

매번 기존 입력값을 수동으로 지울 필요 없이 새로운 정제 규칙을 바로 이어서 적용할 수 있습니다.

(필요에 따라 켜고 끌 수 있습니다.)

3. 줄번호 추가/제거 및 원클릭 복사

최종 정제된 텍스트의 라인 수를 직관적으로 확인할 수 있도록 줄번호 토글 기능을 제공하며, 클립보드 복사 버튼을 통해 안전하고 빠르게 결과물을 복사할 수 있습니다.

🛠️ 가장 많이 쓰는 필수 정규식(RegEx) 활용 팁

5번 '정규식 전용 필터' 또는 정규식 모드를 켠 상태에서 아래 패턴을 복사해서 넣으면 고급 정제 작업을 즉시 수행할 수 있습니다.

  • \d : 모든 숫자를 의미합니다. (0~9)

        (텍스트에서 숫자만 전부 지우고 싶을 때 패턴에 \d를 넣고 대체 문자를 비워둡니다.)

  • \D : 숫자가 아닌 모든 것을 의미합니다.

        (텍스트에서 숫자만 남기고 다 지우고 싶을 때 유용)

     

  • \s : 공백 문자 (스페이스, 탭, 줄바꿈 등)를 의미합니다.

  • . : 아무 글자 1개를 의미합니다.

       (문자, 숫자, 공백 불문)

       예) 가.다 패턴은 '가나다', '가다다', '가1다', '가 다'를 모두 찾아냅니다.​

  • {N} : 정확히 N번 반복되는 패턴을 찾습니다.

       예) \d{4} → 연속된 숫자 4자리 (예: 연도, 비밀번호 포맷 등)를 찾습니다.

  • + : 최소 1번 이상 연속으로 나오는 것을 찾습니다.

        예) \d+ → '1'도 찾고 '12345'도 하나의 덩어리로 묶어서 한 번에 찾습니다.

         (앱에서 성능을 높일 때 유용)

  • ^ : 줄의 시작을 의미합니다.

       예)  ^안녕 → '안녕하세요'처럼 안녕으로 시작하는 줄만 찾습니다.

      

  • $ : 줄의 끝을 의미합니다.

       예) 입니다$ → "맨 마지막이 '입니다'로 끝나고 바로 줄바꿈이 되는 줄을 찾습니다.

  • | : OR(또는) 연산자입니다.

       예) 모바일|아이폰|안드로이드 → 셋 중 하나의 단어라도 걸리면 매칭됩니다.

정규식 실무용 복합 패턴

​찾을 문자에 아래 정규식 입력 후 바꿀 문자에는 비워둠 (공백 하나로 바꿀 때는 예외)

  • HTML 태그 완전 삭제 (순수 텍스트만 추출)

        <[^>]*> 

  • 이메일 주소 일괄 제거 및 마스킹

        [a-zA-Z0-9._%+-]+@[a-zA-Z0-9.-]+\.[a-zA-Z]{2,} 

  • 전화번호/휴대폰 패턴 지우기

        \d{2,3}-\d{3,4}-\d{4} 

  • 연속된 중복 공백(스페이스 여러 개)을 한 칸으로 줄이기

         +

        (스페이스바로 공백 입력후 +입력, 바꿀 문자에는 공백하나만 입력)

  • 괄호와 괄호 안의 내용까지 통째로 지우기

         \([^)]*\) 

  • 줄 맨 앞이 주석(//)으로 시작하는 줄 전체 날리기

         ^\/\/.* 

🎯 대표적인 활용 사례 (Use Cases)

✔ 웹 개발자 및 퍼블리셔

소스 코드 구조에서 불필요한 주석 기호나 들여쓰기 공백을 일괄 제거하고 코드를 콤팩트하게 정리할 때 효과적입니다.

✔ 데이터 분석가 및 마케터

CSV, 이메일 리스트, 키워드 목록에서 특수문자나 빈 줄을 제거하고 특정 키워드가 포함된 행만 깔끔하게 정제하여 데이터 노이즈를 줄일 수 있습니다.

✔ 일반 문서 편집 및 텍스트 교정

메모장이나 웹에서 긁어온 글의 무작위 줄바꿈(공백 라인)을 정리하거나 알파벳, 숫자만 따로 골라내어 삭제하고 싶을 때 유용합니다.

bottom of page