순서가 결과를 바꾼다
같은 작업이라도 어느 것을 먼저 하느냐에 따라 결과가 달라집니다. 공백을 먼저 지우면 "김민수 "와 "김민수"가 같은 줄이 되어 중복 제거에 걸리지만, 공백 제거를 끄면 둘은 다른 줄로 남습니다. 번호를 먼저 붙이고 정렬하면 번호가 뒤섞이고, 정렬을 먼저 하면 번호가 순서대로 붙습니다. 그래서 이 도구는 순서를 고정해 두고 화면 위에 실제 적용 순서를 적어 둡니다. 순서는 앞뒤 공백 제거 → 연속 공백 축약 → 문자 제거 → 빈 줄 제거 → 중복 제거 → 정렬 → 접두·접미 → 번호 → 이어 붙이기입니다. 원하는 결과가 이 순서로 안 나오면 두 번에 나눠 돌리면 됩니다. 결과를 복사해 다시 입력에 붙여 넣고 다른 작업만 켜는 방식입니다.
지울 문자는 정규식이 아니다
정규식을 모르는 채로 *나 .을 지우려다 엉뚱한 결과를 얻는 일이 흔합니다. 여기서 "지울 문자"에 적은 것은 글자 목록으로만 취급합니다. ·-*라고 적으면 가운뎃점, 하이픈, 별표 세 글자를 각각 찾아 모두 지웁니다. 특수문자를 이스케이프할 필요가 없고, 반대로 \d 같은 표현을 적으면 역슬래시와 d라는 두 글자를 지웁니다. 패턴으로 지워야 한다면 정규식 테스터나 여러 단어 한 번에 바꾸기를 쓰세요.
정렬 방식
가나다·ABC 순은 한국어 로케일 비교를 쓰기 때문에 한글과 영문이 자연스럽게 섞이고, 항목2가 항목10보다 앞에 오는 자연 정렬이 적용됩니다. 단순 문자 코드 정렬이라면 항목10이 먼저 와서 목록이 이상해집니다. "짧은 줄부터"와 "긴 줄부터"는 글자 수 기준이며 길이가 같으면 가나다순으로 이어 정렬합니다. "입력 순서 뒤집기"는 정렬이 아니라 그냥 순서를 반대로 돌리는 것이라 원래 순서가 의미 있는 목록(시간순 로그 등)에 씁니다.
이어 붙이기를 쓰는 자리
줄바꿈으로 된 목록을 한 줄로 만들어야 할 때가 자주 있습니다. 이메일 프로그램의 받는 사람 칸, SQL의 IN (...) 절, 태그 입력란 같은 곳입니다. 쉼표만으로 붙이는 것과 쉼표+공백으로 붙이는 것은 붙여 넣을 곳에 따라 다르니 둘 다 두었습니다. 따옴표+쉼표는 SQL이나 코드에 넣을 문자열 목록을 만들 때 쓰는데, 항목 안에 작은따옴표가 들어 있으면 역슬래시로 이스케이프해 넣습니다. 다만 데이터베이스마다 이스케이프 규칙이 달라서 그대로 쿼리에 넣기 전에 확인하는 편이 안전합니다.
자주 묻는 질문
줄 정리 도구와 뭐가 다른가요?
줄 정리는 중복 제거·정렬·빈 줄 삭제 같은 기본 줄 조작을 하나씩 하는 도구입니다. 이 도구는 거기에 문자 제거, 접두·접미 붙이기, 번호 형식 선택, 쉼표 결합까지 얹어 한 번에 통과시키는 파이프라인입니다. 작업이 하나면 줄 정리가 빠르고, 서너 개를 이어 해야 하면 여기가 편합니다.
중복 판단에서 대소문자를 무시할 수 있나요?
이 도구는 글자가 완전히 같을 때만 중복으로 봅니다. 대소문자를 무시해야 한다면 먼저 대소문자 변환으로 한쪽으로 통일한 뒤 여기에 넣으세요. 전각·반각 차이나 눈에 보이지 않는 유니코드 공백도 다른 글자로 취급되어 중복으로 잡히지 않습니다.
작업을 전부 껐는데 결과가 그대로예요.
맞습니다. 켠 작업이 없으면 원본을 그대로 돌려주고 화면 위에 "적용한 작업 0개"라고 표시합니다. 통계에서 원본과 결과의 줄 수·글자 수만 비교하고 싶을 때 그렇게 쓰기도 합니다.