엑셀 중복값 찾기 완벽 가이드: 조건부 서식부터 함수 활용까지 한 번에 정리

핵심만 먼저 확인하세요
- 단순 확인 및 육안 검토가 목적이라면 조건부 서식의 셀 강조 규칙을 적용하는 것이 가장 빠르고 직관적입니다.
- 중복 횟수 집계나 순번 부여 등 후속 연계 작업이 필요하다면 COUNTIF 및 COUNTIFS 함수를 활용해야 합니다.
- 이름과 연락처 등 복합 열을 대조할 때는 보조열 병합 방식이나 다중 조건 수식으로 고유 식별값을 만들어 검증합니다.
마감 시간이 임박한 늦은 오후, 여러 부서에서 취합한 수천 건의 고객 명부나 재고 입출고 내역을 하나의 시트로 합치는 순간을 떠올려 보십시오. 얼핏 보기에는 정리가 끝난 것처럼 보이지만, 동일한 고객이 사은품을 두 번 수령하도록 명단에 중복 등록되어 있거나, 하나의 품목 코드가 여러 행에 제각각 입력되어 총 수량이 어긋나는 위험은 늘 도사리고 있습니다. 스크롤을 무작정 내리며 눈으로 같은 값을 찾아내려는 시도는 피로를 가중할 뿐 아니라 치명적인 업무 누락으로 이어지기 십상입니다.
엑셀에서 중복값을 다루는 작업은 단순히 '같은 글자를 찾아 지우는 일'에 그치지 않습니다. 어떤 상황에서는 중복된 행 전체를 보존하면서 첫 번째 입력 건과 두 번째 이후 입력 건을 구분해야 하고, 어떤 상황에서는 두 개 이상의 열이 동시에 일치하는 복합 조건만을 걸러내야 합니다. 프로그램이 지원하는 기본 기능과 수식의 특성을 정확히 이해하면 수작업 시간을 획기적으로 줄이고 데이터의 무결성을 안정적으로 확보할 수 있습니다.
조건부 서식을 활용한 즉각적인 시각화와 색상 식별
입력된 원본 데이터의 형태를 훼손하지 않으면서 중복 여부만 빠르게 훑어보고 싶을 때 가장 효율적인 수단은 조건부 서식입니다. 검토하고자 하는 열이나 셀 범위를 지정한 뒤 상단 리본 메뉴의 [홈] 탭에서 [조건부 서식] > [셀 강조 규칙] > [중복 값]을 순서대로 선택하면, 지정 범위 내에서 2회 이상 나타난 모든 항목이 기본 연한 빨강 채우기 등의 지정 색상으로 자동 강조 표시됩니다.
이 방식은 별도의 수식을 타이핑할 필요가 없어 직관적이지만, 대용량 데이터를 처리할 때는 렌더링 부하가 발생할 수 있습니다. 수만 행을 초과하는 대규모 스프레드시트 전체에 조건부 서식을 광범위하게 적용할 경우 화면 스크롤이나 셀 수정 시 연산 지연이 발생할 수 있으므로, 검토 작업이 완료된 후에는 규칙 관리자에서 서식을 지우거나 필요한 구간에 한정하여 적용하는 요령이 필요합니다.
- 적용 경로: 홈 탭 > 스타일 그룹 > 조건부 서식 > 셀 강조 규칙 > 중복 값
- 서식 옵션 대화상자에서 '중복'뿐만 아니라 단 한 번만 입력된 '고유' 값만 반전하여 표시하는 것도 가능
- 색상 지정 후 데이터 필터의 '색 기준 필터' 기능을 연계하면 강조된 중복 행만 상단에 모아서 검토 가능
이 글의 요점
- 단순 확인 및 육안 검토가 목적이라면 조건부 서식의 셀 강조 규칙을 적용하는 것이 가장 빠르고 직관적입니다.
- 중복 횟수 집계나 순번 부여 등 후속 연계 작업이 필요하다면 COUNTIF 및 COUNTIFS 함수를 활용해야 합니다.
- 이름과 연락처 등 복합 열을 대조할 때는 보조열 병합 방식이나 다중 조건 수식으로 고유 식별값을 만들어 검증합니다.
- 보이지 않는 양끝 공백이나 보이지 않는 서식 차이가 일치 판단을 방해하므로 전처리 단계에서 TRIM 함수 정리가 선행되어야 합니다.
- 중복 항목 제거 기능은 원본 데이터를 영구 삭제하므로 반드시 워크시트 백업본을 생성한 뒤 실행해야 데이터 유실을 막을 수 있습니다.
COUNTIF 및 COUNTIFS 함수를 이용한 정밀한 중복 빈도 계산
조건부 서식이 단순한 '시각적 표시'에 그친다면, 함수를 활용한 방식은 중복 발생 횟수를 숫자로 기록하여 정렬, 필터링, 조건문 연산의 근거 자료로 확장할 수 있다는 강력한 이점이 있습니다. 가장 기본이 되는 수식은 `=COUNTIF(범위, 기준셀)` 구조입니다. 예를 들어 B열에 위치한 거래처 코드의 중복 횟수를 C2 셀에 계산하고자 한다면 `=COUNTIF($B$2:$B$1000, B2)`를 입력하고 아래로 수식을 채워 넣습니다. 결과값이 2 이상으로 반환되는 행은 중복 입력된 데이터임을 뜻합니다.
실무에서는 '모든 중복 건'을 찾는 데서 더 나아가 '처음 등장한 원본은 유지하고, 두 번째 이후로 나타난 중복 항목만 골라내어 삭제'해야 하는 경우가 빈번합니다. 이때는 범위의 시작점만 고정하는 누적 참조 기법을 활용합니다. `=COUNTIF($B$2:B2, B2)`와 같이 첫 번째 참조 영역의 시작 셀만 절대 참조($)로 묶고 끝 셀을 상대 참조로 열어두면, 위에서부터 행이 내려가면서 해당 데이터가 몇 번째로 나타났는지 누적 순번이 매겨집니다. 결과가 1인 행은 최초 등록 데이터이고, 2 이상인 행은 이후 중복 추가된 데이터로 명확히 구분됩니다.
온라인 쇼핑몰 정산 담당자인 30대 김 모 대리는 월말 결산마다 여러 채널에서 취합된 3만여 건의 주문 데이터를 검증하느라 곤욕을 치렀습니다. 단순히 '중복된 항목 제거'를 눌렀다가 주문번호는 같지만 옵션 품목이 다른 행들까지 한꺼번에 삭제되어 재고 수량이 크게 틀어지는 실수를 겪기도 했습니다. 이후 김 대리는 원본 시트를 복제한 뒤 주문번호와 옵션 코드를 묶는 보조열을 생성하고 누적 COUNTIF 수식(`=COUNTIF($C$2:C2, C2)`)을 걸어 순번을 매기는 작업 체계를 도입했습니다. 그 결과 1을 초과하는 불필요한 단순 이중 결제 건만 안전하게 격리 추출할 수 있었고, 정산 검토 소요 시간을 반나절 이상 단축하면서 데이터 오류 발생률을 제로에 가깝게 낮출 수 있었습니다.
이름과 연락처가 동시에 일치하는 다중 조건 중복 판별법

단일 열 기준 검사만으로는 동명이인을 잘못된 중복으로 오판하거나, 가족 구성원이 동일한 주소를 사용하는 경우를 온전히 걸러내기 어렵습니다. 예컨대 동명이인인 '홍길동'이 서로 다른 전화번호를 가지고 있다면 이는 개별 고객으로 분류되어야 합니다. 이처럼 두 개 이상의 열이 모두 일치해야만 참으로 인정되는 다중 조건 검출에는 두 가지 실무적 접근법이 주로 쓰입니다.
첫 번째는 COUNTIFS 함수를 활용하여 각 열의 조건을 동시에 충족하는 행을 계산하는 방식입니다. `=COUNTIFS($A$2:$A$500, A2, $B$2:$B$500, B2)` 형태로 수식을 구성하면 이름(A열)과 연락처(B열)가 동시에 겹치는 건수만 정확히 추출됩니다. 두 번째는 원본 데이터 좌측이나 우측에 보조열을 추가한 뒤 `=$A2&"_"&$B2` 형태로 문자열을 병합해 고유 키(Key)를 생성하고, 이 보조열을 기준으로 단일 조건부 서식이나 COUNTIF를 적용하는 방법입니다. 보조열 병합 방식은 수식 구조가 단순하여 대규모 데이터셋에서도 연산 속도가 상대적으로 안정적이라는 장점이 있습니다.
공백과 보이지 않는 서식 오류로 인한 매칭 실패 해결
수식이나 조건부 서식을 정확히 설정했음에도 불구하고 명백히 중복된 텍스트가 인식되지 않거나, 반대로 전혀 다른 데이터가 겹치는 것으로 처리되는 주된 원인은 텍스트 끝자락에 숨겨진 보이지 않는 공백 때문입니다. 웹 설문지나 전사적 자원관리(ERP) 시스템에서 데이터를 내보내는 과정에서 글자 뒤에 공백(스페이스바)이 포함되면, 육안으로는 '서울지사'로 동일해 보여도 엑셀 엔진은 '서울지사'와 '서울지사 '를 완전히 다른 문자열로 취급합니다.
이러한 오류를 원천 차단하기 위해서는 본격적인 중복 검증 전 텍스트 정제 작업이 필수적입니다. TRIM 함수는 단어 사이의 단일 공백을 제외한 앞뒤의 불필요한 모든 여백을 제거해 줍니다. 또한 영문 데이터의 경우 대소문자 일치 여부에 따라 기본 COUNTIF가 대소문자를 구분하지 못한다는 점도 유의해야 합니다. 대소문자까지 엄격하게 일치하는 완전 일치 중복을 찾아야 한다면 EXACT 함수를 결합한 배열 수식을 활용하거나 추가적인 데이터 클렌징 단계를 거쳐야 합니다.
데이터 탭의 '중복된 항목 제거' 기능과 안전한 실행 절차

분석 목적이 아니라 불필요한 중복 행을 파일에서 완전히 덜어내는 것이 최종 목표라면 상단 [데이터] 탭의 [데이터 도구] 그룹에 있는 [중복된 항목 제거] 기능이 가장 빠릅니다. 이 기능은 사용자가 지정한 특정 열들의 조합을 바탕으로 중복을 판정하며, 중복이 발견될 경우 목록에서 가장 위쪽에 위치한 행만 남기고 나머지 아래쪽 행들을 즉시 시트에서 영구 삭제합니다.
편리한 기능이지만, 실행 즉시 셀이 물리적으로 지워지기 때문에 실행 전 안전장치를 마련하는 것이 필수적입니다. 실수로 열 선택을 잘못하거나 의도치 않은 행이 삭제되었을 때 데이터 복구가 불가능해지는 사고를 방지하기 위해 정형화된 작업 절차를 준수해야 합니다.
- 사전 백업: 작업 대상 워크시트를 우클릭하여 '이동/복사' 메뉴를 통해 동일 통합 문서 내에 복사본 시트를 먼저 생성합니다.
- 데이터 범위 전체 선택: 헤더(머리글)를 포함한 표 전체 영역을 명확히 선택한 상태에서 기능을 실행합니다.
- 기준 열 지정: '내 데이터에 머리글 표시'를 체크한 뒤, 중복 판단의 기준이 되는 핵심 식별 열(예: 사번, 주민번호 대체 고유번호, 이메일 등)만 체크박스에 남깁니다.
- 결과 알림창 확인: 삭제 실행 후 나타나는 팝업창에서 '제거된 중복 값의 수'와 '유지된 고유한 값의 수'가 업무 예상 수치와 부합하는지 즉시 검토합니다.
피벗 테이블과 고급 필터를 연계한 대용량 데이터 요약 관리
데이터가 수만 행에서 수십만 행 단위로 방대해지면 복잡한 수식 계산이나 조건부 서식은 파일 용량을 급증시키고 통합 문서의 처리 속도를 급격히 떨어뜨립니다. 시스템 성능 저하 없이 고유 항목의 발생 빈도를 체계적으로 검토하고 싶다면 피벗 테이블을 활용하는 방식이 가장 안정적인 대안입니다.
검토할 데이터 범위를 피벗 테이블로 변환한 후, 중복을 검사할 필드를 [행] 영역과 [값] 영역에 동시에 배치합니다. 이때 값 필드의 요약 기준을 기본 '합계'에서 '개수'로 변경하면 각 항목별 등장 빈도가 내림차순 정렬 가능한 형태로 일목요연하게 집계됩니다. 개수가 2 이상인 항목만 필터링하여 확인하면 원본 데이터를 전혀 손상시키지 않고도 이상 징후나 중복 빈도를 거시적으로 파악할 수 있으며, 특정 항목을 더블클릭하여 해당 데이터로만 구성된 별도 세부 시트를 즉시 생성해 원인을 역추적할 수도 있습니다.
엑셀 중복값 처리 방식별 특성 및 실무 적합도 비교 (환경별 상대 지표)
| 구분 및 처리 방식 | 주요 장점 | 실무 시 주의점 | 권장 데이터 규모 |
|---|---|---|---|
| 조건부 서식 (셀 강조) | 별도 수식 없이 클릭 몇 번으로 즉각적인 시각적 식별 가능 | 수만 행 이상 적용 시 통합 문서의 스크롤 및 연산 속도 저하 가능 | 소규모 ~ 중간 규모 (수천 행 이내) |
| COUNTIF 누적 수식 | 최초 입력값과 재입력값을 명확히 분리하여 순번 매김 가능 | 행 수가 방대할 경우 재계산 부하가 발생하므로 완료 후 값 복사 권장 | 중간 규모 ~ 대규모 (수만 행) |
| 데이터 중복 제거 도구 | 단 한 번의 실행으로 불필요한 중복 행을 일괄 정리 | 실행 즉시 원본 행이 영구 삭제되므로 사전 백업 필수 | 소규모부터 초대규모까지 전 영역 |
| 피벗 테이블 요약 | 수식 부하 없이 고유 항목별 발생 빈도를 안전하게 집계 | 원본 행을 직접 삭제하는 것이 아니라 요약 보고서 형태로 추출됨 | 대규모 및 정기 집계 보고서 |
※ 표의 수치·조건은 이해를 돕기 위한 예시이며, 실제 내용은 기관·상품별로 다를 수 있습니다.
실행 전 체크리스트
- 작업 전 원본 통합 문서나 해당 워크시트의 복사본(백업 시트)을 생성했는지 확인합니다.
- TRIM 함수를 적용하여 텍스트 앞뒤에 보이지 않는 공백이 포함되어 있지 않은지 점검합니다.
- 중복 판단의 기준이 단일 열인지, 복수 열(예: 이름+전화번호)인지 기준을 명확히 정의합니다.
- 단순 확인 후 원본 유지가 필요한지, 아니면 완전 삭제가 목적인지 작업 방향을 결정합니다.
- 수만 행 이상의 대용량 파일인 경우 조건부 서식 남발 대신 피벗 테이블이나 보조열 수식을 활용하는지 점검합니다.
- 중복 항목 제거 실행 전 보존해야 할 기준(최신순/과거순)에 맞게 정렬을 선행했는지 확인합니다.
자주 묻는 질문
텍스트의 대소문자를 구분하여 중복값을 찾으려면 어떤 수식을 써야 하나요?
기본 제공되는 COUNTIF 함수는 영문 대소문자를 구분하지 않고 동일한 값으로 인식합니다. 대소문자까지 완전히 일치하는 중복만 찾으려면 대소문자를 엄격히 구별하는 EXACT 함수를 SUMPRODUCT 함수와 함께 조합해야 합니다. 예를 들어 A열 데이터에서 대소문자 일치 중복을 세려면 `=SUMPRODUCT(--EXACT($A$2:$A$100, A2))` 형태로 작성하며, 이 결과가 2 이상인 경우 대소문자까지 똑같은 중복 데이터로 판정할 수 있습니다.
조건부 서식으로 빨간색으로 칠해진 중복 행만 따로 복사하거나 모아서 보려면 어떻게 하나요?
조건부 서식을 적용한 데이터 머리글에 자동 필터(단축키 Ctrl + Shift + L)를 활성화합니다. 이후 검사한 열의 필터 드롭다운 버튼을 클릭하고 [색 기준 필터] 항목으로 이동하여 조건부 서식에 적용된 셀 채우기 색상(예: 연한 빨강)을 선택하면, 색상이 적용된 중복 행만 화면에 추출됩니다. 이 상태에서 행 전체를 선택하여 다른 시트로 복사해 붙여넣으면 중복 항목만 별도로 격리하여 보관할 수 있습니다.
'중복된 항목 제거' 기능을 사용했을 때 남겨지는 기준은 무엇이며 아래쪽 데이터를 남길 수도 있나요?
엑셀의 기본 '중복된 항목 제거' 도구는 위에서 아래로 순차 검색하여 가장 먼저 만나는 '최상단 행'만을 무조건 보존하고 이후에 나타나는 모든 행을 삭제하도록 기본 설계되어 있습니다. 만약 최신 등록일자나 특정 기준에 따라 가장 아래쪽에 있는 데이터를 남기고 싶다면, 중복 제거 도구를 실행하기 전에 해당 날짜나 일련번호 열을 기준으로 '내림차순 정렬'을 먼저 수행하여 보존하고자 하는 최신 데이터를 표의 가장 위쪽으로 끌어올린 뒤 제거 기능을 실행해야 합니다.
엑셀에서 중복값을 통제하는 역량은 데이터 기반 업무의 정확도를 결정짓는 기초 체력과 같습니다. 단순 조회 목적의 조건부 서식부터 누적 COUNTIF를 통한 이력 관리, 대용량 분석을 위한 피벗 테이블까지 작업 목적과 데이터 규모에 부합하는 적절한 도구를 선별하여 활용해 보시기 바랍니다. 사소해 보이는 공백 제거와 작업 전 백업 습관을 들이는 것만으로도 데이터 손실 사고 없이 안정적인 업무 성과를 거둘 수 있습니다.




