전체 도구 ↗

단어 빈도 분석

텍스트를 붙여넣으면 가장 많이 쓴 단어를 순위로 보여드려요.

상위 20개 순위대·소문자 통합기기 안에서 처리

0자 · 입력한 내용은 기기 안에서만 계산돼요.

예시 미리보기

텍스트를 넣고 단어 빈도 분석하기를 누르면 여기 순위가 채워져요.

광고

설명

텍스트에서 단어별 출현 횟수를 세어 상위 20개를 순위로 보여줍니다.

광고

관련 도구

긴 문서나 리포트에서 어떤 단어가 얼마나 자주 등장하는지 파악하고 싶을 때 직접 세는 것은 비효율적입니다. 이 도구는 텍스트를 붙여 넣으면 단어별 출현 횟수를 자동으로 집계하고 빈도 순으로 정렬해 보여줍니다. 키워드 분석, 문서 품질 검토, 설문 응답 텍스트 분석 등 다양한 목적으로 활용할 수 있습니다.

사용 방법

분석할 텍스트를 입력란에 붙여 넣거나 직접 입력한 다음 '단어 빈도 분석하기' 버튼을 누릅니다. 결과는 순위·단어·등장 횟수를 한 줄에 묶어 많이 나온 순서대로 상위 20개까지 보여줍니다. 조사·접속사처럼 의미 없이 자주 등장하는 단어도 그대로 집계되므로, 핵심어를 볼 때는 상위에 오른 조사·접속어 아래 순위부터 살펴보는 것이 좋습니다. 분석 결과는 전체 복사하거나 CSV 파일로 내려받을 수 있어 스프레드시트에서 추가 작업하기 편합니다.

이럴 때 유용해요

블로그 글이나 마케팅 카피를 작성한 뒤 특정 키워드가 의도한 만큼 반복되는지 확인할 때 유용합니다. 고객 상담 내용이나 설문 주관식 응답을 모아 분석하면 자주 언급되는 불만·요청 키워드를 빠르게 파악할 수 있습니다. 학술 논문이나 보고서를 작성할 때 특정 용어가 너무 반복적으로 쓰이지 않는지 점검하는 용도로도 쓸 수 있고, 계약서·정책 문서에서 핵심 조건이 몇 번 등장하는지 확인하는 데도 활용됩니다.

알아두면 좋은 점

한국어 텍스트는 '먹다·먹고·먹어서'처럼 같은 어근이 다양한 형태로 변형되기 때문에, 형태소 분석 없이는 '먹다'와 '먹고'가 별개 단어로 집계됩니다. 이 도구는 공백과 문장부호를 기준으로 단어를 분리하는 방식이므로, 더 정교한 분석이 필요하다면 KoNLPy 같은 형태소 분석기를 별도로 사용하는 것이 좋습니다. 반면 영문 텍스트는 공백 분리만으로도 단어 단위가 명확히 구분되어 분석 정확도가 높습니다. 문서 분량이 클수록 상위 빈도 단어와 하위 단어의 격차가 뚜렷해져 핵심 주제를 파악하기 쉬워집니다.

자주 묻는 질문

대·소문자는 구분해서 집계하나요?
대·소문자를 구분하지 않고 합산합니다. 'Apple'과 'apple'은 같은 단어로 처리됩니다. 대·소문자를 나눠 따로 세는 설정은 제공하지 않습니다.
분석할 수 있는 텍스트 길이에 제한이 있나요?
브라우저 메모리 범위 안에서 처리하므로 수만 자 이상의 긴 문서도 대부분 처리됩니다. 다만 수십만 자 이상의 매우 큰 파일은 결과가 느리게 나올 수 있습니다.
특수문자나 숫자도 단어로 집계되나요?
특수문자와 기호는 단어 구분자로만 쓰여 집계에서 빠집니다. 반면 숫자는 하나의 단어로 함께 집계되므로 '2026'처럼 홀로 떨어진 숫자는 결과에 그대로 나타납니다.
텍스트 내용이 서버에 저장되나요?
아닙니다. 모든 분석은 브라우저 안에서만 실행되며, 입력한 텍스트는 외부 서버로 전송되지 않습니다. 기밀 문서나 개인정보가 포함된 텍스트를 분석해도 외부로 유출되지 않습니다.
결과를 엑셀 파일로 저장할 수 있나요?
CSV 형식으로 내보내기가 가능합니다. 다운로드한 파일을 엑셀이나 구글 스프레드시트에서 열면 바로 확인 및 추가 가공이 가능합니다.

개인정보처리방침

단어 빈도 분석이란

입력한 텍스트를 공백과 문장부호 기준으로 잘라 낱말 하나하나를 세고, 많이 나온 순서대로 순위를 매겨 보여주는 도구입니다. 긴 글에서 어떤 단어가 중심을 이루는지 눈으로 훑기 어려울 때, 출현 횟수라는 객관적 숫자로 핵심어를 바로 드러냅니다. 블로그 초안의 키워드 밀도 점검, 회의록에서 반복되는 주제어 파악, 설문 주관식 답변의 공통 관심사 추출 같은 상황에서 쓰입니다.

작동 원리

계산은 세 단계로 진행됩니다. 첫째, 텍스트를 공백·줄바꿈·쉼표·마침표 등으로 토큰(낱말 단위)으로 분리합니다. 둘째, 각 토큰을 소문자로 통일해 대소문자 차이를 없애고 같은 단어로 묶습니다. 셋째, 단어별 등장 횟수를 세어 내림차순으로 정렬합니다. 예를 들어 "봄 여름 봄 가을 봄"을 넣으면 봄 3회, 여름 1회, 가을 1회로 집계됩니다. 순수하게 문자열이 일치하는 개수만 세므로, 의미가 비슷한 단어("자동차"와 "차")는 서로 다른 항목으로 잡힙니다.

한국어는 조사가 붙는다는 특성 때문에 "학교가", "학교를", "학교는"이 각각 별개 단어로 카운트됩니다. 형태소 분석 없이 표면 문자열 기준으로 세기 때문에 나타나는 결과이며, 조사까지 포함한 실제 표기 빈도를 그대로 보여준다는 점을 감안해 읽어야 합니다.

활용 상황과 팁

글을 쓴 뒤 특정 표현을 무의식적으로 반복하지 않았는지 점검할 때 효과적입니다. "그리고", "정말", "사실" 같은 군더더기가 상위에 올라오면 문장을 다듬을 신호입니다. SEO 목적이라면 노리는 핵심어가 최상위권에 있는지 확인하고, 너무 낮으면 본문에 자연스럽게 보강합니다.

상황활용법
글쓰기 퇴고반복 상투어 상위 노출 여부 확인
키워드 점검목표 단어의 순위·횟수 확인
설문 정리주관식 답변의 공통 관심사 추출

팁: 조사 때문에 같은 명사가 여러 줄로 흩어져 보일 때는, 결과에서 어근이 같은 항목들의 횟수를 머릿속으로 합산해 판단하세요. 또 "은/는/이/가/을/를" 같은 조사와 흔한 접속어는 대개 최상위를 차지하므로, 실제 핵심어는 그 아래 순위부터 보는 것이 요령입니다.

자주 묻는 질문

"학교"와 "학교가"를 하나로 세지 않는 이유는?

이 도구는 형태소 분석이 아니라 표면 문자열이 정확히 일치하는지로 세기 때문입니다. 조사가 붙으면 다른 문자열이 되어 별개 항목으로 잡힙니다. 필요하면 결과에서 같은 어근 항목의 횟수를 합쳐 해석하세요.

대문자와 소문자를 구분하나요?

구분하지 않습니다. Apple과 apple을 같은 단어로 묶어 합산합니다. 영문 텍스트에서 문장 첫 글자 때문에 같은 단어가 둘로 나뉘는 것을 막기 위한 처리입니다.

숫자나 특수문자도 세나요?

공백·문장부호로 분리한 뒤 남는 토큰은 숫자여도 하나의 단어로 셉니다. "2026"처럼 홀로 떨어진 숫자는 집계에 포함되며, 단어 사이의 쉼표·마침표는 구분자로만 쓰이고 카운트되지 않습니다.

입력한 텍스트가 서버로 전송되나요?

단어 분리와 집계는 브라우저 안에서 처리되는 방식이라 텍스트가 외부로 저장·전송되지 않습니다. 초안이나 미공개 원고를 붙여 넣어도 그 내용은 화면 계산에만 쓰입니다.