단어 빈도 분석기 — 글에서 많이 쓴 단어·키워드 밀도 확인
글에서 자주 쓴 단어와 키워드 밀도를 표로 확인하기
브라우저에서 처리 · 서버로 전송되지 않음
분석 방식
한글 단어 끝의 흔한 조사(은·는·이·가·을·를·에서·으로 등) 하나를 떼요. 형태소 분석이 아니라 목록 비교라서 틀릴 수 있어요. 남는 부분이 2음절 이상일 때만 떼므로 "사과"는 그대로지만, "고양이"는 "고양"으로 잘려요.
1~50. 이보다 짧은 단어는 세지 않아요.
줄바꿈이나 쉼표로 나눠요. 기본 제외 목록은 없고, 여기에 적은 단어만 빠져요.
표시 개수
단어 32개 중 서로 다른 단어 25개
상위 20개 / 전체 25개 표시
| 순위 | 단어 | 횟수 | 비율(%) |
|---|---|---|---|
| 1 | 커피 | 5 | 15.63 |
| 2 | 원두 | 4 | 12.5 |
| 3 | 하루 | 1 | 3.13 |
| 4 | 시작하 | 1 | 3.13 |
| 5 | 음료예요 | 1 | 3.13 |
| 6 | 아침마다 | 1 | 3.13 |
| 7 | 마시 | 1 | 3.13 |
| 8 | 사람 | 1 | 3.13 |
| 9 | 많아요 | 1 | 3.13 |
| 10 | 산지 | 1 | 3.13 |
| 11 | 따라 | 1 | 3.13 |
| 12 | 맛이 | 1 | 3.13 |
| 13 | 달라요 | 1 | 3.13 |
| 14 | 좋은 | 1 | 3.13 |
| 15 | 내린 | 1 | 3.13 |
| 16 | 향이 | 1 | 3.13 |
| 17 | 깊어요 | 1 | 3.13 |
| 18 | 고를 | 1 | 3.13 |
| 19 | 때는 | 1 | 3.13 |
| 20 | 로스팅 | 1 | 3.13 |
비율 = 그 항목의 횟수 ÷ 센 항목 전체 수 × 100. 제외할 단어, 숫자, 최소 글자 수로 빠진 항목은 분모에도 들어가지 않아요.
소개
블로그 글이나 보고서, 자기소개서를 쓰다 보면 같은 단어를 생각보다 자주 쓰게 돼요. 단어 빈도 분석기는 글을 붙여 넣는 즉시 어떤 단어가 몇 번 나왔는지, 전체에서 몇 %를 차지하는지 표로 보여 줘요. 많이 쓴 순서대로 정렬되니 반복이 심한 표현을 찾거나 글의 중심 주제가 잘 드러나는지 확인할 때 쓸 수 있어요.
분석 방식은 세 가지예요. ’단어’는 띄어쓰기와 문장부호를 기준으로 나눈 낱말을, ’글자’는 한 글자씩을 셉니다. ’키워드 밀도(SEO)’는 직접 적은 목표 키워드가 글에 몇 번 나오고 전체 단어 중 얼마를 차지하는지 계산해요. 결과 표는 탭으로 구분된 텍스트(TSV)로 복사해서 스프레드시트에 바로 붙여 넣을 수 있어요.
사용법
- 분석할 글을 입력 칸에 붙여 넣어요. 예시 글이 들어 있어서 처음부터 결과를 볼 수 있어요.
- 분석 방식을 단어, 글자, 키워드 밀도 중에서 고릅니다.
- 필요하면 대소문자 구분, 숫자 포함, 조사 떼기, 최소 글자 수 같은 옵션을 바꿔요.
- 빼고 싶은 단어가 있으면 ‘제외할 단어’ 칸에 적어요.
- 표시 개수(10, 20, 50, 전체)를 고르고, ’표 복사’로 결과를 가져가요.
기준
- 단어 나누기: 브라우저의 Intl.Segmenter(단어 단위)를 써서 글자나 숫자로 된 조각만 단어로 봐요. 이모지와 문장부호는 세지 않아요. 한국어는 대체로 띄어 쓴 덩어리가 한 단어가 되고, 중국어처럼 띄어쓰기가 없는 글은 브라우저가 가진 사전에 따라 나뉘어요. 입력은 먼저 NFC로 정규화해서 맥에서 복사한 한글도 똑같이 셉니다.
- 대소문자: 기본값은 구분하지 않고 모두 소문자로 바꿔 셉니다.
- 숫자: ’숫자 포함’을 끄면 숫자와 마침표·쉼표로만 된 단어(2026, 3.14 등)를 뺍니다.
- 최소 글자 수: 1부터 50 사이 정수예요. 조사를 뗀 뒤의 글자 수로 판단하고, 이모지가 섞인 글자도 눈에 보이는 한 글자를 1로 셉니다.
- 제외할 단어: 줄바꿈이나 쉼표로 나눈 단어를 정확히 일치할 때만 빼요. 조사 떼기를 켜면 떼기 전 모양과 뗀 뒤 모양 중 하나라도 맞으면 빠집니다.
- 조사 떼기(추정): 한글로만 된 단어가 에서·에게·으로·까지·부터·처럼·보다·하고·이나·이랑·은·는·이·가·을·를·의·에·로·와·과·도·만·나·랑 중 하나로 끝나면, 그중 가장 긴 조사를 한 번만 떼요. 남는 부분이 2음절 이상일 때만 떼고 아니면 그대로 둡니다. 한국어 페이지에서는 켜진 채로 시작해요.
- 글자 모드: 화면에 보이는 한 글자 단위로 셉니다. 띄어쓰기와 줄바꿈은 항상 빼고, 문장부호는 기본으로 빼요. 이모지와 기호는 셉니다.
- 비율: 그 항목의 횟수 ÷ 센 항목 전체 수 × 100이에요. 화면에는 소수 둘째 자리까지 보여 줘요. 횟수가 같으면 글에 먼저 나온 항목이 위에 와요.
- 키워드 밀도: 등장 횟수 × 키워드의 단어 수 ÷ 글 전체 단어 수 × 100이에요. 여러 단어로 된 키워드는 단어가 연달아 나올 때만 한 번으로 세고, 겹치는 부분은 두 번 세지 않아요. 전체 단어 수에는 제외할 단어나 최소 글자 수, 숫자 옵션이 적용되지 않아요.
- 입력 한도: 글은 200,000자, 제외할 단어 칸은 20,000자, 목표 키워드는 50개까지예요.
예시
예시 글(커피와 원두에 관한 여섯 문장, 조사 떼기 켬)의 결과예요.
| 단어 | 횟수 | 비율 |
|---|---|---|
| 커피 | 5 | 15.63% |
| 원두 | 4 | 12.5% |
| 하루 | 1 | 3.13% |
조사 떼기가 단어를 어떻게 바꾸는지 보여 주는 예예요.
| 원래 단어 | 결과 | 설명 |
|---|---|---|
| 학교에서 | 학교 | ’에서’를 떼고 2음절이 남음 |
| 사과 | 사과 | ’과’를 떼면 1음절이라 그대로 |
| 집으로 | 집으로 | ’으로’를 떼면 1음절이라 그대로 |
| 고양이 | 고양 | 잘못 자른 경우 |
참고할 점
키워드 밀도 모드에서 ’커피 원두’처럼 두 단어로 된 키워드는 글에서도 두 단어가 붙어 나와야 셉니다. ’커피 원두를’처럼 조사가 붙은 경우는 조사 떼기를 켜야 잡혀요. 조사 떼기는 편의 기능일 뿐이니 중요한 분석에서는 결과 표를 한 번 훑어보고 잘못 잘린 단어가 없는지 확인하세요.
자주 묻는 질문
조사 떼기는 얼마나 정확한가요?
형태소 분석기가 아니라 흔한 조사 목록과 단어 끝을 비교하는 방식이라 틀릴 때가 있어요. '고양이'는 끝의 '이'를 조사로 보고 '고양'으로 자르고, '시작하는'처럼 활용된 말도 '시작하'로 잘릴 수 있어요. 결과가 이상하면 옵션을 끄고 원래 단어 그대로 세어 보세요.
기본으로 빠지는 불용어가 있나요?
없어요. '그리고', 'the'처럼 흔한 단어도 그대로 셉니다. 빼고 싶은 단어는 '제외할 단어' 칸에 줄바꿈이나 쉼표로 나눠 적으세요. 적은 단어만 빠지고, 빠진 단어는 비율의 분모에서도 빠져요.
키워드 밀도는 몇 %가 좋나요?
정해진 정답은 없어요. 이 도구는 글 안에서 키워드가 차지하는 비율을 계산해 보여 줄 뿐이에요. 같은 말을 억지로 반복하기보다 읽는 사람에게 자연스러운지를 먼저 보고, 숫자는 너무 많이 반복했는지 점검하는 참고로 쓰세요.
영어 대문자와 소문자는 같은 단어로 세나요?
기본값은 같은 단어로 세요. 'Apple'과 'apple'을 합쳐 소문자 'apple'로 보여 줘요. '영문 대소문자 구분 안 함'을 끄면 둘을 따로 셉니다.
글이 서버로 전송되나요?
아니요. 단어 나누기와 계산은 모두 브라우저 안에서 이루어지고 입력한 글은 저장하거나 보내지 않아요.