단어의 경계는 누가 정하나
영어 워드프로세서의 단어 수는 대체로 공백으로 나뉜 덩어리의 개수입니다. ‘It's a well-known fact.’는 공백으로 나뉜 덩어리가 4개이므로 4단어입니다. 하이픈으로 이은 ‘well-known’은 하나로 셉니다. 이 방식은 단순하고 예측 가능해서 영어 과제·논문 분량 기준으로 널리 쓰입니다.
한국어: 어절 단위
한국어도 띄어쓰기가 있으므로 같은 방식으로 세면 어절 수가 나옵니다. ‘나는 학교에 갑니다’는 3어절입니다. 언어학적으로는 ‘나/는/학교/에/가/ㅂ니다’처럼 형태소로 더 잘게 나눌 수 있지만, 일상적인 단어 수 세기에서는 어절을 한 단어로 봅니다. 이 도구도 어절 단위로 셉니다.
그래서 한국어 글의 단어 수는 같은 내용의 영어 글보다 적게 나오는 편입니다. 조사와 어미가 앞말에 붙어 한 어절을 이루기 때문입니다. 한국어 글의 분량을 말할 때 단어 수보다 글자수를 주로 쓰는 이유도 여기에 있습니다.
일본어와 중국어: 띄어쓰기가 없다
일본어와 중국어는 문장 안에서 띄어 쓰지 않습니다. 공백으로 세면 한 문장 전체가 1단어가 되어 버립니다. 그래서 이 도구는 한자·가나가 섞인 덩어리를 브라우저에 내장된 국제화 분석기(Intl.Segmenter)로 단어 단위로 나눕니다. 이 분석기는 사전을 바탕으로 ‘東京/に/行き/ます’처럼 단어 경계를 추정합니다.
다만 어디까지를 한 단어로 볼지는 사전과 분석기마다 다릅니다. 같은 문장도 도구에 따라 단어 수가 다르게 나오므로, 일본어·중국어 분량은 보통 글자수로 정합니다. 일본의 원고용지나 중국의 원고 분량도 글자 기준입니다.
숫자와 기호
이 도구는 글자나 숫자가 하나라도 들어 있는 덩어리만 단어로 셉니다. ‘2026년’은 1단어, 홀로 떨어진 ‘—’나 ‘·’는 단어가 아닙니다. 단어 빈도에서는 앞뒤의 문장부호를 떼고 소문자로 바꿔 모읍니다. ‘Text,’와 ‘text’는 같은 단어로 집계됩니다.
도구마다 단어 수가 다른 이유 정리
- 하이픈·아포스트로피로 이은 말을 하나로 볼지 둘로 볼지
- 숫자만 있는 덩어리를 단어로 칠지
- 띄어쓰기 없는 언어를 어떤 사전으로 나눌지
- 줄 끝 하이픈으로 끊긴 단어를 이어 볼지
분량 기준이 단어 수로 정해진 제출물이라면, 제출처가 안내한 프로그램(예: 특정 워드프로세서)으로 마지막 확인을 하는 것이 가장 확실합니다.
기준일: 2026-09-23