"성인 평균 읽기 속도는 250WPM"이라는 문장을 어디선가 보셨을 겁니다. 그 수치는 영어 기준이고, 한국어에 그대로 대면 맞지 않습니다. 숫자가 달라서가 아니라 세는 단위 자체가 다르기 때문입니다. 이 글은 그 차이를 정리한 것입니다.
한국어에서 '단어'를 세기 어려운 이유
영어는 띄어쓰기가 곧 단어 경계입니다. I read a book은 누가 세도 4단어입니다. 한국어는 그렇지 않습니다. 조사와 어미가 앞말에 붙어서 한 덩어리를 이룹니다.
띄어쓰기 기준으로는 3덩어리입니다.
문법 단위(형태소)로 쪼개면 나 / 는 / 책 / 을 / 읽 / 었 / 다 — 7개입니다.
영어 I read a book과 견주면 4에 가깝습니다.
같은 문장을 놓고 3, 4, 7 세 가지 답이 나옵니다. 어느 것도 틀리지 않습니다. 다만 무엇을 세기로 했는지 말하지 않으면 그 숫자는 아무 뜻이 없습니다. 한국어 읽기 속도를 다룬 자료들이 서로 크게 어긋나 보이는 이유의 상당 부분이 여기에 있습니다.
이 서비스가 어절을 택한 이유
어절은 띄어쓰기로 나뉘는 덩어리 하나입니다. 위 문장은 3어절입니다. 형태소 분석보다 거칠지만, 읽기 속도를 재는 목적에는 이쪽이 낫다고 판단했습니다. 이유는 세 가지입니다.
- 눈이 실제로 멈추는 단위에 가깝습니다. 읽을 때 눈은 글자 하나하나를 훑지 않고 덩어리 단위로 건너뜁니다. "책을"을 '책'과 '을'로 나눠 두 번 멈추는 사람은 없습니다. 형태소 7개는 문법의 단위이지 시선의 단위가 아닙니다.
- 누가 세도 같은 값이 나옵니다. 형태소 분석은 도구와 기준에 따라 결과가 갈립니다. 어절은 공백으로 나누면 끝이라 재현됩니다. 같은 글을 다시 재도 같은 수가 나와야 속도 변화를 추세로 볼 수 있습니다.
- 글마다 흔들림이 적습니다. 형태소 수는 문체에 크게 좌우됩니다. 조사를 생략한 구어체와 꽉 찬 문어체가 전혀 다르게 나옵니다. 어절은 그 진폭이 작습니다.
그래서 이 서비스의 WPM은 정확히 말하면 어절/분(語節每分)입니다. 화면에 WPM이라고 적은 것은 널리 쓰이는 표기를 따른 것뿐입니다.
영어 수치와 비교할 때
한국어 어절과 영어 word는 대체로 어절 쪽이 담는 정보가 더 많습니다. "읽었다" 한 어절에 동사·시제·종결이 다 들어 있는데, 영어로 옮기면 have read처럼 여러 단어가 됩니다.
그래서 같은 내용을 읽을 때 한국어 어절 수가 영어 word 수보다 적게 나오는 것이 보통입니다. 뒤집어 말하면, 한국어 250어절/분과 영어 250WPM은 같은 속도가 아닙니다. 한국어 쪽이 더 많은 내용을 읽은 것입니다.
같은 사람이 같은 날 재도 달라지는 것들
단위를 맞춰도 수치는 흔들립니다. 어절 기준에서 특히 크게 작용하는 요인이 있습니다.
- 한자어의 밀도. "그 결과로 인하여 발생한"과 "그래서 생긴"은 담는 뜻이 비슷해도 어절 수가 다릅니다. 한자어가 많은 글은 어절당 정보가 많아 같은 WPM이라도 훨씬 힘듭니다.
- 대화가 섞인 비율. 따옴표로 오가는 대화는 한 어절이 짧고 예측이 쉬워 같은 사람이 읽어도 수치가 올라갑니다. 소설로 재면 설명문보다 빠르게 나오는 것이 정상입니다.
- 띄어쓰기의 상태. 원문의 띄어쓰기가 지금 규범과 다르면 어절 수가 달라집니다. 옛 표기를 그대로 실은 글에서 특히 그렇습니다.
그래서 속도를 비교할 때는 글의 종류를 맞추는 것이 먼저입니다. 지난달에 소설로 재고 이번 달에 논설문으로 재면, 그 차이는 실력 변화가 아니라 글의 차이입니다.
정리
- 한국어는 조사·어미가 붙어서 '단어'의 경계가 하나로 정해지지 않습니다.
- 이 서비스는 띄어쓰기 덩어리(어절)를 셉니다. 재현되고, 시선의 단위에 가깝기 때문입니다.
- 영어권 WPM과 직접 비교하지 마세요. 어절 쪽이 담는 정보가 더 많습니다.
- 자기 기록끼리 비교하되, 글의 종류를 맞춰서 비교하세요.