AI가 지은 제목 69개, 25자 이하가 하나도 없었다

AI가 지은 제목 69개, 25자 이하가 하나도 없었다

AI에게 글을 맡기면 제목까지 함께 나옵니다. 그런데 그 제목들을 모아 놓고 보면 이상하게 닮았습니다. 무엇이 닮았는지 감으로는 잡히지 않아서, AI가 초안을 만든 글 69편의 제목을 글자 수준에서 세어 봤습니다. 길이 분포와 문장 부호, 반복되는 표현까지 전부입니다. 가장 뚜렷한 것은 짧은 제목이 한 개도 없다는 점이었습니다.

25자 이하가 0개

먼저 길이입니다. 제목 69개의 글자 수를 세어 구간으로 나눴습니다.

길이 개수 비중
24자 이하 0개 0%
25~32자 1개 1.4%
33~40자 20개 29.0%
41~48자 28개 40.6%
49자 이상 20개 29.0%

평균 44.1자, 중앙값 44자입니다. 그리고 24자 이하가 단 하나도 없습니다. 가장 짧은 것이 32자였습니다.

사람이 지은 제목 묶음에서는 이런 분포가 잘 나오지 않습니다. 짧게 끝내는 것이 있고 길게 늘어놓는 것이 섞입니다. 여기서는 하한선이 잘린 것처럼 32자에서 멈춥니다.

왜 짧아지지 못하는가

이유는 제목이 만들어지는 방식에 있습니다. AI에게 제목을 맡기면 글의 내용을 최대한 담으려고 합니다. 무엇을 다루는지, 어떤 상황인지, 무엇을 얻는지를 모두 넣습니다. 그러면 자연히 40자를 넘깁니다.

짧은 제목은 반대로 무엇을 뺄지 정하는 작업입니다. 뺀 부분은 본문을 읽어야 알 수 있게 남겨 둡니다. 이 판단에는 ‘이 정도는 안 써도 통한다’는 감각이 필요한데, 정보를 빠뜨리지 않으려는 쪽으로 학습된 모델은 그 감각을 발휘하기 어렵습니다.

결과적으로 목록 화면에서 모든 제목이 비슷한 폭으로 두 줄씩 차지합니다. 한 줄로 끝나는 제목이 하나도 없으니 시선이 걸릴 곳이 없습니다.

문장 부호가 대신 일한다

길이가 길어지면 어딘가에서 끊어야 합니다. 그래서 부호가 등장합니다. 어떤 부호가 얼마나 쓰였는지 세어 봤습니다.

형태 개수 비중
숫자 포함 30개 43.5%
쉼표 포함 18개 26.1%
‘이유’ 포함 17개 24.6%
콜론 포함 13개 18.8%
‘확인할’ 포함 9개 13.0%
‘하는 방법’ 포함 7개 10.1%
물음형 어미 0개 0%

쉼표와 콜론을 합치면 44.9%입니다. 제목 둘 중 하나가 부호로 두 도막이 되어 있습니다.

쉼표가 있는 18개를 앞뒤로 갈라 재보니 앞부분 평균 23.0자, 뒷부분 평균 19.8자였습니다. 거의 반반입니다. 이것도 우연이 아닙니다. ‘주제, 그에 대한 설명’ 구조가 반복되면 두 도막의 길이가 비슷해집니다.

물음표가 하나도 없다

다른 방향에서도 눈에 띄는 것이 있었습니다. 물음형이나 제안형으로 끝나는 제목이 0개였습니다. 전부 명사나 서술형으로 닫힙니다.

‘~해도 될까’, ‘~인가’ 같은 마무리는 읽는 사람에게 판단을 넘깁니다. 그런데 이런 형태는 글이 답을 확실히 준다고 약속하지 않는 것처럼 보이기도 합니다. 정보를 빠짐없이 담으려는 방향과 어긋나기 때문에 잘 선택되지 않습니다.

문제는 69개가 전부 같은 방식으로 닫힌다는 점입니다. 변화가 없으면 어떤 제목도 눈에 띄지 않습니다.

화면에 실제로 나가는 길이는 더 길다

지금까지 센 것은 제목 자체입니다. 그런데 브라우저 탭과 검색 결과에 나가는 값은 여기에 사이트 이름이 붙습니다. 실제로 출력되는 형태로 다시 재봤습니다.

기준 초과하는 제목 비중
40자 초과 66개 95.7%
45자 초과 53개 76.8%
50자 초과 34개 49.3%
55자 초과 18개 26.1%
60자 초과 6개 8.7%

사이트 이름까지 합치면 평균 51자, 가장 긴 것은 71자였습니다. 제목만 셌을 때의 44자와는 7자 차이입니다.

이 차이가 중요한 이유가 있습니다. 목록이나 탭에서 잘려 나가는 것은 뒤쪽인데, 사이트 이름이 붙는 자리도 뒤쪽입니다. 제목이 길수록 사이트 이름이 먼저 사라집니다. 반대로 제목이 짧으면 사이트 이름까지 함께 보입니다.

앞쪽 20자에 무엇을 두었는가

그래서 실질적인 기준은 전체 길이보다 앞쪽에 무엇이 오는가입니다. 쉼표가 있는 제목은 앞부분이 평균 23자였으니, 첫 도막이 거의 그대로 보이는 셈입니다.

여기서 앞 도막이 ‘무엇에 대한 글인지’를 담고 있으면 뒤가 잘려도 통합니다. 반대로 앞 도막이 배경 설명이고 핵심이 쉼표 뒤에 있으면, 잘린 상태에서는 무슨 글인지 알 수 없습니다. 길이를 줄이는 것만큼 순서를 바꾸는 것이 효과가 큽니다.

제목과 도입 문단이 얼마나 겹치는가

한 가지를 더 재봤습니다. 제목에 쓴 낱말이 첫 문단에 다시 나오는 비율입니다. 검색 결과에서 제목 바로 아래에 오는 것이 이 문단이기 때문에, 둘이 겹치면 같은 말을 두 번 보여주게 됩니다.

제목 어절 690개 중 265개(38.4%)가 도입 문단에 다시 나왔습니다. 그리고 제목 어절의 60% 이상이 반복된 글이 8편이었습니다.

38%는 자연스러운 수준입니다. 같은 주제를 다루니 주요 낱말이 겹치는 것은 당연합니다. 문제는 8편 쪽입니다. 이런 글은 검색 결과에서 제목과 설명이 거의 같은 문장으로 보입니다.

고치는 방법은 도입 문단을 바꾸는 것입니다. 제목이 이미 ‘무엇’을 말했다면, 첫 문단은 ‘왜 그것이 문제인가’로 시작하는 편이 낫습니다. 같은 낱말을 다시 늘어놓는 대신 새 정보를 넣는 것입니다.

고칠 때의 기준

모든 제목을 짧게 바꿀 필요는 없습니다. 긴 제목이 맞는 글도 있습니다. 다만 묶음 전체가 한쪽에 몰려 있다면 몇 개만 다르게 만들어도 달라집니다.

  1. 가장 긴 다섯 개를 먼저 봅니다. 이 글들에서는 53자에서 63자였습니다. 이 구간은 목록에서 잘려 나가기도 합니다.
  2. 그중 쉼표 뒤가 앞을 설명만 하고 있는 것을 지웁니다. 지워도 뜻이 통하면 원래 없어도 되는 부분입니다.
  3. 한두 개는 일부러 25자 아래로 줄입니다. 목록에서 한 줄로 끝나는 제목이 하나만 있어도 시선이 그리로 갑니다.
  4. 닫는 방식을 하나만 바꿔 봅니다. 전부 서술형이라면 하나쯤 질문형이어도 됩니다.

순서에 이유가 있습니다. 긴 것부터 손대면 길이 분포가 가장 빨리 흩어집니다. 짧은 것을 늘리는 방향은 효과가 없습니다. 이미 하한선이 잘려 있기 때문입니다.

직접 세어 보는 방법

도구가 없어도 확인할 수 있습니다. 자기 글 목록을 열고 제목 열 개의 글자 수만 세어 보면 됩니다.

세어 본 결과 판단
25자 이하가 하나도 없다 위에서 본 것과 같은 상태
절반 이상에 쉼표나 콜론이 있다 두 도막 구조가 굳어졌다
길이가 30자에서 60자까지 흩어져 있다 손댈 필요 없다

열 개면 충분합니다. 제목은 문단이나 문장과 달리 수가 적어서 눈으로도 금방 판정됩니다.

정리하면

AI가 지은 제목의 문제는 어색한 표현이 아니었습니다. 69개를 세어 보니 평균 44자에 24자 이하가 0개, 절반 가까이가 부호로 두 도막이었습니다. 개별 제목은 멀쩡한데 묶어 놓으면 구별되지 않는 이유가 여기에 있습니다.

그래서 제목을 다듬을 때는 하나씩 고치는 것보다 목록 전체를 놓고 길이가 얼마나 흩어져 있는지 보는 편이 빠릅니다. 한 줄짜리 제목 하나를 만드는 것이, 긴 제목 열 개를 조금씩 손보는 것보다 눈에 띄는 변화를 만듭니다.

Similar Posts

답글 남기기

이메일 주소는 공개되지 않습니다. 필수 필드는 *로 표시됩니다