AI 초안 89편의 목록 127개, 항목 547개 중 절반은 마침표 없는 명사로 끝났고 소제목 바로 뒤에 온 목록은 1개였다

AI 초안 89편의 목록 127개, 항목 547개 중 절반은 마침표 없는 명사로 끝났고 소제목 바로 뒤에 온 목록은 1개였다

AI 초안에서 목록은 표 다음으로 손이 많이 가는 자리입니다. 항목이 문장인지 낱말인지, 마침표를 찍는지 안 찍는지가 글마다 다르고 한 목록 안에서도 다릅니다. 두 사이트의 글 89편에서 목록 127개, 항목 547개를 뽑아 셌습니다. 항목 547개 중 275개(50.3%)는 마침표 없이 명사로 끝났고, 198개(36.2%)는 ‘습니다’로 끝났으며, 28개는 ‘~다.’로 끝났습니다. 끝맺음이 섞인 목록은 127개 중 11개였습니다. 목록이 소제목 바로 뒤에 온 경우는 127개 중 1개뿐이고, 나머지 126개는 문단 뒤에 왔습니다. 항목 수는 넷이 가장 많았고 셋에서 다섯 사이가 73.2%입니다.

글 89편의 목록 127개

제목과 표를 뺀 본문에서 ulol을 셌습니다. 사이트별로는 워드프레스·서버 글 40편에 목록 79개, AI 글쓰기 글 49편에 48개입니다. 서버 글은 절차와 확인 항목이 많아 목록이 두 배 가까이 됩니다.

항목
목록 수 127 (순서 없음 98, 순서 있음 29)
중첩 목록 0
항목 수 547
글당 목록 평균 1.43, 중앙값 1, 최대 7
목록이 없는 글 17편 (19.1%)
목록당 항목 평균 4.31, 중앙값 4, 최대 10
항목 길이 평균 34자, 중앙값 28자, 최소 2자, 최대 160자
본문 글자 중 목록 비중 14,716자 / 311,610자 (4.7%)
목록 항목 547개의 끝맺음 막대그래프. 한글 명사 275개, 습니다·입니다 198개, ~다. 28개, 영문·숫자 23개, 그 밖 마침표 11개, 명사형·기타 12개
항목 끝은 명사와 습니다가 반씩이고, 한 목록 안에서 섞인 것은 11개입니다.

목록당 항목 수는 3개 27, 4개 35, 5개 31, 6개 17개로, 셋에서 다섯 사이가 93개(73.2%)입니다. 2개짜리는 10개, 1개짜리는 1개, 7개 이상은 6개입니다. 사람이 쓴 글에서 흔한 열 개 넘는 긴 목록은 하나도 없고, 반대로 항목 하나짜리 목록도 하나뿐입니다. 글당 목록은 1개가 42편으로 가장 많고, 7개인 글이 2편 있는데 둘 다 초기의 서버 글입니다.

항목 끝은 명사 275개, ‘습니다’ 198개

항목 끝 개수 비율
한글 명사, 마침표 없음 275 50.3% 페이지 캐시
‘습니다·입니다’ 198 36.2% …요청마다 크론이 새로 뜹니다.
‘~다.’ (평서형) 28 5.1% …확인한다.
영문·숫자 끝 23 4.2% oEmbed API
그 밖 마침표 11 2.0%
명사형(기·것·함) 7 1.3%
기타 5 0.9%

명사로 끝나는 항목과 ‘습니다’로 끝나는 항목이 반씩입니다. 둘 다 틀린 것은 아니고, 문제는 한 목록 안에서 섞이는 경우입니다. 목록 127개 중 116개는 항목 끝이 한 종류로 통일돼 있었고 11개는 섞여 있었습니다. 섞인 11개는 모두 초기 글 62편에서 나왔고, 최근 27편에서는 0개입니다. ‘~다.’로 끝나는 28개도 모두 초기 글에서 나왔습니다. 본문은 ‘습니다’인데 목록만 ‘한다.’로 끝나는 것으로, 초안에서 목록을 메모처럼 쓰는 습관입니다.

초기 글과 최근 글의 차이

글 번호 131 이전 62편과 그 뒤 27편을 나눠 봤습니다. 뒤쪽 27편은 실측 글로 바꾼 뒤의 것입니다.

구분 초기 62편 최근 27편
목록 수 96 31
항목 수 415 132
명사 끝 259 (62.4%) 23 (17.4%)
‘습니다’ 끝 100 (24.1%) 98 (74.2%)
‘~다.’ 끝 28 0
끝맺음이 섞인 목록 11 0
항목 길이 중앙값 24자 57자

초기 글의 항목은 24자짜리 명사구가 기본이고, 최근 글의 항목은 57자짜리 문장이 기본입니다. 최근 글은 목록이 ‘정한 것’, ‘측정 방법 요약’, ‘고칠 때의 기준’처럼 결론이나 절차를 적는 자리에 오고, 항목 하나가 결론 문장이라 길어졌습니다. 초기 글은 ‘확인할 항목’, ‘원인 후보’처럼 낱말을 나열하는 목록이 많았습니다. 어느 쪽이 낫다기보다 용도가 달라진 것인데, 최근 글에서 항목이 100자를 넘는 것이 나오기 시작했습니다. 100자를 넘는 항목은 전체 16개이고, 160자짜리는 ‘이름: 설명’ 꼴로 확인 절차 전체를 한 항목에 넣은 것입니다.

소제목 바로 뒤에 온 목록은 1개

목록 127개 앞에 무엇이 있는지 봤습니다. 소제목 바로 뒤에 목록이 온 것은 1개이고, 126개는 문단 뒤에 왔습니다. 소제목을 달고 곧바로 항목을 나열하는 형태는 초안에 거의 없고, 반드시 설명 문단을 하나 두고 목록을 붙입니다. 목록이 놓인 자리를 소제목 순서로 보면 첫 소제목 안이 9개, 마지막 소제목 안이 13개, 중간이 105개입니다. 마지막 13개는 ‘측정 방법 요약’, ‘배포 전 확인 항목’처럼 절차나 확인 항목을 적는 자리였습니다.

목록 앞에 온 것 개수
문단 126
소제목 1

항목 안을 보면 두 문장 이상인 항목이 83개(15.2%)이고, 항목 첫머리를 굵게 쓴 것이 48개, ‘이름: 설명’ 꼴이 62개, 코드가 든 항목이 54개입니다. 항목 첫 어절은 ‘댓글’ 10, ‘워드프레스’ 8, ‘특정’ 8, ‘로그인’ 8 순으로, 본문 문장의 첫 어절에서 위를 차지했던 ‘이’와 ‘다만’은 목록에서는 상위에 없습니다. 목록 항목은 접속 부사 없이 바로 명사로 시작합니다.

표와 목록의 자리

표 129개를 셌을 때 표는 열 셋, 행 다섯에 몰려 있었습니다. 목록은 항목 넷에 몰려 있습니다. 항목 셋에서 다섯 사이가 73%이니, 초안이 목록을 만들 때 넷을 기준으로 하나를 빼거나 더한다고 봐도 됩니다. 실제 내용이 항목 일곱 개여도 다섯으로 줄이고, 둘이어도 셋으로 늘리는 쪽으로 기울 가능성이 있는데, 이번 측정만으로는 원래 몇 개였어야 하는지 알 수 없어서 판단은 미룹니다.

정한 것

  1. 목록 항목의 끝은 한 목록 안에서 한 종류로 맞춥니다. 문장이면 모두 ‘습니다’로, 낱말이면 모두 마침표 없이 끝냅니다.
  2. ‘~다.’로 끝나는 항목은 본문과 어긋나므로 ‘습니다’로 고칩니다.
  3. 항목이 두 문장을 넘으면 목록이 아니라 문단으로 풀어 씁니다. 100자를 넘는 항목은 검수 대상입니다.
  4. 항목 수는 내용을 따릅니다. 넷에 맞추려고 빼거나 더한 흔적이 있으면 되돌립니다.
  5. 소제목 바로 뒤에 목록을 두지 않는 지금 방식은 그대로 둡니다. 설명 문단 없이 목록만 있는 절은 만들지 않습니다.

측정 방법

두 사이트의 공개 글 89편 본문에서 <ul><ol>을 찾고 그 안의 <li>를 항목으로 셌습니다. 항목 텍스트는 태그를 벗기고 앞뒤 공백을 지운 것이고, 길이는 글자 수입니다. 항목 끝은 ‘니다’로 끝나면 ‘습니다·입니다’, 그 밖에 ‘다.’로 끝나면 평서형, 마침표 없이 한글로 끝나면 명사, 영문이나 숫자·괄호·퍼센트로 끝나면 영문·숫자로 나눴습니다. 처음에는 ‘습니다’와 ‘입니다’만 잡아서 ‘뜹니다’, ‘봅니다’ 같은 ㅂ니다 꼴이 평서형으로 잘못 세어졌고, ‘니다’로 고쳐 다시 셌습니다. 목록 앞에 온 것은 목록 태그 바로 앞의 HTML이 제목 닫는 태그인지로 판정했습니다. 초기와 최근의 경계는 글 번호 131로, 두 사이트가 같은 번호 체계를 쓰기 때문에 시점으로 나눈 것과 같습니다. 본문 글자 수는 코드 블록을 뺀 텍스트에서 공백을 지운 값입니다.

Similar Posts

답글 남기기

이메일 주소는 공개되지 않습니다. 필수 필드는 *로 표시됩니다