AUTHOR’S ORIGINAL · 원문 작성 · ARCHIVE 224398646170

인터넷의 3분의 1이 AI의 글이라고? 우리가 몰랐던 웹의 '기계적' 민낯

필자 Econ Blog_K의 공개 원문을 허락받아 자동 수집했습니다. 문장과 이미지 순서를 보존하고 지면 폭만 조정했습니다.

이야기하는 사람노해인 · 진행 / 차우진 · 분석

글자
날짜판으로
원문 수록 이미지
원문 AI 제작 표시 보존

1. 당신이 오늘 읽은 글은 정말 '사람'이 쓴 것일까?

2022년 11월, OpenAI가 ChatGPT를 세상에 처음 공개했을 때만 해도 우리는 이 기술이 웹의 풍경을 얼마나 빠르게 뒤바꿀지 다 알지 못했습니다. 하지만 불과 몇 년 만에 변화는 압도적인 현실이 되었습니다. 최근 통계에 따르면 미국 성인의 약 절반이 인공지능(AI) 기반의 챗봇을 사용해 본 경험이 있으며, 그중 24%는 거의 매일 AI와 대화하며 정보를 주고받습니다.

이러한 도구들이 인간과 구별하기 힘든 정교한 문장을 쏟아내기 시작하면서, 우리는 이제 아주 근본적인 의구심을 던져야 하는 시점에 도달했습니다. "내가 지금 화면을 통해 읽고 있는 이 정보는 정말 누군가의 사유를 거쳐 나온 글일까, 아니면 알고리즘이 조합한 결과물일까?" 오늘날 우리가 접하는 온라인 정보의 출처는 그 어느 때보다 불투명해졌고, 웹은 거대한 기계적 실험장으로 변모하고 있습니다.

2. 통계의 충격: 새롭게 생성되는 웹 페이지의 3분의 1은 AI의 작품

최근의 심층 분석 데이터는 우리의 막연한 추측을 서늘한 수치로 증명합니다. 2026년 7월 기준으로 영어권 웹 페이지의 약 10%가 AI에 의해 작성되었거나 실질적으로 편집된 징후를 보이고 있습니다. 10%라는 수치가 언뜻 적어 보일 수 있지만, 여기에는 생성형 AI가 탄생하기 전 수십 년 동안 축적된 '과거의 기록'들이 포함되어 있다는 사실을 기억해야 합니다.

진정한 데이터의 충격은 생성형 AI가 본격적으로 보급된 이후에 게시된 '최신' 콘텐츠들에서 발견됩니다.

"ChatGPT 출시 이후 게시된 페이지의 3분의 1 이상에서 AI 저작 징후가 발견되었습니다."

우리가 현재 인터넷에서 느끼는 평온함은 어쩌면 AI가 존재하지 않던 시절의 유산(Old pages) 덕분에 유지되는 착시일지도 모릅니다. 실상은 이미 정보 생산의 주도권이 기계로 넘어가고 있으며, 새로운 웹 생태계의 성장은 더 이상 인간이 아닌 알고리즘에 의해 주도되고 있다는 뜻이기도 합니다.

3. 영역의 차이: .com은 AI의 놀이터, .gov는 인류의 보루

흥미로운 점은 이러한 AI의 침투가 웹의 모든 영역에서 균일하게 일어나지 않는다는 것입니다. 도메인의 성격과 정보의 목적에 따라 AI 저작물의 비중은 극명한 대조를 이룹니다. 특히 수익 창출과 정보의 양이 중요한 상업적 영역에서의 확산세가 두드러집니다.

.com: 약 9.4% (가장 높은 침투율)

.org: 약 4.6%

.edu: 약 1.0%

.gov: 약 0.8%

상업 도메인인 .com과 공공·교육 영역인 .gov 사이에는 무려 10배가 넘는 격차가 존재합니다. 이는 정확성과 신뢰성이 생명인 정부 및 교육 기관에서는 여전히 인간의 엄격한 검토가 최후의 보루 역할을 하고 있는 반면, 생산 속도와 노출량이 중요한 상업적 영역에서는 AI가 이미 인간 필자를 대체하는 주요 동력으로 자리 잡았음을 시사합니다.

그렇다면 이처럼 영역을 가리지 않고 소리 없이 웹을 점령 중인 AI의 글을, 우리는 과연 어떻게 알아볼 수 있을까요?

원문 수록 이미지
원문 수록 이미지

4. 기계의 지문: AI가 자신도 모르게 남기는 '언어적 습관'

AI는 인간의 방대한 데이터를 학습하여 문장을 만들지만, 역설적이게도 그 과정에서 인간은 좀처럼 하지 않는 자신만의 독특한 '지문'을 남깁니다. AI 탐지 모델은 통계적으로 과도하게 나타나는 특정 언어적 패턴과 구두점 습관을 통해 이를 식별해 냅니다.

엠 대시(—)와 옥스퍼드 콤마: AI는 부연 설명을 위한 엠 대시를 인간보다 2배나 더 자주 사용합니다. 또한 목록의 마지막 항목 앞에 쉼표를 찍는 '옥스퍼드 콤마' 사용 빈도는 2023년 대비 63%나 급증했습니다.

AI 전용 어휘: AI 모델은 특정 단어를 유난히 선호하는 경향이 있습니다. delve, interplay, testament, bolstered, pivotal, tapestry, underscore, meticulous, vibrant 등과 같은 단어들은 AI 콘텐츠에서 그 사용 빈도가 2배 이상 폭증했습니다.

부정적 병렬 구조: "그것은 단지 X가 아니라, Y다(it's not just X, it's Y)"와 같은 대조적 문장 구조 역시 대표적인 지문입니다. 이 구조의 사용 사례는 최근 거의 3배 가까이 늘어났습니다.

이러한 현상은 AI가 학습 과정에서 특정 학술적 스타일이나 저널리즘적 톤을 과도하게 복제하면서 나타나는 부작용입니다. 결국 AI의 글쓰기는 겉보기에는 세련되어 보일지언정, 통계적 확률에 갇힌 기계적 습관에서 완전히 자유로울 수 없습니다.

5. '지능형' 웹 시대에 우리가 던져야 할 질문

이제 인터넷은 단순히 인간의 정보를 연결하는 망을 넘어, 알고리즘과 기계가 스스로 콘텐츠를 빚어내고 순환시키는 '지능형 생태계'로 완전히 변모했습니다. 우리가 매일 스크롤하는 화면 뒤에는 인간의 고뇌보다 기계의 프롬프트가 더 활발하게 움직이고 있습니다.

이러한 기계적 민낯을 마주한 지금, 우리에게는 새로운 철학적 과제가 주어졌습니다. 알고리즘이 쏟아내는 수조 개의 유려한 문장들 속에서 우리는 어떻게 '진실된 인간의 목소리'를 구별해 낼 수 있을까요? 그리고 '진짜'와 '가짜'의 경계가 무너진 이 생태계에서 우리는 무엇을 신뢰의 근거로 삼아야 할까요?

마지막으로 묻고 싶습니다. 당신이 방금 읽은 이 글조차, 100% 인간의 감각과 사유로만 쓰였다고 확신할 수 있습니까? 지능형 웹 시대를 살아가는 우리 모두가 매 순간 스스로에게 던져야 할 질문입니다.

Source: Samel Best vater et al., How Much of the Internet Is Written With AI? Pew Research Center Aug 20, 2026