한 달 동안 AI 탐지기를 사용해 보았습니다. 동료, 데이트 상대, 그리고 제가 동경하던 영웅들에게서 확인한 결과는 저를 경악하게 했습니다.
최근 들어 저는 "이걸 AI가 쓴 걸까?"라는 질문을 끊임없이 던지게 됩니다. 온라인에서 시간을 좀 보내는 분이라면 아마 여러분도 마찬가지일 겁니다. 챗GPT(ChatGPT)가 등장한 지 불과 몇 년 만에 인터넷은 봇(bot)이 생성한 저급 콘텐츠로 뒤덮인 황무지가 되어버렸습니다. 전문가들은 '저급 콘텐츠의 대홍수(slopocalypse)'가 닥칠 것이라고 경고했는데, 그 예언은 현실이 되었습니다.
세상은 이를 그저 수수방관하고 있지만은 않습니다. 출판사들은 도서 출판 계약을 취소하고 있고, 억만장자나 교수, 정치인들이 쓴 칼럼이 AI 작성물임이 드러나 망신을 당하기도 합니다. 논란이 거세지자 기업들도 부랴부랴 대응책을 내놓고 있습니다. 링크드인(LinkedIn)은 사용자들에게 의심스러운 게시물을 신고하도록 독려하고, 서브스택(Substack)은 AI가 작성한 것으로 의심되는 글에 별도의 표식을 달고 있습니다. 구글은 사용자가 접하는 이미지나 동영상이 AI로 생성된 것인지 확인할 수 있는 도구를 개발 중이며, 앤스로픽(Anthropic)은 자사의 AI 모델인 '클로드(Claude)'가 생성한 텍스트에 워터마크를 삽입하기 시작했습니다. 하지만 이러한 조치들은 또 다른 반발을 불러일으켰습니다. AI 작성물을 식별하고 배제하려는 시도가 시대착오적이고 징벌적이며 명예를 훼손하는 행위라고 주장하는 사람들이 있기 때문입니다.
이제 우리는 글쓰기의 어느 정도를 AI에게 맡길지 결정해야 하는 상황에 놓여 있습니다. 어쩌면 모든 글을 AI가 쓰게 해야 한다고 생각할 수도 있고, 반대로 절대 AI를 써서는 안 된다고 생각할 수도 있겠죠. 하지만 아마도 여러분은 저와 비슷하게 그 양극단 사이 어딘가에서 표류하고 있을 겁니다. AI가 어디에나 존재한다는 사실에 불안감을 느끼면서도, 한편으로는 그 도움을 받고 싶어 하는 그런 상태 말입니다. 우리 각자는 나름의 기준선을 긋고 또 수정해 왔으며, 그 과정에서 타인의 기준과 충돌하고 때로는 격렬한 분노를 느끼기도 합니다.
공통된 규범을 마련할 희망을 품으려면, 우리는 더 근본적인 질문에 답해야 합니다. 애초에 어떤 결과물이 인간의 머리에서 나왔는지, 아니면 AI가 만들어냈는지가 우리에게 왜 그토록 중요한 문제일까요? 과거에는 사람이 만들었지만 지금은 기계가 만드는 수많은 것들—직물, 가구, 혹은 가게에서 충동적으로 집어 든 초콜릿 칩 쿠키 상자 같은 것들—에 대해서는 우리는 별다른 의문을 갖지 않습니다. 그렇다면 글쓰기—나아가 그림 그리기, 작곡, 영상 제작 같은 창작 활동—는 도대체 무엇이 다르다는 걸까요? 결과물만 훌륭하다면 누가 신경이나 쓰겠습니까?
저는 신경이 쓰였습니다. 그렇지 않다면, 마치 봇(bot)의 지문을 채취하려는 광적인 탐정처럼 마주치는 모든 의심스러운 문구를 왜 그렇게 눈을 가늘게 뜨고 뚫어지라 쳐다봤겠는가?
그래서 나는 AI 탐지 도구를 사용해 보기로 했다. 기계가 작성한 글을 식별하는 데 있어 대부분의 사람이 실제로는 서툴다는 연구 결과가 잇따르고 있는 반면, 시장을 선도하는 AI 탐지 도구인 '팡그램(Pangram)'은 99.7%의 정확도를 자랑한다. 몇 주 동안 내가 접하는 모든 문장이 과연 누가, 혹은 무엇이 쓴 것인지 명확히 확인하다 보면, 왜 이 구분이 우리에게 그토록 중요한지 조금은 더 잘 이해할 수 있을 것이라 생각했다.
나는 링크드인(LinkedIn)에서 조사를 시작했다. 세계에서 가장 뻔뻔한 기업인들이 모여드는 이곳이야말로 AI가 작성한 글의 공세를 정면으로 마주할 가능성이 가장 높은 곳이라고 판단했기 때문이다. 팡그램의 크롬 확장 프로그램을 설치하자 뉴스피드의 모든 게시물과 댓글에 라벨이 표시되었다. 'AI'라고 적힌 로봇 머리 모양의 빨간색 직사각형(AI가 80% 이상 작성), 'Human(사람)'이라고 적힌 사람 머리 모양의 녹색 직사각형(사람이 90% 이상 작성), 그리고 'Mixed(혼합)'라고 적힌 로봇 머리 모양의 노란색 직사각형이 그것이었다. 뉴스피드를 넘겨볼 때마다 나는 마치 사바나의 사자가 먹잇감을 찾듯 로봇 머리 아이콘을 찾아 눈을 번뜩였다.
내가 아는 한 창업자인 피터 팡(Peter Pang)은 지난 1년 넘게 사람이 직접 쓴 글을 단 하나도 올리지 않은 듯했다. 에이전트형 AI 플랫폼인 '크레아오 AI(Creao AI)'의 공동 창업자인 그의 게시물은 AI 특유의 말투로 가득 차 있었다(예를 들면 이런 식이다. "AI는 단순히 엔지니어의 작업 속도를 높여주는 데 그치지 않습니다. 엔지니어링이란 과연 무엇인지 근본적으로 다시 생각하게 만듭니다"). 3천 명이 넘는 팔로워에게 글을 쏟아내기 전, 그는 과연 자신의 AI 에이전트가 초안을 작성한 내용을 한 번이라도 확인했을까?
마치 누가 보톡스 시술을 받았는지 알아볼 수 있는 새로운 초능력을 얻은 것만 같은 기분이었다.
그에게 직접 물어보니, 그는 AI 에이전트가 준비한 내용을 검토하고 수정한다고 답했다. "지금 이 답변을 포함해서 말이죠." (참고로 팡그램은 그가 내게 보낸 이메일조차 100% AI가 작성한 것으로 판별했다.) 그는 AI 에이전트에게 몇 가지 아이디어나 개요를 제공하고, 그러면 에이전트가 관련 자료를 조사해 그가 읽어볼 수 있는 초안을 작성해 줍니다. "최종적인 글에는 제 견해가 담겨 있습니다." 그가 말했습니다. "그리고 실제로 '게시' 버튼을 누르는 건 바로 저죠."
제 인맥 중에는 AI를 가끔씩만 사용하는 사람들도 있었습니다. 저는 마음속으로 그들의 명단을 꼽아보았습니다. 유명 경제학자, 몇몇 언론인, 그리고 수많은 마케팅 종사자들이었죠. 마치 누가 보톡스 시술을 받았는지 알아볼 수 있는 새로운 초능력을 갖게 된 기분이었습니다.
그들을 그렇게 비판적인 시선으로 바라보는 게 과연 옳은 일이었을까요? 한편으로는, 링크드인 게시물을 작성하는 데 '클로드(Claude)'를 활용하는 것이 링크드인에 글을 올리는 행위 자체보다 훨씬 더 나쁜 일은 아닐지도 모릅니다. AI가 등장하기 전부터 이미 그곳은 견디기 힘든 '겸손을 가장한 자랑(humblebrag)'이나, 배우자의 암 투병 이야기를 통해 사이버 보안 소프트웨어를 더 잘 파는 영업사원이 되는 법을 설파하는 식의 민망한 고백들로 넘쳐났으니까요. 애초에 링크드인에서 진정성을 기대하고 들어가는 사람은 없으니까요. 어쩌면 '팡그램(Pangram)'이 분석한 링크드인의 장문 게시물 중 40% 이상에서 사람들이 개인 브랜딩을 위해 AI를 활용하고 있었다는 사실이, 그리 대수로운 일은 아니었을지도 모릅니다.
하지만 해당 게시물들은 작성자로 표시된 인물의 이름 및 프로필 사진과 함께 게시되고 있었습니다. 한 게시물에서 스타트업 창업자인 팡(Pang)은 자신의 이전 직장에서 막 해고된 사람들에게 위로를 건넸습니다. "해고는 고통스럽고 혼란스러우며, 인간적인 차원에서 볼 때 매우 부당한 일입니다." 게시물에는 이런 내용이 담겨 있었습니다. "만약 해고의 대상이 되셨다면, 이것이 여러분의 가치나 앞으로 이뤄낼 성취를 반영하는 것이 아님을 알아주셨으면 합니다." 전 직장 동료들이 분명 고마워했을 따뜻한 위로의 말이었습니다. 하지만 팡그램(Pangram)의 분석에 따르면, 그 글을 직접 쓴 사람은 그가 아니었습니다. 팡그램은 해당 게시물을 100% AI가 작성한 것으로 분류했으니까요. 그렇다면 그 글에서 그가 진심으로 의도한 부분은 얼마나 되고, 단순히 공허한 말에 불과했던 부분은 얼마나 될까요? ("저는 그 글의 내용에 변함없는 확신을 가지고 있습니다." 그가 제게 말했습니다. "그 안에 담긴 생각은 제 것이니까요.")
다음으로 저는 제 업무용 이메일로 시선을 돌렸습니다. 기자라는 직업 특성상 홍보 담당자들로부터 수많은 제안과 보도자료를 받는데, 며칠 동안 이 자료들을 팡그램으로 확인해 보았습니다. 그중 절반 정도가 팡그램에 의해 AI 생성 텍스트로 분류된 내용을 상당 부분 포함하고 있었는데, 이는 링크드인 게시물보다 훨씬 높은 비율이었습니다.