가볍게 읽는 세계의 IT·AI 이야기

updated

문학상 후보에서 사라진 소설, AI 탐지기는 무엇을 증명했나

프낙 소설상 수상에서 공쿠르상 후보 제외까지 나흘. 탐지 점수, 과거 글의 유사성, 작가와 출판사의 입장, 문학상의 결정이 각각 답하는 질문을 분리해 읽습니다.

글자가 없는 펼친 책 위를 돋보기가 가로지르고, 책 가장자리에 빈 수상 리본이 놓인 개념 일러스트
글자가 없는 펼친 책 위를 돋보기가 가로지르고, 책 가장자리에 빈 수상 리본이 놓인 개념 일러스트

아이티 출신 작가 테리송 오렐리앙의 첫 장편 《C’était ça ou mourir》는 9월 21일 프낙 소설상을 받았다. 나흘 뒤에는 공쿠르상 1차 후보 명단에서 빠졌다. 프낙이 책을 고른 때와 공쿠르상이 후보에서 제외한 때 사이에 AI 사용 의혹과 과거 글의 유사성 문제가 잇따라 불거졌다. 프낙 수상 기록과 공쿠르 아카데미의 공식 성명은 각각 그 사실을 확인해 준다.

이야기를 더 어렵게 만드는 것은 공쿠르상이 내세운 이유다. AI가 소설 대부분을 썼을 가능성과 작가의 과거 글을 둘러싼 표절 문제를 함께 들었다. 그러자 자연스럽게 질문이 생긴다. AI 탐지기가 책을 읽고 높은 점수를 냈다면 작가가 직접 쓰지 않았다는 뜻일까? 과거의 다른 글에서 확인된 유사성이 이번 소설의 작성 방식까지 말해 줄까? 답을 서두르면 서로 다른 증거를 한데 섞게 된다. 이 사건은 AI 탐지기의 정확도에 관한 이야기인 동시에, 책을 만든 과정을 누가 어디까지 알 수 있는지에 관한 이야기다.

먼저, 어떤 책이었나

소설의 주인공 조나스 도를레옹은 아이티에서 폭력을 피해 떠난 역사 교사다. 도미니카공화국과 브라질, 멕시코를 거쳐 캐나다로 가려 한다. 잃어버릴 수 없는 몇 가지 물건을 들고 국경을 넘는 인물의 여정이 책의 중심에 놓여 있다. 이것은 프랑스 출판사 그라세의 작품 소개에 근거한 소설의 줄거리이지, 작가 본인의 이력을 그대로 옮긴 전기는 아니다. 작가가 아이티 출신이라는 사실과 주인공이 아이티를 떠난다는 설정을 겹쳐 읽을 수는 있어도, 둘을 같은 사람으로 취급할 근거는 없다.

책은 캐나다 출판사 보레알의 기록에 따르면 3월 9일 캐나다에서 먼저 나왔다. 프랑스판은 그라세 기록상 8월 19일 출간됐다. 두 출판사의 판본은 발행일과 쪽수가 다르다. 보레알판을 읽은 독자와 프랑스 서점에서 그라세판을 본 독자는 같은 작품을 접했지만, 책의 물리적 판본까지 동일하다고 단정할 필요는 없다. 이후 프낙 소설상 수상과 공쿠르상 후보 선정으로 관심이 커졌다. 그러므로 이번 논란은 출간 전 원고를 놓고 벌어진 예비 심사가 아니다. 이미 두 나라에서 출간되고 프낙 소설상을 받은 책에 뒤늦게 작성 방식에 대한 의혹이 붙은 사건이다.

바로 이 선후 관계가 중요하다. 독자가 이야기에 감동받았다는 사실은 제작 과정의 증거가 아니다. 반대로 제작 과정에 의문이 생겼다고 해서 읽은 경험이 없던 일이 되는 것도 아니다. 논란 이후 출판사가 책을 계속 판매하기로 한 결정, 공쿠르상이 후보에서 제외한 결정은 서로 다른 질문에 대한 답이다. 한쪽은 책의 존재와 유통을, 다른 쪽은 자기 상의 후보 자격을 판단했다.

소설에 붙은 첫 번째 의혹은 ‘탐지 결과’였다

9월 21일 온라인 계정 ‘Balance ton Claude’가 이 소설을 AI 탐지 도구 팽그램에 넣은 결과를 올렸다. 르몽드의 사건 취재와 가디언의 후속 취재가 확인한 출발점이다. 게시물은 의혹을 널리 알렸지만, 게시물 자체가 원고가 만들어진 과정을 기록한 것은 아니다. 같은 날 프낙 소설상 수상이 발표되면서 두 소식은 더욱 극적으로 부딪혔다.

이후 르몽드는 책의 절반이 넘는 부분을 팽그램에 직접 넣었다고 보도했다. 그 결과 도구가 분석한 텍스트의 95% 이상을 AI 작성으로 분류했고, 비교용으로 넣은 다른 최근 소설 약 15권의 앞부분은 사람의 글로 분류했다는 것이다. 르몽드의 검사 내용은 최초 온라인 게시물보다 확인 가능한 과정을 하나 더 보탠다. 그러나 다른 소설은 앞부분을, 문제의 책은 절반 이상을 넣은 비교다. 사용한 표본·길이가 같지 않았고, 무엇보다 어느 검사도 집필 현장을 관찰한 것은 아니다.

‘95%’를 읽을 때 특히 주의해야 한다. 작가가 AI를 사용했을 확률이 95%라는 뜻이 아니다. 책 전체의 95%가 AI로 작성됐다는 확정 판정도 아니다. 보도된 숫자는 르몽드가 입력한 텍스트를 도구가 어떻게 분류했는지 나타낸 결과다. 팽그램의 모델 설명서는 문서별 비율을 분석한 글자 가운데 각 유형으로 분류한 몫으로 설명하고, 국소적인 ‘높은 확신’ 표시도 현실의 참·거짓 확률로 보정한 수치가 아니라고 구분한다. 다만 르몽드가 사용한 도구 화면의 버전과 세부 점수 정의가 공개 설명서의 현행 모델과 정확히 같다고 확인된 것은 아니므로, 이번 검사 수치를 설명서의 특정 항목에 억지로 대입하지는 말아야 한다.

쉽게 말해 탐지기는 문장에 나타난 신호를 바탕으로 분류하는 기계다. 초고를 누가 언제 썼는지, 어느 문단에 사람이 손을 댔는지, 어떤 문장이 편집자와의 왕복 끝에 바뀌었는지는 그 결과만으로 볼 수 없다. 그렇다고 높은 점수가 아무 의미도 없다는 말도 아니다. 르몽드가 절반 넘는 본문에서 비슷한 결과를 얻은 것은 추가 확인이 필요한 구체적인 신호다. 신호와 결론 사이의 간격을 숨기지 않는 것이 이 사건의 첫 번째 원칙이다.

실제로 모든 AI 탐지기가 쓸모없다는 단정도 근거와 맞지 않는다. 2026년 학술 문서 160건을 대상으로 한 동료심사 연구는 네 탐지 도구를 진짜 작성 방식이 알려진 문서에 시험했고, 팽그램의 성능이 비교 도구들보다 강한 편이라고 보고했다. 연구자들은 동시에 도구의 판단을 단독 판정으로 삼지 말라고 경고한다. 그 실험은 영어 학술 문서와 특정 생성 모델을 다룬 것이다. 아이티·카리브해 언어 감각이 반영된 프랑스어 장편소설을 검증한 실험이 아니다. 팽그램의 자체 성능 자료도 프랑스어 평가 결과를 제시하지만, 회사가 고른 평가 자료에서 보인 성능을 이 한 권의 미확인 원고 이력에 곧장 옮길 수는 없다.

팽그램 공동창업자 맥스 스페로는 르몽드와의 별도 인터뷰에서 책 전체 PDF를 검사한 뒤 AI 사용을 확신한다고 말했다. 그는 프랑스어를 읽지는 못하지만 도구가 여러 쪽에서 강한 신호를 냈다는 점을 근거로 든다. 이 말은 결과를 개발자가 어떻게 해석하는지 알려준다. 동시에 그는 도구를 만든 회사의 공동창업자라서 독립 심사자와는 위치가 다르다. 르몽드가 책의 절반 이상을 넣어 얻은 ‘분석 텍스트의 95% 이상 분류’와 스페로가 전체 PDF 검사에 대해 말한 ‘95% 가능성’은 같은 사람의 같은 계산표를 독자에게 보여준 수치가 아니다. 두 표현을 합쳐 ‘책의 95%가 AI로 작성된 것이 95% 확률로 확정됐다’고 말하면, 증거를 두 번 부풀리는 셈이다. 자신감 있는 개발자의 평가도 초고 파일과 작성 기록을 대신하지는 못한다.

작가 오렐리앙은 AI 사용을 부인한다. 자신의 글에 아이티와 카리브해의 언어 리듬이 들어 있고, 이를 도구가 낯선 문체로 판단했을 가능성을 말한다. 그는 의혹에 인종적 요소가 있다고도 주장했다. 르몽드와 작가 인터뷰 보도, 가디언의 후속 취재에 나타난 당사자의 반박이다. 그가 그런 문제를 제기했다는 사실과 실제 탐지 결과의 원인이 무엇인지는 구분해야 한다. 점수가 정말 언어적 편향 때문인지, 다른 작성 과정 때문인지 확인하려면 동일한 조건의 원고 이력이나 추가 검증이 필요하다.

두 번째 의혹은 다른 글에서 나왔다

사건이 탐지기 사용법 논쟁으로만 끝나지 않은 이유는 작가의 과거 글이다. 2013년 필리핀 스타에 실린 글과 이후 오렐리앙 이름으로 올라온 글을 나란히 놓았을 때, 영웅을 기대하는 도입의 흐름과 타이거 우즈·랜스 암스트롱·오스카 피스토리우스를 이어 드는 배열이 매우 비슷하다는 보도가 나왔다. 필리핀 스타의 2013년 원문과 라프레스의 대조 취재가 근거다. 오렐리앙 쪽의 당시 개인 블로그 글은 현재 직접 열람에 제한이 있어, 이 대목은 원문 한쪽과 언론의 대조 취재를 함께 근거로 삼는다. 문장 몇 개를 이 글에서 번역해 맞붙여 재판정한 것처럼 꾸밀 이유는 없다.

TVA의 별도 취재는 이전의 다른 글에서도 유사성 문제를 다뤘다. 이 보도가 말하는 대상은 2026년 소설의 본문이 아니라 과거에 발표된 다른 글들이다. 독자 입장에서는 ‘작가가 이전에 글을 베꼈다면 이번에도 그랬을 것’이라고 이어 생각하기 쉽다. 하지만 이 사건의 두 의혹은 내용도 검사 방식도 다르다. 과거 글의 앞뒤 원문을 대조하는 일은 문장이 서로 얼마나 닮았는지를 보여줄 수 있다. 이번 소설에 AI가 쓰였는지는 그 대조로 알 수 없다. 앞의 의혹이 뒤의 의혹을 자동으로 증명하지 않는다는 점이 중요하다.

그렇다고 과거 글 문제를 이번 판단과 전혀 관계없는 흠집내기로 치울 수도 없다. 작품을 심사하는 기관은 글을 쓴 사람에 대한 신뢰와 상의 기준을 함께 고려할 수 있다. 공쿠르 아카데미는 실제로 9월 25일 성명에서 과거 표절 의혹이 드러난 점과, 자신들이 신뢰할 만하다고 보는 연구자·언론인의 여러 분석이 비슷한 방향을 가리킨다는 점을 나란히 들었다. 이것은 상이 왜 후보에서 뺐는지 설명하는 근거다. 한편 아카데미가 검토한 분석의 원자료와 방법을 모두 공개한 것은 아니다. 따라서 독자가 공식 성명의 결론을 독립적으로 같은 방식으로 재현할 수 있는 상황은 아니다.

서로 다른 자료, 서로 다른 대답

한 자료가 답할 수 있는 질문을 다른 질문의 결론으로 옮기지 않는다.

AI 탐지 결과

말해 주는 것: 입력한 문장을 도구가 어떻게 분류했는가.

말해 주지 못하는 것: 실제 집필 기록과 사용 범위.

과거 글의 원문 대조

말해 주는 것: 이전 글끼리 어떤 표현과 구성이 닮았는가.

말해 주지 못하는 것: 이번 소설의 AI 사용 여부.

출판사의 설명

말해 주는 것: 완성 원고를 받은 뒤 편집에 AI를 썼는가.

말해 주지 못하는 것: 원고 전달 이전의 모든 작업.

문학상의 결정

말해 주는 것: 아카데미가 책을 후보로 두지 않기로 했는가.

말해 주지 못하는 것: 저자성이 법적으로 확정됐는가.

그림: 이 사건의 자료는 모두 중요하지만 증명 범위가 다르다. 공쿠르상의 후보 제외는 확인된 결정이고, 실제 원고 작성 방식은 별도의 문제다.

출판사는 왜 ‘확인할 수 없다’고 했을까

출판사의 발언을 한 문장으로 줄이면 모순처럼 들린다. ‘AI를 쓰지 않았다’면서 ‘AI 의혹을 부인할 수 없다’는 식으로 보이기 때문이다. 그러나 보레알의 9월 24일 전달 공식 성명을 보면 두 말의 대상이 다르다. 보레알은 작가가 완성된 원고를 넘긴 뒤 출판사가 진행한 편집, 언어 교정, 교열 과정에서는 출판사가 AI를 사용하지 않았다고 밝혔다. 자신들의 작업을 설명한 것이다.

원고가 출판사에 오기 전 작가가 어떻게 썼는지에 대해서는 다른 입장을 냈다. 작가와 함께 이전 작업을 보여줄 자료를 모으려 했지만, 지금 단계에서는 의혹을 확인하거나 반박할 수 없다고 했다. 이것은 작가가 AI를 썼다는 인정도, 쓰지 않았다는 보증도 아니다. 출판사의 편집 파일에는 원고를 받은 뒤의 흔적이 남아도, 그 전 작업까지 저절로 저장되지는 않는다. 완성된 사진을 받은 편집자가 카메라 셔터를 누른 순간을 증언할 수 없는 것과 비슷하다. 다만 이 비유도 모든 원고가 동일한 방식으로 작성됐다는 뜻은 아니다. 지금 확인 가능한 경계가 어디인지를 말할 뿐이다.

보레알은 앞선 다른 글들의 표절 의혹을 우려한다고 밝혔고, 작가의 안녕을 고려해 홍보 일정을 잠시 멈췄다. 동시에 책은 계속 판매한다고 했다. 출판사 성명에서 이 선택들을 함께 읽어야 한다. ‘판매 중이니 의혹을 반박한 것’도 아니고 ‘홍보를 멈췄으니 유죄라고 본 것’도 아니다. 조사 가능한 범위와 현재 사업·편집상 결정을 분리한 모습에 가깝다. 출판사는 창작 과정이 작가에게 속하며 신뢰 관계를 감시 업무로 바꾸고 싶지 않다는 입장도 밝혔다. 그 원칙에 동의하든 하지 않든, 성명이 주장하는 범위를 정확히 읽는 것이 먼저다.

무엇이 더 밝혀지면 판단이 달라질까. 출판사가 받은 완성본보다 이른 시기의 초고와 수정 기록이 실제로 남아 있다면, 문장이 언제 생기고 바뀌었는지 더 세밀하게 살필 수 있다. 여러 날에 걸친 파일의 변화를 독립적으로 확인할 수 있다면 탐지기의 분류 결과를 해석할 맥락도 늘어난다. 그렇지만 그 자료 역시 누가 키보드를 쳤는지까지 자동으로 증명하지는 않는다. 반대로 그런 기록을 지금 공개하지 않았다는 이유만으로 AI 사용을 입증한 것도 아니다. 기록은 기기 교체, 저장 습관, 공동 작업 방식에 따라 남는 정도가 다르다. 이 사건에서 중요한 것은 증거 하나가 완벽한 답을 주기를 기다리는 일이 아니라, 각각의 자료가 가리키는 범위를 드러낸 채 서로 맞춰 보는 일이다. 9월 27일까지 공개 자료에서는 그 초기 원고 이력이 독립적으로 검증됐다고 확인되지 않는다.

여기에는 출판 현장 전체가 직면한 간격이 드러난다. 텍스트를 받아 맞춤법을 고치고 문장과 구조를 논의하는 출판사의 일은, 초고가 어떻게 시작됐는지 증명하는 일과 다르다. 그렇다면 출판사가 작품의 ‘사람이 쓴 정도’를 어디까지 보증할 수 있을까. 이번 사건은 그 질문을 실물 책 한 권 위에 올려놓았다. 보레알의 답은 원고를 받은 뒤의 자신들 작업에 관한 증언과, 그 이전은 아직 모른다는 선 긋기였다.

공쿠르상은 무엇을 결정했고 무엇을 결정하지 않았나

논란 초기에 공쿠르상 쪽에서는 신중해야 한다는 목소리가 나왔다. 회장 필리프 클로델의 발언을 전한 가디언 보도에 따르면 그는 섣부른 판단을 경계했다. 이후 과거 글의 유사성을 다룬 보도가 나오고, 9월 25일 아카데미는 정식으로 이 책을 1차 후보 명단에서 삭제했다. 시간 순서상 자료가 늘어난 뒤 결정이 나온 것은 맞다. 다만 내부 회의의 누가 어떤 자료에 얼마만큼 무게를 실었는지, 표결이 있었는지는 공개 성명만으로 알 수 없다. ‘어떤 보도가 결정을 뒤집었다’고 단정하기보다, 공개된 결정 이유를 읽어야 한다.

아카데미의 9월 25일 성명은 과거 글의 표절 문제와 여러 분석이 가리키는 AI 작성 가능성을 근거로 책을 첫 후보 명단에서 뺀다고 밝혔다. 프랑스어 표현은 이 작품이 매우 높은 개연성으로 AI의 산물이라는 취지다. 법원의 저자 판정이나 집필 로그 공개를 발표한 문장이 아니다. 아카데미는 사람의 문학을 기리는 상의 무결성을 지키려는 선택이라고 설명했다. 독자는 그 판단을 비판하거나 지지할 수 있다. 다만 결정의 정확한 종류는 ‘공쿠르상 1차 후보 제외’다. 이미 받은 프낙 소설상을 취소했다는 뜻이 아니고, 책의 판매를 금지했다는 뜻도 아니다.

문학상 심사는 본래 모든 의혹에 대해 법적 수준의 확정을 내리는 절차가 아니다. 기관은 자신이 수여할 상에 어떤 작품을 남길지 정한다. 이번 결정은 아카데미가 공개된 자료를 함께 보고 자기 상의 기준에 따라 위험을 감수하지 않겠다고 택한 것으로 읽힌다. 이 해석은 성명에 근거한 편집적 해석이지 아카데미 내부 심리의 기록이 아니다. 반대쪽에서는 원고 이력이 확인되지 않은 상태에서 후보를 지운 판단이 작가에게 과도한 불이익이라고 볼 수 있다. 특히 탐지 도구에 편향이 있을 수 있다는 문제 제기가 있는 상황에서, 심사기관이 자체 분석의 세부를 충분히 공개하지 않았다는 점은 비판의 근거가 된다.

반대로 아카데미가 무기한 기다리기 어려웠다는 사정도 있다. 2차 후보 명단은 10월 6일 발표될 예정이고, 문학상은 정해진 일정에 따라 후보를 좁힌다. 공식 일정과 성명이 확인해 주는 사실이다. 이런 상황에서 아카데미는 책을 유지할 경우 상의 취지를 해친다고 판단했을 수 있다. 여기서 ‘판단했을 수 있다’는 설명은 결정의 맥락을 읽는 추론이다. 특정 위원이 실제로 그렇게 말했거나, 법적으로 배제해야 했다는 뜻이 아니다. 어느 쪽을 택하든 결정과 증명의 차이는 남는다.

‘증거가 여러 개’라는 말의 함정

온라인 최초 게시물, 르몽드의 재검사, 팽그램 개발자의 확신, 공쿠르상의 성명을 네 개의 독립된 실험처럼 셀 수는 없다. 최초 게시물과 르몽드 검사는 같은 종류의 도구를 썼고, 개발자는 그 도구를 만든 이해관계자다. 공쿠르상은 실험 결과를 독자에게 공개한 연구기관이 아니라 자신이 신뢰하는 분석들을 근거로 후보를 결정한 심사기관이다. 각각 중요한 자료지만 역할이 다르다. 또 가디언의 취재는 일부 다른 탐지 도구가 이 책을 사람의 글로 판단했다고 전한다. 그 검사에 쓰인 문장과 설정이 상세히 공개되지 않아 반대 결론의 독립 증명으로 내세우기 어렵지만, 결과가 하나로 완전히 정렬된 상태도 아니라는 점은 보여준다.

과거 글의 원문 대조는 여기서 독립적인 축이다. 그 축은 작가의 과거 글에 관한 신뢰를 흔든다. 하지만 이번 소설 본문이 AI로 작성됐는지에 관한 직접 자료는 아니다. 출판사 성명도 다른 축이다. 편집 과정에서 AI를 쓰지 않았다는 사실을 알려주지만, 작가가 원고를 넘기기 전 과정은 비어 있다. 상의 결정은 또 다른 층위다. 그 빈칸을 법적으로 채운 것이 아니라, 빈칸이 남아 있는 상태에서 후보를 어떻게 처리할지 정했다. 뉴스 제목에서는 이 모든 정보가 ‘AI 소설 적발’이라는 몇 글자로 압축될 수 있다. 실제로는 확신의 정도와 적용 범위가 네 번 달라진다.

이 구분은 탐지 기술을 믿을지 말지 정하는 데도 도움이 된다. 글쓰기에서 맞춤법 검사, 번역 도움, 아이디어 정리, 몇 문단 생성, 전체 초고 생성은 각각 다른 개입이다. 이번 사건의 공개 자료만으로는 실제 AI 사용이 있었는지조차 확정할 수 없고, 있었다면 어느 범위였는지도 말할 수 없다. 그러니 ‘AI가 조금이라도 섞였으면 가짜’라는 일반론을 이 사건의 결론으로 삼는 것도, ‘문학이니 AI 사용은 아무 문제가 없다’는 일반론으로 뛰는 것도 성급하다. 공쿠르상의 가치 기준을 논하려면 먼저 무슨 일이 있었는지를 알아야 한다.

9월 27일 현재 확인 가능한 것은 분명하다. 책은 캐나다와 프랑스에서 출간됐고 프낙 소설상을 받았다. AI 탐지기는 분석한 본문에 높은 AI 분류 결과를 냈다. 작가는 사용을 부인하고, 과거의 다른 글에서는 유사성 의혹이 제기됐다. 보레알은 자신들의 편집 과정에 AI가 없었다고 말하면서도 이전 집필 과정은 확인하지 못한다고 밝혔다. 공쿠르 아카데미는 이를 포함한 자료를 근거로 자기 상의 첫 후보 명단에서 책을 지웠다. 반면 독립적으로 공개 검증된 초고·수정 기록이 이번 소설의 실제 작성 범위를 확정했다는 자료는 아직 확인되지 않는다. 상의 판단은 이미 내려졌지만, 책을 어떻게 썼는가라는 질문은 그 결정만으로 끝나지 않았다.

참고자료
  1. Fnac, Prix du roman Fnac 2026
  2. Académie Goncourt, 2026년 9월 25일 성명
  3. Grasset, C'était ça ou mourir 도서 정보
  4. Boréal, C'était ça ou mourir 도서 정보
  5. Le Monde, 소설 AI 의혹과 자체 탐지 검사
  6. The Guardian, 공쿠르상 후보 제외 사건 취재
  7. Pangram Labs, Pangram 4 Model Card
  8. International Journal for Educational Integrity, AI 탐지기 평가 연구
  9. The Philippine Star, Falling from pedestals
  10. La Presse, 과거 글 유사성 취재
  11. TVA Nouvelles, 과거 글 유사성 별도 취재
  12. Boréal, 오렐리앙 관련 두 번째 성명
  13. Le Monde, 팽그램 공동창업자 맥스 스페로 인터뷰