연구 현장에서 AI를 둘러싼 규칙이 한꺼번에 바뀌고 있습니다. OpenAI는 EU AI Act의 투명성 의무에 맞춰 AI가 쓴 글에 보이지 않는 워터마크를 넣겠다고 밝혔고, 미국 STEM 박사 논문의 약 30%에서 AI가 쓴 흔적이 나왔습니다. 영국의 한 연구 네트워크는 AI로 연구비 신청서 절반 가까이를 사람이 보기도 전에 떨어뜨렸다가 사과했고, arXiv는 한 달 제출량이 4만 건을 넘자 제출 수에 한도를 두었습니다. 네 소식을 관통하는 질문은 하나로 보입니다. AI가 쓴 글을 무엇으로 가려내고, 그 판단을 어디까지 기계에 맡길 것인가입니다.
OpenAI 텍스트 워터마크, 수학 글에서는 잘 잡히지 않는다
OpenAI는 2026년 10월 6일 EU AI Act의 투명성 의무를 지키기 위한 텍스트 출처 표시(provenance)와 워터마크 방침을 공개했습니다. API 고객은 눈에 보이지 않는 워터마크를 찾아내는 탐지기를 쓸 수 있고, ChatGPT 같은 소비자용 도구는 유럽 사용자 계정에서 만든 글에 신호를 넣기 시작합니다.
방식은 token(모델이 글을 나눠 처리하는 단위)의 분포에 통계적인 치우침을 심어 두는 것입니다. 사람 눈에는 보이지 않지만 탐지기는 이 치우침을 읽어 냅니다. 다만 OpenAI가 함께 공개한 측정 결과를 보면 한계가 뚜렷합니다.
| 조건 | 탐지율 |
|---|---|
| 심리학 글, 400 token | 94.3% |
| 수학 글, 200 token | 36.5% |
| 낱말 10%를 동의어로 바꾼 글 | 92%에서 66%로 하락 |
| 낱말 25%를 동의어로 바꾼 글 | 17%로 하락 |
글이 짧거나 수식이 많을수록 탐지율이 크게 떨어지고, 동의어 바꾸기나 편집만으로도 신호가 약해집니다. OpenAI도 워터마크로는 사람이 얼마나 기여했는지, 내용이 사실인지, 법적인 저자와 책임이 누구에게 있는지 알 수 없다고 밝혔습니다. 워터마크는 모델이 관여했다는 표시일 뿐입니다.
걱정되는 쪽은 대학과 연구 기관이 이 신호를 학술 부정의 증거로 받아들이는 상황입니다. 초안을 다듬는 데 AI를 쓴 학생과 연구 내용까지 맡긴 학생을 워터마크로는 구분할 수 없습니다. 탐지 결과가 나왔다는 사실만으로 징계를 정하면 억울한 사례가 생길 수 있습니다.
미국 STEM 박사 논문 30%에 AI 글쓰기 흔적
2026년 10월 나온 NBER(미국 경제연구소)의 연구 보고서는 미국 STEM 박사 학위 논문에서 AI가 쓴 글이 얼마나 늘었는지 분석했습니다. 2023년 전에는 AI 글쓰기가 탐지되지 않았지만 그 뒤로 빠르게 늘었습니다.
| 시기 | AI 글쓰기가 탐지된 논문 비율 |
|---|---|
| 2023년 | 1.7% |
| 2024년 | 5.5% |
| 2025년 | 18.8% |
| 2026년 5월까지 | 29.4% |
분야별로는 컴퓨터과학·수학이 36%, 공학이 35%로 높았습니다. 영어가 모국어가 아닌 학생과 순위가 낮은 박사 과정의 학생에게서 사용률이 크게 높았습니다. 모국어가 아닌 언어로 전문적인 글을 써야 하는 유학생이 표현을 다듬는 데 언어 모델을 쓰는 것은 이해할 만한 일로 보입니다.
눈에 띄는 결과는 진로입니다. 논문에 AI가 쓴 글이 들어간 졸업생은 학계의 정년 트랙에 남기보다 산업계로 갈 가능성이 훨씬 높았습니다. 다만 이 관계를 AI 사용이 진로를 바꿨다는 뜻으로 읽기는 어렵습니다. 처음부터 산업계로 갈 생각이던 학생이 전통적인 학위 논문 규범에 덜 신경 썼을 수도 있기 때문입니다.

▲ 박사 논문 속 AI 글쓰기 증가
연구비 신청서 절반을 사람보다 먼저 떨어뜨린 AI
영국 UKRI(UK Research and Innovation)가 지원하는 한 사이버보안 연구 네트워크는 연구비 공모에 들어온 신청서 179건을 AI 선별(triage) 도구로 먼저 걸렀습니다. 도구는 일곱 가지 기준으로 신청서를 평가했고, 사람이 한 건도 읽기 전에 절반 가까이를 탈락시켰습니다.
몇 주씩 공들여 복잡한 연구 계획을 다듬은 연구자들이 크게 반발했고, 이 네트워크는 사과한 뒤 탈락한 신청서를 모두 다시 평가하겠다고 밝혔습니다.
이 일은 AI에 어디까지 맡길지에 대한 선을 다시 보여 줍니다. AI는 교정, 맞춤법, 문법, 서식, 상호 참조 확인 같은 표면적인 점검에는 쓸모가 있습니다. 그러나 특정 분야의 새로운 과학 가설이나 좁은 분야의 연구 방법을 이해하고 그 가치를 판단하는 일은 아직 AI가 해낼 수 있는 일로 보기 어렵습니다. 연구비 지원 여부를 전문가의 평가 없이 AI가 정하게 하면 신청서에 들인 연구자의 노력을 헛되게 만들 수 있습니다.
AI 탐지기 하나로 심사를 거절한 사례
같은 문제는 동료 평가(peer review)에서도 나타났습니다. 호주 Western Sydney University의 한 겸임교수는 2026년 10월 5일 X에 원고 심사 요청을 거절했다는 글을 올렸습니다. 원고 초록을 AI 탐지 도구의 무료 버전에 넣었더니 전부 AI가 썼다는 결과가 나왔다는 이유였습니다. 이 글은 조회 70만 회를 넘겼습니다.
보수를 받지 않는 심사자가 성의 없이 자동으로 만든 원고에 시간을 쓰고 싶지 않다는 불만은 이해할 만합니다. 하지만 학계에서는 반론도 많았습니다. AI 탐지기는 정확도가 낮고, 사람이 쓴 글을 AI가 쓴 글로 잘못 판정하는 일이 잦습니다. 문장 구조나 낱말 몇 개만 바꿔도 판정이 뒤집혀 쫓고 쫓기는 게임에 가깝습니다. 한 이용자는 AI 탐지기 결과로 원고를 거절하는 것을 저자가 계산기를 썼다는 이유로 물리학 원고를 거절하는 일에 빗대기도 했습니다.
AI가 만든 글에 대한 반감 자체는 이해할 수 있지만, 결함이 있는 탐지 알고리즘을 그대로 믿고 심사를 거절하는 것은 지나친 대응으로 보입니다.
arXiv, 한 달 4만 건 넘자 제출 수 제한
논문 사전 공개 서버 arXiv는 2026년 10월 1일부터 제출자와 분야별로 제출 수를 제한하는 정책을 시행했습니다. 생성형 AI로 글을 쉽게 만들 수 있게 되면서 제출량이 급증했기 때문입니다.
| 시점 | 월 제출 수 |
|---|---|
| 2016년 9월 | 9,869건 |
| 2024년 9월 | 20,569건 |
| 2026년 9월 | 40,363건(역대 최다) |
예전에는 타자 속도와 사람이 직접 내용을 종합하는 시간이 논문 출판량의 자연스러운 상한이었습니다. 생성형 AI가 이 장벽을 없애면서 한 저자가 한 달에 수십 편을 올리는 일이 가능해졌습니다. 그 부담은 제출물을 살펴보는 arXiv의 자원봉사 검토자(moderator)에게 돌아갔습니다. 2026년 9월 한 달에만 지원 요청이 9,000건 가까이 쌓였고 게시가 곳곳에서 늦어졌습니다.
학자들과 검토자들은 이 제한을 지지하고 있습니다. Rutgers University의 한 수학 교수는 저자가 한 달에 가장 좋은 논문 두 편을 골라 올리면 충분하다고 말했습니다. 제출 한도는 자원봉사 검토 체계가 무너지지 않게 막는 불가피한 임시 조치로 보입니다.

▲ 사전 공개 서버의 제출 폭증
수학 원고 719편 공개를 둘러싼 반발
OpenAI는 워터마크 방침과 같은 날인 10월 6일, 내부 최신 모델이 쓴 수학 원고 719편을 372개 묶음으로 나눠 GitHub에 공개했습니다. 수학자들의 한 실무 그룹은 Terence Tao의 블로그에 성명을 싣고, 수학자들이 요청한 적 없는 검증되지 않은 논문을 한꺼번에 쏟아 낸 것은 학술적 기여가 아니라 기업의 힘을 과시한 일이라고 비판했습니다. 이 반발이 정당한 윤리·검증 문제 제기인지, 자기 일의 핵심이 자동화되는 데 대한 방어인지는 더 지켜볼 문제로 남습니다.
연구자와 기관이 지금 확인할 것
AI가 쓴 글을 가려내는 도구는 아직 믿을 만한 판정자가 아니고, AI가 연구의 가치를 평가하는 일도 전문가의 판단을 대신하지 못합니다. 연구자와 기관이 지금 할 일은 다음과 같습니다.
- 워터마크나 AI 탐지기 결과만으로 학술 부정을 판단하지 않습니다. 짧거나 수식이 많은 글은 탐지가 특히 부정확합니다.
- 워터마크는 저자를 정하지 않습니다. 제출한 글의 사실 관계에 대한 책임은 사람 저자에게 있습니다.
- 생성형 AI는 문체 다듬기, 문법 점검, 서식, 구조 초안에 쓰고, 검증하지 않은 과학적 주장을 만들게 하지 않습니다.
- 영어가 모국어가 아니라면 AI를 번역과 표현 보조로 쓰되 연구 방법과 핵심 내용까지 맡기지 않고, 사용 사실을 투명하게 밝힙니다.
- arXiv 같은 사전 공개 서버에는 많이 올리기보다 영향력 있는 소수의 논문을 골라 올립니다.