
생성형 AI 서비스가 일상에 깊숙이 들어오면서, 그 성능을 떠받치는 데이터가 어디서 왔는지는 점점 더 중요한 질문이 되고 있습니다. 특히 뉴스처럼 사람의 취재와 편집이 들어간 콘텐츠라면, 활용 범위와 권리 문제는 기술 논쟁을 넘어 산업 구조의 문제로 이어집니다.
이번 공개 문서는 그 질문을 아주 선명하게 다시 꺼냈습니다. 오픈AI가 챗GPT 개발 과정에서 언론사 기사 1000만 건 이상을 무단 사용했다는 주장이 법원 기록을 통해 드러났고, 오픈AI와 마이크로소프트는 이를 공정 이용으로 맞서고 있습니다.
법원 문서가 꺼내 놓은 핵심 쟁점
AFP통신에 따르면 17일 현지시각에 공개된 법원 문서에는 오픈AI가 챗GPT 개발 과정에서 뉴욕타임스(NYT)를 비롯한 여러 언론사의 기사를 대거 사용했다는 내용이 담겼습니다. 문서에는 이를 두고 ‘절도’라는 표현이 등장했고, 마이크로소프트의 응용과학 책임자 브렌트 헥트가 오픈AI의 기사 사용 규모를 “전례 없는 규모의 놀라운 절도 사건이자 인류 역사상 최대 규모의 노동 착취”라고 지적한 발언도 포함됐습니다.
문서에 따르면 무단 사용이 주장된 언론사 기사는 1000만 건이 넘고, 이 가운데 약 3분의 1은 NYT 기사인 것으로 나타났습니다. NYT는 2023년 오픈AI와 MS를 상대로 뉴욕 연방지방법원에 저작권 침해 소송을 제기했고, 이후 지프 데이비스, 마더 존스의 모회사, 더 인터셉트, 미국 각 지역 언론사 등이 소송에 합류했습니다.
오픈AI는 2022년 말 챗GPT를 출시한 뒤 여러 언론사와 콘텐츠 라이선스 계약을 체결해 왔습니다. 하지만 법원 문서가 공개되면서, 서비스 출시 이후의 계약 확대와 별개로 개발 단계에서의 데이터 사용 방식이 여전히 핵심 쟁점으로 남아 있다는 점이 다시 부각됐습니다.

링크만으로는 해결되지 않는 문제
이번 문서에서 특히 눈에 띄는 부분은 오픈AI 내부와 AI 업계가 뉴스 원문 링크 제공만으로는 트래픽 감소 문제를 풀기 어렵다고 봤다는 대목입니다. 공개된 문서에는 오픈AI 엔지니어들이 “우리가 아무리 눈에 띄게 링크를 보여주더라도 사용자들은 클릭하지 않을 것”이라고 언급한 내용이 담겼습니다.
이 대목은 생성형 AI가 뉴스를 소비하는 방식을 바꿔 놓았다는 사실을 보여줍니다. 이용자는 검색 결과를 거쳐 원문으로 이동하지 않아도 답을 얻을 수 있고, 그만큼 언론사 웹사이트로 향하는 흐름은 약해질 수 있습니다. 링크와 인용을 붙이는 방식이 최소한의 대응처럼 보이더라도, 실제로는 원문 방문을 되살리는 데 한계가 있다는 점이 쟁점으로 남습니다.
오픈AI와 MS는 이런 활용이 기존 저작물에 새로운 가치와 목적, 기능을 더하는 ‘변형적 이용’에 해당하며 미국 저작권법상 공정 이용에 들어간다고 반박하고 있습니다. 미국 법무부도 이달 초 과학 발전과 경제 성장, 국가 안보 등을 이유로 두 회사 측 입장을 지지하는 취지의 의견서를 법원에 제출했습니다.
이 사건을 볼 때 함께 확인할 기준
이번 논란은 AI가 무엇을 할 수 있는지보다, 어떤 콘텐츠를 어떤 방식으로 쓰는지가 더 중요해졌다는 점을 보여줍니다. 특히 뉴스 콘텐츠처럼 제작 비용과 권리 구조가 분명한 자료는, 단순한 학습 데이터가 아니라 산업의 수익 기반과 연결됩니다.
그래서 비슷한 논쟁을 볼 때는 ‘데이터를 많이 썼는가’보다 ‘어떤 권리 관계 위에서 썼는가’를 먼저 확인할 필요가 있습니다. 또 서비스가 원문 링크를 제공하는지, 인용을 표시하는지뿐 아니라 그 조치가 실제로 원문 방문이나 보상 구조를 바꾸는지까지 함께 봐야 합니다.
법원이 약식판결 신청을 받아들이면 정식 재판 없이 결론이 날 수 있다는 점도 중요합니다. 이번 사건은 한 기업의 개발 관행을 넘어, 생성형 AI가 뉴스 생태계와 맺는 관계를 법이 어디까지 조정할 수 있는지 시험대에 올려놓고 있습니다.
D.Flick Note
오픈AI와 MS는 공정 이용을 내세우고 있지만, 이번 문서에서 더 분명하게 드러난 것은 기술이 아니라 분배의 문제입니다. 챗GPT가 정보를 더 쉽게 전달할수록, 그 정보를 만들어 온 언론사와의 관계를 어떤 기준으로 정리할지에 따라 AI 서비스의 사회적 신뢰도는 달라질 수 있습니다.