규제
Microsoft, 법원에 Copilot이 AI 저작권 MDL에서 책을 거의 복제하지 않는다고 주장

Microsoft는 2026년 9월 4일에 대형 언어 모델 훈련을 둘러싼 책 저자와 뉴스 출판사들이 제기한 통합 저작권 소송에서 요약 판결을 신청했으며, 맨해튼 연방 법원에 전문가가 820만 건의 Copilot 대화를 검토한 결과 저자들이 주장하는 작품과 최소 30단어가 일치하는 응답이 단 24개에 불과하다고 진술했습니다.
이 수치는 Microsoft가 요약 판결 신청을 뒷받침하기 위해 제출한 법률 메모에 설명된 분석에서 나온 것으로, 뉴욕 남부 지방법원 Sidney H. Stein 판사가 관할하는 다중소송(MDL) 중 책 원고들의 통합 사건에 해당합니다. Authors Guild와 지정된 소설·논픽션 작가들은 2022년 11월 OpenAI가 ChatGPT를 공개한 지 약 10개월 후에 소송을 제기했으며, 이후 Microsoft를 피고로 추가했습니다.
Copilot 로그 분석 결과
법률 메모에 따르면, 책 저자들의 전문가인 Dr. Shawn Shan은 약 530만 건의 시도에서 GPT 모델에 수백 단어에 이르는 원문 책 구절을 그대로 입력하는 적대적 추출 프로토콜을 사용했으며, 이 중 1% 미만이 30단어 일치를 생성했습니다. Microsoft는 이 작업을 전문가가 목표 구절을 선택하고 모델이 원하는 텍스트를 출력할 때까지 반복적으로 프롬프트를 제공한 것으로 설명했습니다.
실험실 환경을 벗어나, 서류에 따르면 Shan은 Microsoft의 Copilot 제품에서 820만 건의 대화를 검토하고 30단어가 일치하는 24개의 응답을 확인했으며, 이는 .00029 퍼센트에 해당한다고 기술했습니다. 212권으로 주장된 책 중 202권에 대해서는 메모가 전문가가 로그에서 전혀 재현을 발견하지 못했다고 밝히고 있습니다. “이는 LLM 훈련의 변형 목적을 거의 약화시키지 않는다”고 서류는 결론짓습니다.
Microsoft는 또한 저자들의 자체 판매 증거를 인용하여, 원고들이 ChatGPT와 Copilot이 출시되지 않았다면 판매했을 책 수와 동일하게 판매하고 있으며, 실제 출력이 그들의 작품과 일치하는 사례는 거의 없다고 주장했습니다. 서류는 극작가 David Henry Hwang이 피고들의 LLM이 자신의 연극 시장에 해를 끼치고 있다고 믿지 않는다고 인용하고, 판매 분석 결과 모델 도입으로 인한 매출 감소가 없다고 밝혔습니다.
공정 이용 논쟁
Microsoft의 서류에서 핵심 법적 주장은 저작권이 있는 책을 이용한 LLM 훈련이 법적으로 공정 이용에 해당한다는 것입니다. 이 서류는 해당 사용이 “극도로 변형적”이라고 주장하며, Meta와 Anthropic을 상대로 한 두 건의 AI 훈련 사건 판결을 인용해 LLM 훈련이 매우 변형적이라고 설명합니다. 서류는 책은 읽히기 위해 만들어진다고 밝히면서, OpenAI가 John Grisham의 The Street Lawyer와 Stacy Schiff의 Cleopatra와 같은 텍스트를 사용한 것은 기술적 목적: 프롬프트에 대한 자연어 응답을 생성하는 모델을 구축하기 위함이라고 설명합니다.
Authors가 OpenAI가 무단 복제본이 포함된 것으로 알려진 온라인 저장소 Library Genesis에서 책을 다운로드한 점에 초점을 맞춘 것에 대해, Microsoft는 명백한 기록이 자신이 해당 데이터를 다운로드하거나 획득에 관여하지 않았음을 입증한다고 밝히고, 훈련 데이터의 출처가 공정 이용 분석을 변경하지 않는다고 주장했습니다. 왜냐하면 과정의 모든 단계가 동일한 훈련 목적을 수행했기 때문입니다.
이 서류는 또한 OpenAI의 요청에 따라 Microsoft가 Bing 검색 엔진 인덱스의 일부를 제공한 점을 다룹니다. 메모는 해당 부분에 원고들의 작품이 포함되었는지 여부에 대한 증거가 불확실하다고 명시하며, 원고의 전문가가 인덱스 전송된 부분에서 8에서 24개의 주장된 작품을 확인했다고 언급하고, 그 전송이 LLM 훈련의 일부였다고 주장합니다.
시장 피해와 관련해, Microsoft는 원고가 제기한 두 가지 이론—훈련 데이터에 대한 라이선스 비용 손실과 AI 지원 책이 저자들의 자체 책과 경쟁함으로써 발생하는 “시장 희석”—을 법원이 기각하도록 촉구했습니다. 서류에 인용된 연구에 따르면, 회사 전문가의 선언에 따라 압도적인 다수의 소비자는 가격이 크게 낮아져도 AI 생성 책을 구매하지 않을 것이라고 밝혔습니다. 또한 서류는 훈련 데이터에 대한 라이선스 요구가 혁신에 큰 장벽이 될 것이라고 덧붙였으며, 이는 개발자들이 수백만 작가의 작품을 확보해야 하기 때문이라고 설명했습니다.
Microsoft는 같은 메모에 따라 원고들의 기여 침해 청구에 대한 청구서 판단을 동시에 요청했으며, LLM 훈련을 공정 이용으로 판단하면 해당 청구가 독립적으로 배제된다고 명시했습니다. 또한 같은 날 뉴스 원고들의 통합 사건에 대해 별도의 요약 판결 신청을 제출했으며, 책 관련 서류는 뉴스 서류가 출판사들이 문제 삼는 특정 LLM 기반 도구가 합법적인 이유를 설명한다고 기술했습니다.
MDL에서 다음 단계는
이 서류들은 저자와 출판사의 사건을 합친 다중소송 절차인 In re: OpenAI, Inc. Copyright Infringement Litigation에 제출되었습니다. 사건 기록에 따르면 다중소송 절차가 저자와 출판사의 사건을 결합했습니다. New York Times Company는 2026년 9월 4일에 자체 요약 판결 신청을 제출했으며, 답변은 2026년 10월 5일까지 제출해야 합니다. OpenAI도 같은 날 뉴스 원고들의 청구에 대한 요약 판결 신청을 제출했습니다.
2026년 9월 3일 Stein 판사가 서명한 합의된 비밀 유지 명령은 브리핑 공개 일정표를 설정했으며, 당사자와 제3자는 2026년 9월 14일까지 요약 판결 서류의 비공개 부분 유지 요청을 제출해야 하고, 모든 이의 제기되지 않은 부분이 비공개 해제된 상태로 2026년 9월 17일까지 서류와 Rule 56.1 진술을 공개 재제출해야 합니다. 반대 서류는 유사한 일정으로 진행되며, 2026년 10월 15일까지 공개 재제출이 요구됩니다.












