AIbase수정일

미국 지역 언론, 집단으로 마이크로소프트·OpenAI 고소: 수만 편의 기사가 모델에 투입됐지만 단 한 푼도 지급되지 않아

마이크로소프트와 OpenAI가 다시 소송에 시달리고 있다. 미시시피주의 엠리지 신문 그룹을 필두로 한 여러 미국 지역 뉴스 매체들은 두 기술 기업이 오랫동안 체계적으로 무단·무보상으로 수만 편의 저작권 보호 신문 기사를 대규모 모델 학습에 사용하고 AI 제품을 통해 막대한 상업적 이익을 얻었으며, 정작 원 콘텐츠 제공자에게는 응당한 보상이 이루어지지 않았다고 고발했다. 현재 이 사건은 법원에…

마이크로소프트와 OpenAI가 다시 법정에 섰는데, 이번에 원고석에 선 것은 평소 스포트라이트를 잘 받지 못하던 지역 뉴스 매체들이다. 미시시피주의 엠리지 신문 그룹을 필두로 여러 미국 지역 뉴스 기관들이 최근 법원에 소장을 제출하고, 두 기술 기업이 오랫동안 체계적으로 승인도 받지 않고 어떠한 보상도 지급하지 않은 채 수만 편의 저작권 보호 신문 기사를 대규모 모델 학습 과정에 밀어 넣었으며, 이런 AI 제품으로 막대한 상업적 가치를 벌어들였는데 정작 원 콘텐츠 제공자는 단 한 푼도 받아보지 못했다고 고발했다.

이 소송은 결코 단독 사례가 아니다. 최근 몇 년간 비슷한 긴장감이 끊이지 않았고, 《뉴욕 타임스》 등 대형 언론은 이미 같은 이유로 마이크로소프트와 OpenAI를 고소한 바 있다. 하지만 지역 언론의 가세로 전선은 주요 대형 신문에서 지역 신문사까지 번져나갔다. 원고 측은 소장에서 노골적으로 밝혔다: 마이크로소프트와 OpenAI가 이미 수십억 달러의 수익을 창출했고 계속 창출해 나가는 반면, 콘텐츠 생산자는 "단 한 푼도 받지 못했다"는 것이다. 더 눈에 거슬리는 것은, 원래 페이월을 설치해 접근 제한을 걸어둔 일부 기사마저 제한을 우회해 가져가 학습에 사용했다는 지적이다.

소송에서 기술적 세부 사항이 가장 잘 드러나는 부분은 저작권 표지에 관한 것이다. 원고들은 소송 대상 기사들에 원래 저작권 관리 정보, 즉 저자 서명, 출판 기관 이름, 저작권 표시, 이용 조건이 박혀 있었고, 이는 곧 작품의 신분증과 같은 것이라고 지적했다. 그들은 마이크로소프트와 OpenAI가 콘텐츠를 학습에 투입하기 전에 이런 표지들을 함께 지워버려 작품의 소속이 가족 사진첩에서 몰래 찢겨 나간 것처럼 되었다고 고발했다. 또 다른 증거는 출력 측에서 나왔다. 원고 측은 지난 몇 년간 자사의 뉴스 콘텐츠가 AI 시스템에 의해 거의 축자적으로 반복되는 방식으로 내놓아진 사례가 여러 번 있었다고 주장하며, 이는 그 자료들이 이미 모델 속 깊이 삼켜졌음을 역으로 증명하는 것이라고 밝혔다.

지역 언론에게 이것은 단순한 저작권 문제가 아니라 생존의 문제다. 미국의 지역 신문들은 그동안 종이 판매량 감소와 광고 위축이라는 이중의 압박을 이미 견뎌 왔는데, AI가 답을 사용자에게 직접 전달하면서 원래도 얇아지던 트래픽마저 더 잠식당했다. 그래서 원고 측은 기술 기업들의 행위를 "지역 언론의 장송곡"이라 불렀다. 그들이 서비스하는 많은 시장에서 엠리지 신문 그룹은 그 지역의 유일한 뉴스 출처이며, 이런 매체가 축소되거나 문을 닫게 되면 이웃들의 정보 통로가 직접 끊긴다. 이번에 연명으로 소송을 제기한 곳은 엠리지 외에도 Ojai Media와 Coopwood 산하의 여러 출판 및 미디어 회사가 있으며, 모두 독립 신문·잡지 출판사들이다.

법적 측면에서 원고들은 두 회사가 미국 《저작권법》과 《디지털 밀레니엄 저작권법》(DMCA)을 위반해 저작권 침해 및 관련 위법 행위를 구성했다고 본다. 소장은 또한 뚜렷한 이중잣대를 지적했다: 마이크로소프트와 OpenAI는 한편으로는 출판사들의 저작권을 무시했다고 지목되면서도, 다른 한편으로는 라이선스 계약, 유료 서비스, 법적 수단을 적극적으로 활용해 자사의 코드, 모델, 시스템을 빈틈없이 보호해 왔다. 원고 측은 더 나아가 최근의 한 건을 일부러 꺼냈다. OpenAI는 경쟁사가 자사가 생성한 콘텐츠를 모델 학습에 사용해 자사의 이익을 침해했다고 공개적으로 불만을 표명한 적이 있는데, 이런 태도는 지금 자신이 고발당하는 행위와 정확히 대조를 이룬다.

지역 언론의 요구는 명확하다. 법원이 손해 배상과 보상을 판결해 주기를 바라는 것은 물론이고, 무엇보다 마이크로소프트와 OpenAI가 모델 학습 데이터에서 원고의 저작권 작품과 관련된 모든 내용을 완전히 삭제하도록 강제하는 금지 명령을 내려 달라는 것이다. 점점 더 많은 뉴스 기관, 출판사, 콘텐츠 창작자들이 법적 수단을 들이대면서, AI 학습 데이터가 과연 합법인지, 콘텐츠는 어떤 메커니즘으로 라이선스하고 보상해야 하는지가 글로벌 인공지능 산업에서 가장 주목받는 법적 쟁점의 자리를 확고히 차지하고 있다.


원문 출처

AIbase

내용 안내

원문 발행 및 권리는 출처에 있습니다.

기계 번역 · 원문을 참고하세요