[Hacker News 요약] 작가 소송: 마이크로소프트/OpenAI 경영진, 불법 복제 및 작가 생계 위협 인지 증거 공개
28
설명
작가들이 마이크로소프트와 OpenAI를 상대로 제기한 소송에서 새로운 증거가 공개되었습니다.
이 증거는 두 회사의 고위 경영진이 저작권이 있는 책을 무단으로 사용하여 AI 모델을 훈련하는 것이 불법임을 알고 있었으며, 이로 인해 작가들의 생계가 위협받을 수 있다는 점을 인지하고 있었음을 시사합니다.
이번 공개는 AI 개발의 윤리적, 법적 측면에 대한 논쟁을 더욱 심화시키고 있습니다.
### 배경 설명
이번 사건은 생성형 AI 기술의 급속한 발전과 함께 저작권 침해 및 창작자의 권리 보호에 대한 논의가 뜨거워지고 있는 가운데 발생했습니다. OpenAI의 GPT 모델과 같은 대규모 언어 모델은 방대한 양의 텍스트 데이터를 학습하여 인간과 유사한 텍스트를 생성하지만, 이 학습 데이터에 저작권이 있는 자료가 포함되어 있는지 여부는 중요한 쟁점입니다. 특히, 작가들은 자신들의 작품이 동의 없이 AI 학습에 사용되어 결과적으로 자신들의 일자리를 빼앗길 수 있다는 점에 대해 강한 우려를 표명하고 있습니다. 이번에 공개된 서류는 이러한 우려가 단순한 추측이 아니라, OpenAI와 마이크로소프트 내부에서도 인지하고 있었던 사실임을 보여줍니다. 이는 AI 개발 과정에서의 투명성 부족과 윤리적 책임에 대한 질문을 제기하며, 향후 AI 기술 발전 방향과 규제 논의에 중요한 영향을 미칠 것으로 예상됩니다.
### 경영진의 불법 행위 및 작가 생계 위협 인지
공개된 서류에 따르면, OpenAI의 정책 책임자인 Jack Clark는 2020년 5월, AI와 창의성에 대한 연구가 점차 '사람들의 노동을 대체하는 시스템을 만드는 것'으로 이어질 것이라고 언급했습니다. 그는 특히 장르 소설 작가들이 GPT-X의 발전으로 인해 아마존에서의 일자리를 잃을까 봐 걱정하게 될 것이라고 지적했습니다. 또한, 그는 '이 분야에서의 우리의 작업은 사람들을 실업하게 만들 것'이며, '예술가들이 우리의 작업에 대해 우려를 표명할 때가 올 것이지만, 우리는 그들의 우려를 무시하고 출시할 가능성이 높다'고 덧붙였습니다. 이는 AI 개발팀이 자신들의 기술이 가져올 사회적, 경제적 파장에 대해 명확히 인지하고 있었음을 보여줍니다.
### AI 모델을 통한 타인의 저작물 '자동 완성' 시도
OpenAI는 2022년, 모델의 글쓰기 품질 향상을 이끌기 위해 Tarun Gogineni를 고용했습니다. Gogineni는 GPT 모델이 조지 R.R. 마틴의 '얼음과 불의 노래' 시리즈의 마지막 두 권을 '언젠가 완성할 수 있도록' 하는 것을 자신의 '연구 임무'라고 밝혔습니다. 그는 심지어 'GRRM(조지 R.R. 마틴)이 일찍 사망하더라도 GPT-5가 그의 시리즈를 자동 완성할 것이라는 사실에 안심할 것'이라고 말했습니다. 이는 AI가 단순히 기존 텍스트를 모방하는 것을 넘어, 창작자의 의도를 이어받아 새로운 작품을 '완성'하려는 시도가 있었음을 보여주며, 창작의 본질에 대한 근본적인 질문을 던집니다.
### 저작권 침해 및 '수용 가능한 경제적 혼란'
Gogineni는 작가들이 '데이터셋이 도난당했다'고 불평하고 AI 생성 경쟁으로 인해 일자리를 잃고 있다는 불만에 대해 '별로 동정적이지 않다'고 생각했으며, 이를 '수용 가능한 경제적 혼란'으로 간주했습니다. 그는 '세상은 곧 '독자의 죽음'을 경험하게 될 것'이라며 '기계가 기계를 위해 쓰레기를 만들 것'이라고 썼습니다. 이는 AI 개발 과정에서 발생할 수 있는 윤리적 문제와 작가들의 생계 위협을 단순한 '경제적 혼란'으로 치부하는 태도를 보여주며, 기술 발전의 이면에 숨겨진 냉혹한 현실을 드러냅니다.
### 마이크로소프트의 초기 인지 및 증거 은폐 시도
마이크로소프트는 OpenAI가 LibGen과 같은 출처에서 데이터를 사용했다는 사실을 초기부터 인지하고 있었습니다. 2019년 4월, Sam Altman과 Dario Amodei가 Bill Gates와 Kevin Scott(마이크로소프트 최고 기술 책임자)에게 GPT-3의 초기 버전을 시연하면서 LibGen 사용 사실을 공개했습니다. 또한, OpenAI는 2022년 여름, 'Project Clear'라는 이름으로 LibGen 파일을 삭제하는 등 증거를 은폐하려는 시도를 했습니다. 이는 2022년 6월 15일, OpenAI의 Slack 채널에서 LibGen 언급에 대한 우려와 시스템 및 저장소에서 LibGen을 제거하는 방안에 대한 논의가 있었음을 보여줍니다. 이러한 행위는 자신들의 불법적인 데이터 수집 사실을 숨기려는 의도를 명확히 드러냅니다.
### 가치와 인사이트
이번 소송에서 공개된 서류는 AI 개발 기업들이 저작권 침해의 위험성과 그로 인한 창작자들의 피해를 명확히 인지하고 있었음에도 불구하고, 기술 개발을 강행했음을 보여주는 결정적인 증거입니다. 이는 AI 기술 발전의 속도만큼이나 중요한 것이 바로 윤리적 책임과 법적 준수임을 다시 한번 강조합니다. 특히, '수용 가능한 경제적 혼란'이라는 표현은 기술 발전이 가져올 수 있는 사회적 비용을 어떻게 평가하고 관리해야 하는지에 대한 심각한 질문을 던집니다. 작가들은 자신들의 창작물이 AI에 의해 대체되거나 모방되는 것에 대한 정당한 보상과 권리 보호를 요구하고 있으며, 이번 사건은 이러한 요구가 더욱 거세질 것임을 시사합니다. AI 기업들은 단순히 기술 개발에만 집중할 것이 아니라, 창작 생태계와의 공존 방안을 적극적으로 모색해야 할 것입니다.
### 향후 전망
이번 소송의 결과는 AI 학습 데이터의 저작권 문제에 대한 법적 선례를 남길 가능성이 높습니다. OpenAI와 마이크로소프트는 물론, 다른 AI 개발 기업들도 이번 사건을 통해 데이터 수집 및 활용 방식에 대한 재검토를 피할 수 없을 것입니다. 향후 AI 모델의 학습 데이터셋 구성에 대한 투명성이 강화되고, 저작권 침해에 대한 법적 책임이 명확해질 것으로 예상됩니다. 또한, 작가, 출판사 등 창작자 커뮤니티는 AI 기술 발전에 대한 감시를 강화하고, 자신들의 권익 보호를 위한 법적, 제도적 장치 마련을 더욱 적극적으로 요구할 것입니다. 경쟁사들은 이러한 법적 리스크를 회피하기 위해 합법적인 데이터 소싱 방안을 모색하거나, 저작권 문제를 해결하기 위한 새로운 비즈니스 모델을 개발할 수 있습니다. 2027년 초로 예정된 청문회는 이 사건의 향방을 결정짓는 중요한 분기점이 될 것입니다.
📝 원문 및 참고
- Source: Hacker News
- 토론(HN): [news.ycombinator.com](https://news.ycombinator.com/item?id=49863864)
- 원문: [링크 열기](https://authorsguild.org/news/ag-v-openai-top-execs-knew-mass-book-piracy-was-illegal/)
---
출처: Hacker News · [원문 링크](https://authorsguild.org/news/ag-v-openai-top-execs-knew-mass-book-piracy-was-illegal/)
이 글에 대한 한 줄 의견
신고 · 불법·유해·아동 안전(CSAE) 관련 콘텐츠

댓글 0
아직 댓글이 없습니다. 로그인하면 바로 의견을 남길 수 있습니다.