제284호

공급망을 무너뜨리는 제품이라고, 만든 쪽이 먼저 적었어요

마이크로소프트·오픈AI 내부 문서가 법정에서 풀렸어요

비즈니스공급망을 무너뜨리는 제품이라고, 만든 쪽이 먼저 적었어요

‘역사상 최대의 노동 절도’보다 오래 남을 문장

지난 17일(현지 시각), 뉴욕타임스가 오픈AI와 마이크로소프트를 상대로 낸 저작권 소송에서 봉인돼 있던 문서 일부가 공개됐어요. 기사 제목은 거의 다 같은 문장을 달았어요. 마이크로소프트 응용과학 디렉터 브렌트 헥트가 2023년 1월 내부 메모에 적었다는 표현, “인류 역사상 최대의 노동 절도”예요.

제목이 될 만한 문장이에요. 그런데 저는 같은 사람이 쓴 다른 문장에서 더 오래 멈췄어요. 거대 언어 모델은 자기 공급망을 파괴하는 제품이라는 문장이요. 마이크로소프트 내부 문서에는 이런 취지의 대목도 있었다고 해요. 최종 제품이 핵심 공급자의 경제적 기반을 위협하는 건 아주 드문 일인데, 우리가 LLM 사업에서 바로 그 상황을 만들었다고요.

절도는 윤리의 언어이고, 법정에서 다툴 단어예요. 공급망은 사업의 언어예요. 오늘은 뒤쪽 이야기를 해보려 해요. 회사 안에서 무엇을 알았고, 무엇을 숫자로 확인했고, 그걸 알고도 왜 공급자를 붙잡는 쪽으로 움직이지 않았는지요.

공개된 문서에 적힌 것들

먼저 무엇이 나왔는지 정리할게요. 소송은 2023년 12월 뉴욕타임스가 제기했고, 지금은 뉴욕데일리뉴스를 포함한 다른 11개 언론사가 함께하고 있어요. 뉴욕 남부연방지법 시드니 스타인 판사가 약식 판결1 신청을 검토하고 있고, 그 과정에서 문서가 조금씩 풀리는 중이에요.

이번에 공개된 대목은 크게 세 갈래예요.

첫째는 규모예요. 원고 측 서면에 따르면 오픈AI의 중간 학습 데이터셋에만 원고 언론사 기사 사본이 9만 1,692건 넘게 들어 있었고, 커먼크롤2에서 추린 한 데이터셋에는 nytimes.com 문서만 200만 건이 넘었어요. 유료 벽을 우회하고 학습 데이터에서 저작권 고지를 지웠다는 정황도 원고 측 주장에 들어 있어요. 오픈AI 연구원이 뉴욕타임스 유료 벽을 우회하는 ‘핵’을 보고하자 그렉 브록먼 사장이 “아 좋네”라고 답했다는 대화도 그중 하나예요.

둘째는 내부의 우려예요. 헥트의 메모 말고도 있어요. 챗GPT 개발을 이끈 닉 털리는 2023년 6월 메모에서 AI가 언론사에 존재론적 위협이라고 썼고, 2024년 2월에는 AI 제품이 좋아질수록 점점 더 대체적이 될 거라고 적었어요. 2020년에는 당시 오픈AI 정책 디렉터였던 잭 클라크가 샘 올트먼과 브록먼에게, 회사가 사회의 문화를 만드는 사람들의 노동을 대체하는 시스템을 만들게 될 거라는 메모를 보냈어요. 클라크는 이후 회사를 떠나 앤스로픽을 공동 창업했어요.

셋째는 경영진의 진술이에요. 사티아 나델라 마이크로소프트 CEO는 증언 녹취에서 유료 벽 뒤의 콘텐츠는 쓰려는 누구든 라이선스를 받아야 한다고 했어요. 그리고 오픈AI가 유료 벽 뒤 정보를 긁어 학습했다는 걸 알았다면, 모델 재학습을 요구하는 권리를 행사했을 거라고 말했어요.

다만 읽을 때 조심할 점이 두 가지 있어요. 이번에 나온 내용 상당수는 원본 증거가 아니라 뉴욕타임스 측 서면에 인용된 발췌예요. 원 문서는 아직 봉인돼 있으니, 앞뒤 맥락 없이 잘린 문장이라는 뜻이에요. 그리고 마이크로소프트는 헥트의 메모가 회사 입장이 아니라고 반박했어요. 법원 서면에서는 그가 의사결정권자가 아니었고, 다른 각도의 관점을 내도록 고용된 연구자였다고 설명했고요. 오픈AI는 논평 요청에 답하지 않았어요.

‘도둑질’보다 무거운 단어는 ‘대체’예요

헤드라인은 절도였지만, 재판에서 무게가 실릴 단어는 따로 있다고 봐요. 대체예요.

오픈AI와 마이크로소프트의 방어 논리는 미국 저작권법의 공정 이용3이에요. 기사를 학습에 쓴 건 원본을 새로운 무언가로 충분히 변형한 것이고, 원본의 시장 가치를 해치는 대체재가 아니라는 주장이죠. 공정 이용을 판단할 때 법원이 따지는 요소 가운데 하나가, 그 이용이 원저작물의 시장에 어떤 영향을 주느냐예요.

그런데 이번 문서에는 회사 안에서 쓴 ‘대체’라는 단어가 반복돼요. 털리는 AI 제품이 대체로 대체적이라고 쓰고 거기에 “이상 끝”을 붙였어요. 2023년 2월 오픈AI의 한 엔지니어는 링크를 아무리 눈에 띄게 보여줘도 사용자는 누르지 않을 거라고 동료들에게 썼고요. 마이크로소프트 자체 데이터로는, 코파일럿의 답변 엔진이 기존 빙 검색에 비해 nytimes.com의 클릭률을 최대 93%까지 떨어뜨렸다는 대목도 서면에 들어 있어요.

이 링크 이야기는 저희 뉴스레터에서도 몇 번 다뤘어요. 구글이 퍼블리셔에게 선호 소스 버튼을 내밀었을 때도, AI 요약이 붙으면 링크 클릭이 거의 반으로 줄어든다는 외부 조사를 인용했었어요. 이번에 달라진 건 출처예요. 바깥 조사기관이 아니라 제품을 만든 회사의 내부 데이터와 엔지니어의 문장이라는 점이요. “출처 링크를 달면 트래픽이 돌아간다”는 설명을, 만든 쪽이 먼저 믿지 않았던 거예요.

구글 선호 소스 버튼, 팔로워 수는 알려주지 않아요 · 제210호 · INLEVEL9구글이 공개한 선호 소스 임베드 버튼의 내용과, 퍼블리셔가 자기 사이트를 지정한 독자 수와 유입량을 확인할 수 없는 이유를 정리했어요inlevel9.com

그렇다고 소송 결과를 여기서 예단할 수는 없어요. 지금까지 미국 법원은 AI 학습을 공정 이용으로 보는 쪽에 대체로 기울어 있었고, 이달 초에는 트럼프 행정부가 오픈AI 쪽을 지지하는 의견서를 냈어요. 맥락이 빠진 발췌는 재판에서 얼마든지 다르게 읽힐 수 있고요. 다만 “변형이지 대체가 아니다”라고 주장하는 회사 안에서 “대체다, 끝”이라는 문장이 나왔다는 사실은 판결과 별개로 기록에 남았어요.

공급자를 말려 죽이는 구매자

이제 공급망 이야기로 돌아갈게요.

사업하는 입장에서 핵심 공급자가 무너지는 건 윤리 문제이기 전에 생존 문제예요. 지난 8월 샌디스크 이야기를 쓸 때가 딱 반대 장면이었어요. AI 데이터센터를 짓는 고객들이 낸드 공급사와 4년 넘는 계약을 맺고, 계약을 깨면 돈이 곧바로 넘어가도록 165억 달러 규모의 보증까지 걸었어요. 부품이 끊기면 자기 사업이 멈추니까, 구매자가 먼저 공급자의 생존에 돈을 댄 거예요.

샌디스크 4년 계약, 165억 달러 보증까지 · 제183호 · INLEVEL9고객 8곳이 4년 이상 공급계약과 165억 달러 재무 보증을 먼저 요구했어요inlevel9.com

헥트의 문서가 흥미로운 건 이 논리를 콘텐츠에 그대로 대입했다는 점이에요. 그는 코파일럿이 언론사 클릭을 떨어뜨리는 현상을 ‘파멸의 고리’라고 불렀어요. 언론사가 약해지면 좋은 글이 줄고, 좋은 글이 줄면 모델 성능도 떨어지고, 웹 전체가 같이 나빠진다는 거예요. 윤리 호소라기보다 우리 제품의 원재료 수급 경고였어요.

그런데 반도체와 달리 콘텐츠에서는 구매자가 공급자를 붙잡지 않았어요. 왜 그랬는지 문서가 직접 답하지는 않아요. 여기서부터는 제 해석인데, 두 가지가 겹쳤다고 봐요.

하나는 시차예요. 낸드는 오늘 끊기면 오늘 서버가 멈춰요. 기사는 이미 수십 년 치가 학습돼 있으니, 공급자가 무너지는 비용은 몇 년 뒤에야 청구돼요. 다른 하나는 공급자의 수예요. 낸드 공급사는 손에 꼽지만 글을 쓰는 곳은 셀 수 없이 많아요. 한 곳이 무너져도 당장은 대체재가 있는 것처럼 보이죠. 두 조건이 겹치면, 공급망이 무너지는 걸 알아도 오늘 돈을 낼 이유는 약해져요.

그 사이 공급자 쪽 값은 소송과 개별 계약으로 매겨지기 시작했어요. 뉴스코퍼레이션처럼 오픈AI와 대형 계약을 맺은 언론사도 있고, 저처럼 책 한 권을 AI 학습용으로 라이선스해 수백 달러를 받은 저자도 있어요. 다만 이건 공급망을 설계한 결과라기보다, 무너지는 걸 보면서 급히 덧댄 조각에 가까워요.

오스왈드의 시선

이번 문서에서 제가 가장 오래 본 대목은 따로 있어요. 마이크로소프트가 헥트를 두고 한 설명이요. 다른 관점을 내라고 고용한 사람이었고, 의사결정권자가 아니었다는 것.

supply chain방어 논리로는 말이 돼요. 그런데 조직 설계로 읽으면 이상해요. 반대 의견을 내라고 사람을 뽑았고, 그 사람이 정확히 그 일을 했는데, 이제 와서 그 결과를 회사 입장이 아니었다고 말하는 거예요. 경고는 있었는데 결정하는 자리까지 도착하지 않았다는 고백으로도 읽혀요. 나델라의 증언도 같은 모양이에요. 알았다면 재학습을 요구했을 거라는 말은, 뒤집으면 알 수 있었던 정보가 자기 책상까지 오지 않았다는 뜻이니까요. 물론 증언은 증언이고, 스스로를 보호하는 말일 수도 있어요.

클라크의 2020년 메모까지 놓고 보면 그림이 더 선명해져요. 경고는 한 번이 아니었고, 한 회사에만 있지도 않았어요. 2020년, 2023년, 2024년에 걸쳐 두 회사 안에서 같은 방향의 문장이 여러 번 쓰였어요. 그러고도 방향은 바뀌지 않았어요.

요즘 AI를 도입하는 기업들이 자주 만드는 자리가 있어요. 윤리위원회, 레드팀, 책임 있는 AI 담당 같은 자리요. 저는 이런 자리가 필요하다고 봐요. 다만 이번 사례가 보여주는 건, 반대 의견을 내는 자리를 만드는 일과 그 의견이 결정에 닿는 경로를 만드는 일은 전혀 다르다는 점이에요. 경로가 없으면 그 메모는 몇 년 뒤 법정에서, 그것도 상대편 증거로 처음 제대로 읽혀요.

그래서 저는 조직에 이렇게 먼저 물어보는 편이 낫다고 생각해요. “이건 우리 공급망을 망가뜨린다”는 메모가 올라오면, 그 메모는 누구 책상에서 멈추는가.

마치며

이번 문서가 판결을 정하지는 않아요. 발췌는 맥락이 빠져 있고, 법원은 여전히 공정 이용 쪽에 기울어 있어요. 다만 AI 회사 안에서 쓰인 문장들이 바깥의 비판보다 문제를 더 정확하게 짚고 있었다는 건 남아요. 절도라는 단어보다, 공급망이라는 단어가요.


💬 구독자님 조직에서는 내부의 반대 의견이 결정하는 자리까지 가는 경로가 있나요? 그 경로를 타고 방향이 실제로 바뀐 경험, 혹은 끝내 도착하지 못했던 경험이 있다면 댓글로 들려주세요.

📨 AI 도입이나 콘텐츠 사업을 고민하는 동료가 있다면 이 글을 전달해 주세요.


여러분의 생각이 다음 호를 만듭니다

이번 호에서 가장 공감했거나, 다른 경험을 한 지점은 무엇인가요?

댓글은 무료 회원이면 누구나 남길 수 있어요.

커피 한 잔 보내기

이 관점이 좋았다면, 다음 글에 커피 한 잔

오스왈드에게 커피와 함께 짧은 쪽지를 보내주세요. 응원은 다음 취재와 집필에 보탭니다.

오스왈드에게

커피와 쪽지 보내기

“공급망을 무너뜨리는 제품이라고, 만든 쪽이 먼저 적었어요”을 읽고 떠오른 말을 남겨주세요. 메뉴 이름만큼의 응원금과 함께 전달됩니다.

참고자료 & 더 읽기

핵심 출처

함께 읽으면 좋은 지난 호


안광섭(오스왈드) 프로필 일러스트

필자 안광섭 (오스왈드)은 세종대학교 겸임교수, INLEVEL9 전략 컨설턴트입니다. 경력, 연구, 저서와 최신 활동은 저자 소개에서 계속 갱신합니다. 최근 소식 · 2026년 8월: 2026 세종도서 교양부문 우수도서 선정.

📝 용어 설명

각주

  1. 약식 판결(summary judgment): 사실관계에 실질적인 다툼이 없다고 볼 때, 정식 재판(배심 심리)까지 가지 않고 판사가 법률 문제만으로 판단을 내리는 절차예요. 양측이 이 단계에서 자기에게 유리한 증거를 적극적으로 내놓기 때문에, 봉인됐던 문서가 이때 드러나는 경우가 많아요. ↩

  2. 커먼크롤(Common Crawl): 웹 페이지를 대규모로 수집해 무료로 공개하는 비영리 아카이브예요. 많은 AI 연구소가 학습 데이터의 출발점으로 써요. ↩

  3. 공정 이용(fair use): 미국 저작권법에서 비평, 보도, 패러디 등 일정한 경우 허락 없이 저작물을 쓸 수 있게 하는 원칙이에요. 이용의 목적과 성격, 원저작물의 성격, 이용한 분량, 원저작물 시장에 미치는 영향 네 가지를 함께 따져요. ↩