OpenAI가 수학자들의 미공개 연구를 Codex 학습에 무단 활용했다는 의혹 제기
원문 보기 · Reddit r/LocalLLaMA두 수학자가 1년간 비공개로 진행한 난제 연구 초안을 Codex에 입력했는데, 발표 직전 OpenAI가 동일한 해법을 내놨다는 의혹이 Reddit을 통해 제기됐다. OpenAI는 해당 모델이 두 사람의 비공개 대화를 학습했는지 여부에 답하지 않은 것으로 전해진다.
발췌에 따르면 두 수학자가 어려운 수학 문제를 풀기 위해 초안을 계속 Codex에 입력하며 작업했고, 발표를 앞둔 시점에 OpenAI가 동일한 해법을 제시했다는 주장이다. 이들은 모델이 자신들의 비공개 대화 내용을 학습에 사용했는지 질문했지만 OpenAI로부터 명확한 답을 받지 못했다고 한다. 관련 성명서 링크가 공유됐으나 성명서 자체의 구체적 내용은 발췌에 포함되어 있지 않다.
이는 AI 서비스 이용약관상 사용자 입력 데이터의 학습 활용 여부와 옵트아웃 정책이라는 오래된 논쟁과 연결된다. 다수 AI 업체는 기업용·API 요금제에서는 학습 미활용을 약속하지만, 소비자용 서비스나 특정 제품에서는 정책이 다르거나 불명확한 경우가 있어 왔다. 연구자·개발자가 미공개 성과물을 클라우드 AI 도구에 입력하는 관행 자체의 위험성이 다시 부각되는 사례다.
실무적으로는 연구기관·기업이 AI 도구 이용약관에서 입력 데이터의 학습 활용 범위와 옵트아웃 조항을 재점검할 필요가 있다. 특히 미공개 연구·영업비밀·발명 아이디어를 다루는 부서라면 로컬 모델 사용이나 학습 비활용이 계약상 명시된 엔터프라이즈 플랜 채택 여부를 검토하는 것이 합리적이다. 저작권·영업비밀 침해 주장이 실제 소송으로 이어질 경우 학습데이터 출처 입증 책임 문제도 쟁점이 될 수 있다.
현재까지는 당사자 성명과 커뮤니티 게시물 수준의 주장이며, OpenAI의 공식 반박이나 조사 결과, 사실관계에 대한 제3자 검증은 발췌만으로는 확인되지 않는다. 성명서 원문과 OpenAI의 후속 대응을 확인할 필요가 있다.
본문은 수집한 기사의 제목과 발췌를 바탕으로 AI가 정리한 해설입니다. 원문 전체를 옮긴 것이 아니므로 수치·날짜·조문 등 세부 사실은 위 원문 링크에서 확인하세요. 개별 사안에 대한 법률·세무·노무·회계·의료 자문을 대체하지 않습니다.
법률 실무를 강의로 이어서 학습하세요
읽은 주제를 실무 절차로 옮기는 과정은 전문가 강의에서 다룹니다. 분야별 커리큘럼과 수강 현황을 강의 페이지에서 확인할 수 있습니다.

