동찰 Beating AI 속보, 404 Media가 입수한 내부 자료에 따르면, OpenAI는 'Project Lily'라는 코드명의 프로젝트를 통해 수백 명의 외주 인력이 실제 사용자와 ChatGPT의 대화를 읽도록 하여 모델 훈련 및 개선에 활용하고 있다. 검토자는 사용자 이름을 볼 수 없지만 전체 대화를 볼 수 있다. 일부 작업에는 사용자의 '기억 요약'이 첨부되기도 하는데, 여기에는 이전에 무엇을 이야기했는지, 어디에 거주할 가능성이 있는지 등의 정보가 포함된다.
이들은 먼저 사용자가 무엇을 하려는지 요약한 다음, ChatGPT가 생성한 여러 답변을 비교하고 1점에서 7점까지 점수를 매긴다. 검토 중점 사항에는 사실이 정확한지, 사용자에게 지나치게 동조하는지, 그리고 ChatGPT가 자신을 너무 인간처럼 묘사하는지가 포함된다.
OpenAI는 먼저 Privacy Filter로 이름, 연락처 등 개인정보를 제거하지만, 이 모델이 흔치 않은 신원 정보와 모호한 사적 정보를 놓칠 수 있다는 점도 공식적으로 인정했다. 일부 민감한 내용은 여전히 검토자 앞에 나타날 수 있다.
모든 ChatGPT 대화가 사람에 의해 읽히는 것은 아니다. 개인용 Free, Plus, Pro는 기본적으로 '모든 사용자를 위한 모델 개선'이 켜져 있으며, 사용자가 끄면 새 대화는 더 이상 훈련에 사용되지 않는다. Business, Enterprise, Edu는 기본적으로 훈련에 사용되지 않는다.
