OpenAI, AI의 비공개 풀이 기록을 빼내려는 조직적 시도 차단

디플릭 Editorial

🗓️ 2026.10.06

Hero Image
© AI Image

OpenAI가 9월 30일 AI의 비공개 풀이 기록을 조직적으로 빼내려는 시도를 차단했다고 발표했습니다. 수집한 기록으로 다른 AI를 학습시키려는 활동으로 판단했습니다.

이번 발표의 초점은 대화창에 보이는 답변 뒤의 내부 기록입니다. OpenAI는 저장된 이용자 대화에 직접 침입한 사건과는 구분했습니다.

🔎 추출 시도를 막고, 관련 활동군을 조사했습니다

공개된 1만 6,000건은 추출 시도 횟수이며, 성공 건수는 미공개입니다. 아래는 회사가 발표한 관찰·차단 일정입니다.

OpenAI는 핵심 활동군을 AI 서비스 Kimi의 개발사인 문샷AI 관련 인물들과 연결했습니다. 전체 배후는 불확실하다는 회사 판단입니다.

Hero Image
자료: OpenAI · D.Flick 정리

📓 ‘정답’보다 ‘풀이 노트’를 노렸습니다

모델의 답변이나 풀이를 학습 자료로 삼아 다른 모델을 개선하는 방식을 ‘증류’라고 부릅니다. 이번 사건에서는 허가 없이 비공개 기록을 추출하려 했다는 점이 문제가 됐습니다.

OpenAI가 인용한 독립 연구는 왜 이런 기록이 표적이 되는지 설명합니다. 일부 AI 서비스는 다음 대화에서도 앞선 작업을 이어갈 수 있도록 내부 기록을 암호화된 데이터로 전달합니다. 읽을 수 없는 형태로 포장된 풀이 노트를 다음 요청에 다시 첨부하는 셈입니다.

연구진은 이 데이터가 서로 다른 대화·사용자·모델 사이에서 통용되는 구조를 취약점으로 지목했습니다. 보호가 상대적으로 약한 모델을 통해 숨겨진 기록을 드러낼 수 있었다는 설명입니다.

논문은 답변에서 차단한 위험한 정보가 중간 기록에 포함될 수 있고, 공개된 작업 로그 속 암호화 데이터에도 개인정보나 인증 정보가 남을 수 있다고 보고했습니다. 겉으로 읽을 수 없다는 이유만으로 안전한 공개 자료로 취급하기 어렵다는 뜻입니다.

이 연구는 관련 기술적 위험을 다룹니다. 특정 회사가 이번 활동을 지시했다는 사실을 입증하는 자료로 확대해서 읽을 수는 없습니다.

Hero Image
자료: 관련 보안 연구 · D.Flick 정리

🛠️ 계정과 기록의 보호 조치를 강화했습니다

OpenAI는 관련 계정을 제한하고 다른 이용자의 암호화된 기록을 재입력해 내용을 얻는 경로를 차단했다고 설명했습니다. 출력 검사와 파트너 협력도 강화하고 있습니다.

Hero Image
© OpenAI · 공식 발표
D.Flick Perspective

D.Flick Note

이번 소식은 AI가 보여주는 답변과 그 답변을 만드는 중간 기록을 나눠 보게 합니다. 이용자 화면에서 숨긴 정보도 서비스 사이를 오갈 때는 별도의 보호가 필요합니다.

References

  • 자료 확인일: 2026.10.01. 사건과 배후에 관한 설명은 OpenAI의 발표를 바탕으로 하며, 연구 논문은 기술적 배경으로 참고했습니다.



다양한 아티클을 확인해보세요