AI 안전비즈니스 및 시장 🇷🇺 07.08.2026 17:01

AI에 잘못된 파일 업로드 — 해고. AI에서 데이터 보안이 작동하는 방식

DeepSeekDeepSeek OpenAIOpenAI Google/DeepMindGoogle/DeepMind
직원들이 기업 데이터를 공개 AI 서비스에 업로드하는 경우가 늘고 있으며, 규칙이나 데이터 흐름에 대한 이해 없이 이루어지는 경우가 많습니다. 최근 사례로, 한 임원이 DeepSeek에 업무 문서를 업로드했다가 해고되었습니다. 이 기사는 데이터가 어디로 가는지, 누가 볼 수 있는지, 그리고 삭제가 종종 되돌릴 수 없는 이유를 설명합니다.
Daria Lushkina의 RuNet Rating 기사는 신경망 사용 시 데이터 보안을 분석한다. 이 기사는 한 연구를 언급하며, 2025년에 러시아 기업 150곳의 직원들이 공개 AI 서비스에 1년 전보다 30배 더 많은 기업 데이터를 업로드했고, 기업의 60%는 AI 사용 규칙이 없다고 밝혔다. 7월에는 모스크바의 한 엔지니어링 회사의 고위 임원이 DeepSeek에 업무 문서를 업로드한 이유로 해고되었고, 법원은 사용자 측의 손을 들어주었다. 기사는 데이터 처리 파이프라인을 자세히 설명한다: 파일이 파싱되고, 텍스트가 추출되며, 조각으로 분할되고, 임베딩으로 변환되어 로그와 저장소에 흔적을 남긴다. 데이터는 저장, 로그, 제3자 체인 및 훈련 과정에서 취약할 수 있다. 삭제는 복잡하다: 대화를 삭제해도 모든 복사본이 삭제되지 않으며, 데이터가 훈련에 사용된 경우 그 영향은 되돌릴 수 없다. 기사는 또한 기계 언러닝을 연구 방향으로 다룬다. 인간 검토자가 대화를 검토할 수 있다는 점(예: Google의 Gemini)과 클라우드 제공업체와 같은 인프라 파트너가 접근 권한을 가진다는 점을 언급한다. 2023년 DeepSeek 데이터 유출 사건에서 백만 개 이상의 채팅 로그와 키가 노출된 점을 언급한다. 삼성 엔지니어들은 소스 코드를 ChatGPT에 보냈고, 미국 사이버보안 기관장은 민감한 문서를 업로드했다. 저자는 주의를 기울이고 데이터 정책을 이해할 것을 조언한다.
출처: Habr — хаб ИИ — 원문
관련 게시물 ↓
새로운 뉴스