Hugging Face는 최근 자사의 프로덕션 인프라가 자율 AI 에이전트 시스템을 이용한 공격에 의해 침해되어 내부 데이터셋과 자격 증명이 유출되었다고 밝혔다. Hugging Face는 45,000개 이상의 AI 모델을 제공하는 오픈소스 AI 및 머신러닝 플랫폼으로, 50,000개 이상의 조직이 사용 중이다. 현재 파트너 및 고객 데이터가 영향을 받았는지 조사 중이며, 영향이 확인될 경우 직접 연락할 예정이라고 밝혔다. 현재까지 공개된 모델, 데이터셋, Spaces에는 변조 흔적이 없으며, 소프트웨어 공급망도 안전하다고 확인했다.
공격은 데이터 처리 파이프라인에서 시작되었으며, 공격자는 악성 데이터셋을 이용해 두 가지 코드 실행 취약점을 악용하여 클라우드 및 클러스터 자격 증명을 탈취하고 내부 클러스터로 이동했다. 이 공격은 수천 건의 개별 행위를 수행하는 자율 에이전트 프레임워크를 통해 이루어졌으며, 명령 및 제어는 공용 서비스에 분산되어 있었다. Hugging Face는 취약점 경로를 차단하고, 공격자를 퇴출했으며, 손상된 노드를 재구축하고 모든 영향을 받은 자격 증명을 회수 및 교체했다. 또한 악성 활동 탐지 시스템을 강화하고, 법 집행기관에 신고했으며, 외부 포렌식 전문가와 함께 추가 조사를 진행 중이다.
Hugging Face는 사용자들에게 액세스 토큰을 교체하고 최근 계정 활동을 점검할 것을 권고했다. 이번 사건은 AI 에이전트가 연루된 첫 보안 사고이지만, 과거에도 Spaces 플랫폼 침해 등 여러 보안 문제가 있었다. 최근 몇 년간 악성 AI/ML 모델, 인포스틸러 악성코드, 안드로이드 악성코드 유포 등 다양한 위협 행위가 플랫폼을 통해 발생한 바 있다.
※ 이 글은 생성형 AI(gpt4.1)에 의해 요약되었습니다.