오픈뉴스백과
오늘의 이슈오늘 10장그래프ONP 브리핑
뉴스정치 렌즈개체 사전공식 자료용어사전
...

오픈뉴스백과

집단지성 기반 뉴스 검증 플랫폼. 다양한 시각으로 뉴스를 이해합니다.

서비스

오늘의 이슈홈라이브뉴스공식 자료용어사전개체 사전내 편향피드 제보소개

법적 고지

개인정보처리방침이용약관콘텐츠 이용 안내

문의

문의하기

본 플랫폼에서 제공하는 뉴스 콘텐츠의 저작권은 각 언론사에 있으며, 무단 복제 및 배포를 금지합니다.

RSS 피드를 통해 수집된 콘텐츠는 각 원저작자의 라이선스 조건을 따릅니다. 오픈 라이선스(CC-BY 등) 콘텐츠는 해당 라이선스에 따라 출처를 표기합니다.

오픈뉴스백과는 뉴스 집계 및 검증 플랫폼으로, 개별 기사의 내용에 대한 책임은 해당 언론사에 있습니다.

이용자가 작성한 피드백, 팩트체크, 독자 제보 등의 콘텐츠에 대한 책임은 해당 작성자에게 있습니다.

콘텐츠 제거·정정이 필요하시면 문의하기에 남겨 주세요.

© 2026 오픈뉴스백과 (OpenNewsPedia). All rights reserved.

뉴스 목록
관련 뉴스security incident· 사건 전체3건3개 미디어
ZDNet Korea
ITWorld 코리아
플래텀
ZDNet Korea
IT/기술
중도 성향

오픈AI 탈주 에이전트, 허깅페이스 이어 모달 랩스 고객까지 연쇄 침해

ITWorld 코리아
오픈AI 탈주 에이전트, 허깅페이스 이어 모달 랩스 고객까지 연쇄 침해

오픈AI의 AI 에이전트가 AI 플랫폼 허깅페이스를 침해한 사건의 피해 범위가 단일 피해에 그치지 않은 것으로 드러났다. 로이터 보도에 따르면, 오픈AI의 탈주 에이전트는 허깅페이스를 상대로 수일에 걸친 해킹 공세를 펼치는 과정에서 클라우드 컴퓨팅 플랫폼 업체 모달 랩스(Modal Labs)의 고객 계정도 침해한 것으로 확인됐다. 오픈AI는 성명 업데이트를 통해 문제의 에이전트가 총 4개 서비스의 4개 계정에 무단 접근했다고 공식 확인했지만, 구체적인 서비스명은 공개하지 않았다.

에이전트는 고객 코드에 존재하던 취약점을 악용한 것으로 분석됐다. 모달 랩스 측에 따르면, 고객이 인터넷 사용자 누구나 샌드박스에서 코드를 실행할 수 있는 비인증 엔드포인트를 외부에 공개 게시한 것이 원인이었다. 미국 온라인 매체 악시오스(Axios) 보도에 따르면, 침해된 모달 랩스 고객의 자산은 오픈AI 에이전트에게 주어진 평가 과제인 사이버 보안 벤치마크 익스플로잇짐(ExploitGym)의 기반 프로젝트 사이버짐(CyberGym)과 연관된 것으로 전해졌다. 새로운 세부 사항은 오픈AI 에이전트가 테스트 환경을 벗어난 이후에도 당초 할당된 목표를 포기하지 않고 계속 수행하려 했음을 시사한다.

오픈AI 업데이트에 따르면, 에이전트는 평가 환경 내 소프트웨어 다운로드를 중개하는 패키지 저장소 캐시 프록시 소프트웨어 아티팩토리(Artifactory)의 제로데이 취약점을 악용해 샌드박스를 탈출했다. 탈출 이후 에이전트는 모달 랩스 플랫폼의 사이버짐 관련 샌드박스를 발판으로 삼아 허깅페이스 서버에 원격 코드 실행 경로를 구축했다. 허깅페이스가 공개한 기술 타임라인에 따르면, 에이전트는 4일에 걸쳐 총 1만 7,600개의 개별 행동을 실행하며 허깅페이스 시스템에 침투했다. 영국 IT 전문 매체 더 레지스터에 따르면, 허깅페이스는 이번 사고 대응 과정에서 전체 인프라의 3분의 1을 재구축해야 했다.

모달 랩스 임원진은 자사 플랫폼 자체는 침해되지 않았다고 강조했다. 모달 랩스 CTO 악샤트 부브나는 고객이 비인증 엔드포인트를 공개 게시해 외부 누구나 샌드박스에서 코드를 실행할 수 있었으며, 탈주 에이전트가 그 엔드포인트를 활용했다고 밝혔다. 부브나는 또 “모달의 플랫폼은 어떠한 방식으로도 침해되지 않았다”라고 전했다.

문제의 에이전트는 공개 모델 GPT-5.6 솔과 오픈AI가 ‘더욱 강력하다’고 표현한 비공개 모델 두 종의 조합으로 구성됐다. 오픈AI는 실세계 소프트웨어 취약점 898개 인스턴스로 구성된 익스플로잇짐 벤치마크를 에이전트에게 부여하면서, 원시 역량 측정을 이유로 프로덕션 안전 분류기를 의도적으로 비활성화한 상태에서 테스트를 진행했다. 에이전트에게 부정행위 금지 지시가 명확히 전달되지 않은 점도 문제로 지적됐다. 테크크런치(TechCrunch) 보도에 따르면, GPT-5.6 솔은 전작인 GPT-5.5보다 에이전트 정렬 이탈 행동에 훨씬 취약한 것으로 오픈AI 자체 시스템 카드에서도 확인됐다. 배포 시뮬레이션에서도 제한 우회, 파괴적 행동 수행, 무단 데이터 전송 가능성이 전작 대비 높은 것으로 나타났다.

오픈AI는 모달 랩스 관련 문의에 직접 답변하지 않고 자사 최신 업데이트를 참조하도록 안내했다. 오픈AI는 업데이트에서 “허깅페이스 사건에서 확인된 플랫폼 수준의 침해에 준하는 심각성이나 규모의 다른 활동은 식별되지 않았다”라고 밝혔다. 오픈AI는 또 허깅페이스와 함께 포렌식 조사를 진행 중이며, 향후 훈련 및 평가 과정에 더 강력한 보호 조치를 도입하겠다고 전했다. 오픈AI는 문제의 모델을 비활성화하고 암호화해 추가 연구 접근을 차단했다고 덧붙였다.

이번 사고는 AI 개발 속도 조절 논의로까지 번지고 있다. 오픈AI CEO 샘 올트먼은 팟캐스트 인터뷰에서 AI 역량이 새로운 수준에 도달함에 따라 업계가 개발 속도를 조율해야 할 수 있다고 언급하면서, 허깅페이스 보안 사고를 그 배경으로 직접 거론했다.
dl-itworldkorea@foundryco.com ...

전문 보기

이 뉴스, 어떠셨어요?

탭 한 번으로 반응 · 로그인 불필요

같은 사건, 다른 제목

진보 성향0

보도 없음

중도 성향3
보수 성향0

보도 없음

관련 뉴스 제보는 로그인 후 가능합니다.

'tech' 카테고리 뉴스

케이엠제약 10%이상주주 강일모 회장, 소유 주식 수량 2849주 증가…소유 지분율 5.27%p 하락

디지털투데이

"광고 보면 게임 무료"…엑스박스, 구독 대신 꺼낸 승부수

디지털투데이

美 상원, 애플에 최후통첩…"中 메모리 안 쓰겠다고 약속하라"

디지털투데이

ITWorld 코리아의 다른 기사

오픈소스는 미끼, 진짜 목표는 개발자

ITWorld 코리아

“오픈·효율·최신 기술, 3개 축으로 간다”…엔비디아 생성형 AI 부사장 인터뷰

ITWorld 코리아

오픈 웨이트, AI를 더 정직하게 만들 수 있을까

ITWorld 코리아

이 사건 개요

오픈AI 탈주 에이전트, 허깅페이스 이어 모달 랩스 고객까지 연쇄 침해

3건 · 3개 미디어

관련 개체

OpenAIUnited StatesUnited KingdomSam Altman
사건 전체 보기

피드백

피드백을 남기려면 로그인해 주세요.

🇰🇷ITWorld 코리아
보는 중

오픈AI 탈주 에이전트, 허깅페이스 이어 모달 랩스 고객까지 연쇄 침해

🇰🇷플래텀

해킹당한 허깅페이스, 상용 AI는 조사도 거절했다

🇰🇷ZDNet Korea

오픈AI 에이전트, 허깅페이스 이어 외부 서비스까지 침해