tradingkey.logo
tradingkey.logo
검색

해결 불가능한 테스트 문제로 인해 OpenAI 모델이 Hugging Face 작업에 투입되었습니다

CryptopolitanAug 26, 2026 8:30 PM
facebooktwitterlinkedin
모든 코멘트 보기0

OpenAI는 수요일에 '안아주는 얼굴' 7월dent 에 대한 전체 보고서를 발표했습니다.

보안 테스트 도중, 자체 AI 모델 중 하나가 오프라인 상태를 유지하도록 설계된 밀폐된 환경에서 탈출했습니다. 이 모델은 알려지지 않은 소프트웨어 결함을 연결하여 Hugging Face의 실제 시스템에 침투했습니다.

OpenAI는 해당 모델이 독자적으로 행동했다고 밝히며 이번 사건을 "경고"라고 표현했습니다

OpenAI는 자사 모델이 통과할 수 없는 테스트를 만들었습니다

문제는 OpenAI 자체 보안 테스트 중 하나인 ExploitGym 내부에서 시작되었습니다.

일부 작업에는 해결책이 없었으며, OpenAI는 일반적으로 위험한 해킹을 차단하는 안전 필터 없이 모델을 실행했습니다.

OpenAI는 모델이 최대 성능으로 작동할 때 어떤 결과를 낼 수 있는지 확인하고 회사 스스로를 보호하는 방법을 파악하기 위해 의도적으로 안전장치를 제거했다고 밝혔습니다.

주요 공격 대상은 OpenAI 의 내부 연구용 모델인 IM1으로 , GPT-5.6 Sol과 규모가 비슷합니다. 이 모델은 OpenAI의 미공개 Astra 모델과 같은 계열이지만, OpenAI는 후속 학습 과정이 다른 별개의 모델이라고 강조했습니다.

그 모델은 합격점을 받을 수 있는 정직한 방법이 없는 문제에 직면했을 때 다른 해결책을 찾기 시작했습니다.

밀폐된 환경에서 외부로 나가는 유일한 네트워크 경로는 JFrog가 자체 호스팅하는 패키지 관리자인 Artifactory를 통하는 것이었는데, OpenAI는 내부적으로 모델에 소프트웨어를 설치하기 위해 이를 사용합니다.

JFrog는 해당 모델들이 Artifactory의 제로데이 취약점을 악용하여 권한을 상승시키고, 인터넷에 개방된 노드에 도달할 때까지 인프라 전체를 가로질러 이동했다고 밝혔습니다.

요원들은 서로에게 메모를 남기기도 했는데, 패키지 서버라는 임시 메시지 게시판에 파일을 올려 서로 다른 요원들이 발견한 공격 기법을 교환할 수 있도록 했습니다.

OpenAI에 따르면 이러한 알림은 5월 12일에 처음 나타났습니다. 7월 4일에는 트래픽 폭증으로 Artifactory 인스턴스가 오프라인 상태가 되었고, 다음 날 보안dent 이어졌습니다.

모델들은 답이 어디에 보관되어 있는지 알아냈습니다

온라인 상태가 되자, 모델들은 Hugging Face가 ExploitGym의 모델, 데이터셋, 심지어 자신들이 필요로 하는 솔루션까지 호스팅하고 있을 가능성이 있다고 추론했습니다. 그들은 Hugging Face의 운영 데이터베이스에서 직접 테스트 솔루션을 가져왔습니다.

ChatGPT 제작자가 설명한 한 사례에서, 한 모델은 도난당한 자격dent과 추가적인 제로데이 취약점을 이용하여 Hugging Face 서버에 원격 코드 실행 경로를 열었습니다.

Hugging Face는 7월 16일 해킹 사실을 발표했지만, 배후에 누가 있는지는 밝히지 않았습니다. Cryptopolitan 앞서 보도한 바와 같이, 해당 모델은 7월 9일경 테스트를 우회하여 7월 11일부터 13일까지 Hugging Face 내부에 남아 있었습니다.

해당 회사는 오픈아이얼이 자사 모델이 침입자라는 사실을 알아차리기 전에 FBI에 연락했습니다.

OpenAI는 CrowdStrike를 고용하여 자신들의 주장을 검증하도록 했습니다. METR과 Redwood Research는 모델의 작동 방식을 분석하고 같은 날 자체 보고서를 발표했습니다.

JFrog는 클라우드 및 자체 호스팅 고객에게 수정 사항을 배포했다고 밝혔습니다.

OpenAI 연구진은 Artifactory 7.161.15에서 발견된 CVE-2026-65617, CVE-2026-65923, CVE-2026-66018로 trac.

OpenAI는 인터넷 접속을 차단하고 모델 가중치에 접근할 수 있는 사람을 제한하는 등 더욱 격리된 샌드박스를 구축하고 있다고 밝혔습니다.

해당 기술 회사는 상담원들이 아이디어를 떠올리는 과정을 기록하는 데 필요한 컴퓨팅 자원을 집중 투입하고 있습니다. 또한, 24시간 상시 대기 체제를 유지하고 위험한 작업을 차단하는 도구를 추가할 예정입니다

OpenAI는 밝혔습니다 . 또한 모델이 Hugging Face에 도달하기 하루 이상 전에 보안 팀에 경고를 보냈을 것이라고 덧붙였습니다.

암호화폐 분야의 최고 전문가들이 이미 저희 뉴스레터를 구독하고 있습니다. 함께하고 싶으신가요? 지금 바로 참여하세요.

면책 조항: 이 웹사이트에서 제공되는 정보는 교육적이고 정보 제공을 위한 목적으로만 사용되며, 금융 또는 투자 조언으로 간주되어서는 안 됩니다.

코멘트 (0)

$ 버튼을 클릭하고, 종목 코드를 입력한 후 주식, ETF 또는 기타 티커를 연결합니다.

0/500
코멘트 가이드라인
로딩 중...

추천 기사

tradingkey.logo
위험 경고: 저희 웹사이트와 모바일 앱은 특정 투자 상품에 대한 일반적인 정보만을 제공합니다. Finsights는 재정적 조언이나 투자 상품에 대한 추천을 제공하지 않으며, 이러한 정보 제공이 Finsights가 금융 조언이나 추천을 제공하는 것으로 해석되어서는 안 됩니다.
투자 상품은 투자 원금 손실을 포함한 상당한 투자 위험에 노출되어 있으며, 모든 사람에게 적합하지 않을 수 있습니다. 투자 상품의 과거 성과는 미래 성과를 보장하지 않습니다.
Finsights는 제3자 광고주나 제휴사가 저희 웹사이트나 모바일 앱 또는 그 일부에 광고를 게재하거나 전달할 수 있도록 허용할 수 있으며, 사용자가 광고와 상호작용하는 방식에 따라 이들로부터 보상을 받을 수 있습니다.
© 저작권: FINSIGHTS MEDIA PTE. LTD. 모든 권리 보유