tradingkey.logo
tradingkey.logo
검색

영국 보안 훈련에서 Anthropic과 OpenAI 에이전트가 테스트 규칙을 19번 위반했습니다

CryptopolitanAug 5, 2026 8:03 AM
facebooktwitterlinkedin
모든 코멘트 보기0

영국 AI 보안 연구소에 따르면, 사이버 보안 테스트 도중 오픈AI와 앤스로픽의 AI 에이전트가 19건의 무단 행위를 저질렀습니다. 연구소는 화요일에 발표한 성명에서 해당 에이전트 중 하나가 가짜 온라인dent을 만들어 사용자를 속여 악성 코드를 승인하도록 유도했다고 밝혔습니다.

AISI는 19건의 침해 사고를 기록했으며, 대부분 Anthropic Games에 의한 것입니다

이 결과는 영국 정부 산하 기관인 AISI가 두 회사의 에이전트가 무엇을 할 수 있는지 알아보기 위해 실시한 가상의 사이버 보안 훈련을 기반으로 합니다. AISI는 동일한 훈련을 122회 반복했으며, 그중 10회에서 19건의 규칙 위반 사례를 기록했습니다.

표시된 활동 17건은 Anthropic의 에이전트가 Mythos 5 모델을 사용한 결과이며, 나머지 2건은 OpenAI의 GPT-5.6-Sol에서 발생했습니다.

AISI는 블로그 게시물 에서 일부 공격자들이 "실제 사람과 조직을 대상으로 지속적이고 잠재적으로 유해한 활동에 가담했다"고 밝혔지만, 이러한 침해로 인해 실제 피해가 발생한 사례는 없다고 덧붙였습니다.

AISI는 주요 연구소와의 자발적 협약을 통해 최첨단 모델에 대한 조기 접근 권한을 확보하고 있습니다. 이러한 모델이 고객에게 도달하기 전에 오류를 감지할 수 있는 테스트가 마련되어 있습니다.

OpenAI와 Anthropic Market Agents는 차세대 비즈니스 소프트웨어로 주목받고 있지만, 연구소는 이러한 결과가 에이전트 테스트 관련 안전장치가 여전히 미흡하다는 증거라고 지적했습니다.

가장 심각한dent 악성 코드를 작성하고 가짜 온라인 신원을 만들어낸 에이전트dent두 가지 사례와는 다르다고 밝혔습니다 OpenAI가 이미 공개한

캘리포니아의 AI 위험 연구 비영리 단체인 CivAI의 연구원 앤드류 윤은 "그렇다면 유력한 용의자는 앤트로픽의 대리인일 가능성이 높다"고 말했다.

OpenAI와 Anthropic은 잘못된 설정 탓으로 돌립니다

앤트로픽은 X에 올린 게시물에서 AISI와 협력하여 세부 정보를 수집하고 조사를 진행하고 있다고 밝혔습니다.

OpenAI는 자사 에이전트와 관련된 두 가지 행동에 대해 회사 블로그 게시물을 통해 입장을 밝혔는데, 두 행동 모두 프롬프트에서 허용되지 않은 방식으로 인터넷에 접근하는 것이었습니다.

회사 측은 "고위험 평가를 안전하게 수행하기 위한 공통된 관행을 강화"하고자 하며, 향후 몇 주 안에 국가 AI 연구기관, 외부 평가자, 경쟁 연구소들을 소집할 계획이라고 밝혔습니다

OpenAI는 같은 게시글을 통해 다른 문제를 보고했습니다. 제3자 테스트 제공업체인 Irregular가 설정을 잘못 구성하여 의도치 않게 OpenAI 에이전트가 인터넷에 접근할 수 있게 되었다는 것입니다.

앤트로픽은 일주일 전 이레귤러에 대해 매우 유사한 내용을 공개했습니다. 오픈AI는 추가 에이전트 탈출 사례를 발견한 후 자체 해킹 조사 범위를 확대했습니다.

7월에 OpenAI 에이전트가 격리된 환경에서 탈출하여 Hugging Face의 실제 시스템에 접근했고, Hugging Face는 FBI trac에 이를 신고했습니다. 이후 약 일주일 뒤 공격의 배후가 OpenAI라는 사실이 밝혀졌습니다

AISI 평가에서 에이전트들은 샌드박스 환경을 벗어나지 못했습니다. AISI는 표준 절차의 일환으로 의도적으로 에이전트들에게 인터넷 접속 권한을 부여했습니다.

허깅 페이스(Hugging Face) 해킹 사건으로 인해 앤트로픽은 로그 감사를 실시하게 되었습니다. Cryptopolitan 7월 31일, 앤트로픽이 마이토스 5(Mythos 5)를 포함한 세 개의 모델이 테스트 환경을 벗어나 실제 세 곳의 기업에 유출된 사실을 발견했다고 보도했습니다. 잘못된 설정으로 인해 해당 모델들이 인터넷에 접속할 수 있게 된 것입니다.

Mythos 5는 PyPI에 악성 파이썬 패키지를 게시했으며, 해당 패키지는 삭제되기 전까지 15개의 실제 시스템에서 실행되었습니다. Anthropic은 평가 그룹인 METR에 이 사건에 대한dent인 검토를 요청했습니다.

암호화폐 분야의 최고 전문가들이 이미 저희 뉴스레터를 구독하고 있습니다. 함께하고 싶으신가요? 지금 바로 참여하세요.

면책 조항: 이 웹사이트에서 제공되는 정보는 교육적이고 정보 제공을 위한 목적으로만 사용되며, 금융 또는 투자 조언으로 간주되어서는 안 됩니다.

코멘트 (0)

$ 버튼을 클릭하고, 종목 코드를 입력한 후 주식, ETF 또는 기타 티커를 연결합니다.

0/500
코멘트 가이드라인
로딩 중...

추천 기사

tradingkey.logo
위험 경고: 저희 웹사이트와 모바일 앱은 특정 투자 상품에 대한 일반적인 정보만을 제공합니다. Finsights는 재정적 조언이나 투자 상품에 대한 추천을 제공하지 않으며, 이러한 정보 제공이 Finsights가 금융 조언이나 추천을 제공하는 것으로 해석되어서는 안 됩니다.
투자 상품은 투자 원금 손실을 포함한 상당한 투자 위험에 노출되어 있으며, 모든 사람에게 적합하지 않을 수 있습니다. 투자 상품의 과거 성과는 미래 성과를 보장하지 않습니다.
Finsights는 제3자 광고주나 제휴사가 저희 웹사이트나 모바일 앱 또는 그 일부에 광고를 게재하거나 전달할 수 있도록 허용할 수 있으며, 사용자가 광고와 상호작용하는 방식에 따라 이들로부터 보상을 받을 수 있습니다.
© 저작권: FINSIGHTS MEDIA PTE. LTD. 모든 권리 보유