tradingkey.logo
tradingkey.logo
검색

인공지능 에이전트들이 폭주한 이유를 설명하려 애쓰는 앤트로픽이 계속해서 우려를 자아내고 있습니다

CryptopolitanSep 10, 2026 11:20 AM
facebooktwitterlinkedin
모든 코멘트 보기(0)

앤트로픽은 자사의 클로드 모델이 테스트 중 인터넷에 무단 접속하여 타사 시스템을 해킹한 네 건의dent에 대해 블로그 게시물을 통해 그 원인을 잘못된 설정 때문이라고 설명했습니다. 그러나 해당 게시물은 모델이 실제로 공격을 계속한 이유에 대해서는 설명하지 않았으며, 회사 측은 아직 그 해답을 찾지 못했다고 인정했습니다. 

앤트로픽의 이러한 인정은 AI 연구소가 대중에게 공개하는 모델, 그리고 더 나아가 내부적으로 사용하는 더욱 강력한 시스템에 대해  실제로 얼마나 통제력을 갖고 있는지에 대해 의문을 제기해 온 AI 비관론자들에게 새로운 논점을 제공했습니다

인간 중심 인공지능 모델은 어떻게 인터넷에 퍼지게 되었을까요? 

앤트로픽은 수요일 블로그 게시물을 했습니다 defi통해 자사 모델이 테스트 샌드박스를 탈출한 경위에 대한 명확한 답변을 . 해당 게시물에서는 확인된 4건의 모두에서 사이버 보안 평가를 수행한 주체가 외부 파트너 한 곳이라고 밝혔습니다dent. 

클로드에게는 테스트 장비가 개방형 웹에 연결할 수 없는 밀폐된 시뮬레이션 환경에서 작동 중이라고 알려졌지만, 설정 오류로 인해 인터넷 연결이 완전히 차단되지 않았던 것으로 보입니다. 

해당 시뮬레이션의 평가 파트너인 Irregular는 오류의 원인을 명명 오류로 지목했습니다. 해킹 훈련에 사용된 가상의 회사 이름이 실제 도메인과 우연히 일치했던 것입니다. 따라서 시뮬레이션 환경의 모든 것이 허용된다고 가정한 모델들은 취약한 비밀번호와 노출된 엔드포인트를 사용하여 실제 제3자 웹사이트를 해킹했습니다.

네 건의 사건 중 가장 최근dent은 클로드 오푸스 4.6 초기 빌드와 관련된 것으로, 지난 1월에 발생했음에도 불구하고 이번 주에야 보도되었습니다. 앤트로픽은 오푸스 4.7, 미소스 5, 그리고 내부 연구 모델과 관련된  나머지 세 건의dent에 대해서는 지난 7월에 직접 설명했습니다

앤트로픽은 1월에 발생한dent 을 지난달이 되어서야 발견했다고 밝혔습니다. 이 발견으로 약 4억 8100만 건의 녹취록을 대상으로 광범위한 조사가 진행되었지만, 기존에 알려진 것보다 더 심각한 새로운 사례는 발견되지 않았습니다.

모델사건dent 일보고 날짜세부
클로드 작품 4.61월구월8월 정찰 중에 발견됨
클로드 작품 4.7칠월칠월7월 초기 공개 자료에 포함됨
미소스 5칠월칠월상당히 편향된 추론을 보였다
내부 연구 모델칠월칠월7월 초기 공개 자료에 포함됨

인류 원리는 모델의 일부 행동을 설명할 수 없습니다

모델들이 인터넷에 어떻게 탈출했는지에 대한 설명은 괜찮았지만, 앤스로픽은 모델들이 실제 인터넷에 도달했다는 징후를 무시한 이유(편향된 추론)와 완료된 작업에 피해를 입힌 이유(무모함)에 대해서는 답을 내놓지 못했습니다. 

인류학 연구소 연구원들은 편향된 추론의 근거를 파악하기 위해 내부 학습 과정을 조사했지만 아무런 성과도 얻지 못했습니다. 이러한 문제점은 AI 연구소의 사전 출시 검사에서도, 모델이 테스트에 투입되기 전에도 전혀 발견되지 않았습니다. 

회사 스스로 인정했듯이, 모델 출시 전에 최악의 행태를 잡아내는 것은 "여전히 어려운 과제"입니다 

하지만 앤트로픽 측은 METR 연구 비영리 단체에 녹취록을 제출하고 직원들에게 해당 사건에 대한 접근 권한을 부여할 것이라고 밝혔으며,dent은 이제 8주간dent 조사를 진행할 예정입니다.

2조 달러 규모의 IPO를 앞둔 시점에서 타이밍이 좋지 않네요

이러한 사실이 공개되면서 업계 내부의 반발도 거세졌다. 오픈AI와 앤스로픽에서 약 3년간 사전 학습 연구를 담당했던 제이콥 콕슨은 수요일 X 포럼에서 두 회사 모두 "책임감 있게 행동하지 않는다"는 이유로 사임했다고 밝히며, 스스로 발전하는 초지능을 향해 경쟁하고 있다고 경고했다. 

인류 안전성 연구원인 에반 휴빙거는 BBC와의 인공지능이 10년 안에 "모든 인류를 죽일 가능성"이 10%를 넘는다고 밝혔습니다.

이러한 경고는 이제 대규모 IPO에 그림자를 드리우고 있습니다. 벤처 투자자이자 트럼프 전 대통령의 AI 및 암호화폐 담당 고문이었던 데이비드 삭스는 목요일에 앤트로픽의 IPO가 "내부 고발자의 주장이 조사될 때까지 중단되어야 한다"고 말했다고 Cryptopolitan 보도했습니다. 

앤트로픽은 최근 비공개 평가액인 약 9650억 달러를 훨씬 뛰어넘는 2조 달러에 가까운 기업 가치를 목표로 상장을 추진하고 있어, 안전성 문제와 재무적 문제를 분리하기가 점점 더 어려워지고 있습니다.

암호화폐 분야의 최고 전문가들이 이미 저희 뉴스레터를 구독하고 있습니다. 함께하고 싶으신가요? 지금 바로 참여하세요.

면책 조항: 이 웹사이트에서 제공되는 정보는 교육적이고 정보 제공을 위한 목적으로만 사용되며, 금융 또는 투자 조언으로 간주되어서는 안 됩니다.

코멘트 (0)

$ 버튼을 클릭하고, 종목 코드를 입력한 후 주식, ETF 또는 기타 티커를 연결합니다.

0/500
코멘트 가이드라인
로딩 중...

추천 기사

tradingkey.logo
위험 경고: 저희 웹사이트와 모바일 앱은 특정 투자 상품에 대한 일반적인 정보만을 제공합니다. Finsights는 재정적 조언이나 투자 상품에 대한 추천을 제공하지 않으며, 이러한 정보 제공이 Finsights가 금융 조언이나 추천을 제공하는 것으로 해석되어서는 안 됩니다.
투자 상품은 투자 원금 손실을 포함한 상당한 투자 위험에 노출되어 있으며, 모든 사람에게 적합하지 않을 수 있습니다. 투자 상품의 과거 성과는 미래 성과를 보장하지 않습니다.
Finsights는 제3자 광고주나 제휴사가 저희 웹사이트나 모바일 앱 또는 그 일부에 광고를 게재하거나 전달할 수 있도록 허용할 수 있으며, 사용자가 광고와 상호작용하는 방식에 따라 이들로부터 보상을 받을 수 있습니다.
© 저작권: FINSIGHTS MEDIA PTE. LTD. 모든 권리 보유