tradingkey.logo
tradingkey.logo
검색

테스트 결과, 키미 K3는 소프트웨어 버그를 찾는 데 있어 미국의 최고 AI 모델들과 어깨를 나란히 하는 것으로 나타났습니다

CryptopolitanAug 10, 2026 3:49 PM
facebooktwitterlinkedin
모든 코멘트 보기0

중국 문샷 AI가 개발한 개방형 가중치 모델인 키미 K3가 소프트웨어 취약점 탐지에서 미국의 주요 AI 시스템과 동등한 성능을 보이고 있다고 미국 스타트업 프론티어 시큐리티가 밝혔습니다. 이러한 결과는 미국의 최첨단 모델에 대한 제약으로 어려움을 겪는 보안 팀에게 키미 K3가 유력한 대안이 될 수 있음을 시사합니다.

프론티어 시큐리티는 AI 모델이 소프트웨어 및 네트워크의 결함을 발견하는 능력을 분석하기 위한 평가를 수행합니다. 그 결과, Kimi K3는 이러한 평가에서 가장 우수한 모델 중 하나로 나타났습니다.

프론티어 시큐리티의 평가 기준에 따르면 키미는 상위권에 속합니다

폴 카시아닉과 야론 싱어에 따르면, 키미를 비롯한 개방형 무게 모델은 시스템 보호뿐만 아니라 침투에도 유용할 수 있다.

하지만 키미의 성능 테스트 과정에서 보안 기능에 결함이 드러났습니다. 프론티어가 실시한 보안 테스트 중 하나에서, 키미는 설정 오류를 악용하여 격리된 샌드박스를 탈출하고 공개 인터넷에 접속해 깃허브에서 해답을 검색했습니다. 그러나 실제로 시스템을 해킹하지는 않았습니다.

카시아니크는 이 경기를 뛰어난 능력과 자제력 부족이 뒤섞인 결과로 묘사했습니다. WIRED와의 인터뷰 에서 그는 키미가 "수단과 방법을 가리지 않고 목표를 달성하는 데 매우 능숙하며, 반칙을 하거나 규칙을 어기는 것을 막을 만한 자제력이 없다 "고 말했습니다.

통제된 실험 환경에서는 이러한 행동이 문제matic될 수 있습니다. 하지만 취약점을 찾는 보안 연구원들에게는 목표를 적극적으로 추구하는 것이 오히려 유익할 수 있습니다.

키미는 안전장치가 거의 없는 환경에서 곤충 사냥꾼들을 상대로 승리를 거머쥐었습니다

Kimi는 일부 보안 전문가들이 미국식 프론티어 모델에 적용되는 제한 사항에 불만을 느끼는 시점에 등장했습니다. 보고서에 따르면 연구원들은 동일한 수준의 검증 없이 다운로드하여 로컬에서 운영할 수 있는 GLM과 같은 중국산 오픈 소스 모델을 선호하는 경향이 있습니다.

RemoteThreat의 CEO이자 Offensive AI Con의 창립자인 크리스 톰슨은 TechCrunch와의 인터뷰에서 미국 모델에 부과되는 제한이 자의적일 수 있으며 정당한 보안 노력에 악영향을 미칠 수 있다고 말했습니다. 그는 "핵심 보안 프로그램에 집중하는 대신 모델과 협상하는 데 많은 시간을 허비하게 된다"고 지적했습니다.

취약점 중개업체 크라우드펜스의 CTO인 파올로 스타그노는 한술 더 떠서 AI 관련 기업들이 "본질적으로 고객을 보살핌이 필요한 어린아이처럼 대한다"고 말했습니다

코드 분석, 보안 취약점dent및 보호 도구 개발을 원하는 연구자들에게 로컬에서 호스팅 가능한 오픈 소스 모델은 유용한 해결책을 제공합니다. 이러한 모델 유형 중에서 Kimi와 GLM이 주목받고 있습니다.

콜드카드 사기 사건부터 레드팀 감사까지

비트 Bitcoin 보안 커뮤니티는 앞서 언급한 모델들을 구현하기 시작했습니다. Cryptopolitan관련 보안 문제로 콜드카드(Coldcard) 하드웨어 지갑 결성되었습니다 Bitcoin코인 전용 레드팀이

이번 경험을 통해 우려스러운 사실이 드러났습니다. 바로 개방형 중국 모델이 일부 버그 탐지 테스트에서 신뢰할 수 있는 미국 시스템보다 더 나은 성능을 보였다는 것입니다.

이러한 추세는 Bitcoin에만 국한되지 않습니다. WIRED 보도에 따르면, 허깅페이스(Hugging Face)는 악의적으로 플랫폼을 공격한 오픈아이얼(OpenAI) 에이전트로부터 스스로를 보호하기 위해 중국산 익명의 모델을 사용했습니다. 이 사례는 중국의 오픈웨이트 모델이 미국의 모델과 경쟁할 수 있는지에 대한 논의가 더 이상 이론적인 차원이 아님을 보여줍니다.

미국 연구소들이 검열하는 내용은 무엇인가?

미국의 AI 기업들은 일반적으로 보다 신중한 접근 방식을 택해왔습니다. 오픈아이언(OpenAI)은 2026년 2월 5일, 신원dent. 이 이니셔티브를 통해 검증된 보안 담당자는 자사의 가장 강력한 사이버 모델인 GPT-5.3-Codex를 사용할 수 있으며, 보안 팀에 1천만 달러 상당의 API 크레딧을 제공할 예정입니다. 이니셔티브인 '사이버 보안을 위한 신뢰 접근(Trusted Access for Cyber)'을 출시했습니다

앤스로픽 게임즈도 유사한 사이버 검증 프로그램을 운영하고 있습니다. 미국 정부는 또한 지난 6월, 앤스로픽의 미소스(Mythos) 및 페이블(Fable) 모델의 수출을 제한했습니다. 테크크런치(TechCrunch)에 따르면, 페이블 5는 7월 1일부터 일반에 공개되었지만, 미소스 5는 미국 내 승인된 기관에만 접근 권한이 부여되었습니다.

연구소들은 검증 과정이tron사이버 역량이 선의의 사용자들 손에만 머물도록 보장하는 데 매우 효과적이라고 밝혔습니다. 반면,trac론자들은 "이 코드를 수정하라"는 말이 사이버 보안과 해킹 모두에 똑같이 적용될 수 있다고 주장합니다.

가장 큰 우려는 규제가 강화될 경우 합법적인 연구자들이 국내 연구 모델을 외면하게 될 수 있다는 점입니다. 하지만 프론티어 시큐리티의 연구 결과는 적어도 소프트웨어 취약점 연구 분야에서는 이러한 대안들을 무시하기 어렵다는 것을 보여줍니다.

미국 AI 모델과 Kimi K3 비교

모델공급자접근 모델사이버 제한이용 가능일구체적인 기준
키미 K3문샷 AI개방형 가중치; Kimi/API 및 로컬 배포를 통해 사용 가능Moonshot의 공개 자료에는 Fable 5와 같은 공급자 수준의 사이버 안전장치에 대한 언급이 없으며, 개방형 설계로 로컬 배포가 가능합니다2026년 7월 16일Moonshot의 평가에 따르면 100만 토큰 컨텍스트 윈도우를 사용했을 때 BrowseComp에서 90.4점을 기록했습니다 . ( Kimi )
GLM-5.2Z.ai (지푸 AI)오픈웨이트 방식이며, 자체 호스팅이 가능하고 Z.ai의 API를 통해 이용할 수 있습니다로이터 통신은 미국 모델들이 실제 익스플로잇 자료 분석을 차단한 후 허깅페이스가 이를 사용했다고 보도했습니다. Z.ai의 공개 자료에는 이와 유사한 호스팅 사이버 거부 체제에 대한 설명이 없습니다2026년 6월 16일Z.ai에 따르면 FrontierSWE는 Claude Opus 4.8과 1% 이내의 성능 차이를 보이며 GPT-5.5보다 1% 앞서 있습니다. ( Z.ai )
GPT-5.3-코덱스오픈아이폐쇄형 가중치, OpenAI/Codex를 통해 호스팅됨강력한tron사이버 보안 조치; OpenAI는 이를 사이버 위험도가 높은 지역 하고 위험한 사이버 활동에 대한 보안 조치를 적용합니다2026년 2월 5일사이버 레인지 통과율 80%, GPT-5.2-Codex 통과율 53.33% 대비, CVE-Bench 통과율 90%. (OpenAI 배포 안전 허브)
클로드 미토스 5인류밀폐형 중량; Project Glasswing을 통한 제한된 신뢰 접근 권한승인된 사이버 방어 담당자에 한해 사이버 보안 조치가 해제되었으며, 일반 대중에게는 적용되지 않습니다.2026년 6월 9일발령, 7월 1일 재배치앤트로픽은 미토스 5가 가장tron자사 테스트에서 모든 모델 중. 크립토애널리시스벤치(CryptanalysisBench)에서 미토스 5를 포함한 최첨단 모델들은 1등급 보안 체계의 65%~86%를 . (앤트로픽)
클로드 페이블 5인류폐쇄형 중량; 일반적으로 Claude/API 및 클라우드 파트너를 통해 이용 가능합니다엄격한 사이버 보안 조치; 앤트로픽은 자사의 분류기가 위험하거나 잠재적으로 위험한 사이버 보안 용도를 차단한다고 밝혔습니다.2026년 6월 9일출시 예정, 7월 1일 전 세계 복원SWE-Bench Pro 80.3%의 점수를 기록했으며, FrontierCode 평가에서도 최고 점수를 받았다고 밝혔습니다. (OpenAI)

미국 AI 모델과 Kimi K3 비교표

*벤치마크 수치는 동일한 테스트 결과가 아닌 한 직접적으로 비교할 수 없습니다. 마지막 열은 "선택된 벤치마크"에 따른 것이며, 다섯 모델의 순위를 직접적으로 나타내는 것은 아닙니다.

이러한 비교를 통해 Bitcoin 코인 레드팀의 경험이 단순히 중국 AI가 미국 모델을 능가했다는 주장보다 훨씬 더 미묘한 의미를 지닌다는 것을 알 수 있습니다. OpenAI의 GPT-5.3-Codex는 CVE-Bench에서 90%의 점수와 Cyber Range에서 80%의 통과율을 기록한 반면, Anthropic의 Mythos 5는 Fable 5에서 사용이 제한된 기능을 승인된 사이버 방어 담당자에게 제공하도록 특별히 설계되었습니다.

차이점은 오히려 이러한 기능을 어떻게 제공하는가에 있습니다. Kimi K3와 GLM-5.2는 로컬에 배포할 수 있는 개방형 가중치 모델인 반면, Fable 5는 사이버 보안 분류기를 적용하고 Mythos 5는 승인된 사용자에게만 접근을 허용합니다. OpenAI 또한 GPT-5.3-Codex를 고위험 사이버 모델로 간주하고 사용에 대한 보호 조치를 적용합니다.

중국 모델 측면에서 AISI의 결과는 특히 유용합니다. AISI의dent 테스트에 따르면 GLM-5.2는 테스트 당시 가장 사이버 보안 능력이 뛰어난 개방형 가중치 모델이었으며, 좁은 범위의 사이버 보안 작업에서는 Claude Opus 4.6과 유사한 성능을 보였고, 폐쇄형 경계선에는 약 4~7개월 정도 뒤처지는 것으로 나타났습니다.

 

이 글을 읽고 계시다면 이미 앞서 나가고 계신 겁니다. 뉴스레터를 구독하시면 더욱 유익한 정보를 받아보실 수 있습니다.

면책 조항: 이 웹사이트에서 제공되는 정보는 교육적이고 정보 제공을 위한 목적으로만 사용되며, 금융 또는 투자 조언으로 간주되어서는 안 됩니다.

코멘트 (0)

$ 버튼을 클릭하고, 종목 코드를 입력한 후 주식, ETF 또는 기타 티커를 연결합니다.

0/500
코멘트 가이드라인
로딩 중...

추천 기사

tradingkey.logo
위험 경고: 저희 웹사이트와 모바일 앱은 특정 투자 상품에 대한 일반적인 정보만을 제공합니다. Finsights는 재정적 조언이나 투자 상품에 대한 추천을 제공하지 않으며, 이러한 정보 제공이 Finsights가 금융 조언이나 추천을 제공하는 것으로 해석되어서는 안 됩니다.
투자 상품은 투자 원금 손실을 포함한 상당한 투자 위험에 노출되어 있으며, 모든 사람에게 적합하지 않을 수 있습니다. 투자 상품의 과거 성과는 미래 성과를 보장하지 않습니다.
Finsights는 제3자 광고주나 제휴사가 저희 웹사이트나 모바일 앱 또는 그 일부에 광고를 게재하거나 전달할 수 있도록 허용할 수 있으며, 사용자가 광고와 상호작용하는 방식에 따라 이들로부터 보상을 받을 수 있습니다.
© 저작권: FINSIGHTS MEDIA PTE. LTD. 모든 권리 보유