구글, 제미나이 3.8 플래시 출시: 성능은 최고 모델 클로드 오퍼스 5에 근접, 비용 효율성이 여전히 핵심 경쟁력
구글(GOOGL)은 동부시간 기준 9월 2일 ‘제미나이 3.8 플래시’와 ‘제미나이 3.8 플래시 사이버’ 등 신규 모델 2종을 공개했다. 제미나이 3.8 플래시는 기존의 고속·저비용 특성을 유지하면서 코드 생성 및 복잡한 추론 역량을 강화했으며, 일부 벤치마크 테스트에서 상위 모델에 근접하거나 웃도는 성능을 보였다고 전해진다. 가격은 이전 세대와 동일하게 유지되어 비용 효율성을 강조하고 있다. 제미나이 3.8 플래시 사이버는 사이버 보안 방어에 초점을 맞춰 취약점 탐지 및 자동 복구 성능을 향상시켰으며, 검증된 신뢰할 수 있는 방어자에게만 제한적으로 제공될 예정이다.

TradingKey - 구글(GOOGL)은 동부시간 기준 9월 2일 두 가지 신규 모델인 제미나이 3.8 플래시(Gemini 3.8 Flash)와 제미나이 3.8 플래시 사이버(Gemini 3.8 Flash Cyber)를 공개했습니다. 이는 구글이 6주 만에 출시한 세 번째 플래시 시리즈 모델로, 이전 제미나이 3.7 플래시의 고속·저비용 특성을 유지하면서 코드 생성, 복잡한 추론, 에이전트 작업 및 사이버 보안 역량을 더욱 강화했습니다.
전자는 소프트웨어 엔지니어링, AI 에이전트, 전문 분야의 다단계 추론 작업에 맞춰 설계되었으며, 후자는 취약점 탐지 및 자동화된 복구에 집중하여 검증된 신뢰할 수 있는 방어자에게만 제공됩니다.
두 모델은 서로 다른 사용 사례를 목표로 하지만, 모두 동일한 기반 지능 코어를 바탕으로 하며 장기간 실행되는 에이전트 루프를 통해 모델 출력을 반복적으로 평가하고 최적화합니다.
제미나이 3.8 플래시: 장기 호라이즌 코딩 및 에이전트 작업 강화
Gemini 3.8 Flash의 주요 업그레이드는 다중 턴 도구 호출이 필요한 복잡하고 연속적인 작업을 처리하는 데 중점을 둡니다. Google은 일부 테스트에서 이 모델의 성능이 더 높은 비용의 플래그십 모델에 근접한다고 밝혔습니다.
DeepSWE v1.1 장기 소프트웨어 엔지니어링 벤치마크에서 Gemini 3.8 Flash는 73.7%를 기록해 Gemini 3.7 Flash의 65.3%보다 높았으며, GPT-5.6 Sol의 72.7%와 GPT-5.6 Terra의 69.6%도 상회했고 Claude Opus 5의 74.0%에는 약간 못 미쳤습니다.

출처: Google
전문 분야 작업에서도 Gemini 3.8 Flash는 강력한 경쟁력을 입증했습니다. 이 가운데 과학, 기술, 인문학 및 전문 지식을 아우르는 다학제적 질문을 다루는 HLE-Verified 벤치마크에서 Gemini 3.8 Flash는 Claude Sonnet 5의 31.0%, GPT-5.6 Terra의 51.1%, Claude Opus 5의 54.4%, GPT-5.6 Sol의 54.5%를 앞섰습니다.
가격 측면에서 Gemini 3.8 Flash는 입력 토큰 100만 개당 0.75달러, 출력 토큰 100만 개당 3.75달러라는 Gemini 3.7 Flash의 초기 가격을 그대로 유지합니다.
이와 비교해 Claude Opus 5의 입력 및 출력 가격은 각각 5달러와 25달러이며, GPT-5.6 Sol은 4달러와 20달러, GPT-5.6 Terra는 2달러와 12달러입니다.
이는 Gemini 3.8 Flash가 일부 코딩 및 추론 벤치마크에서 더 큰 모델에 근접하거나 심지어 능가하면서도 API 호출 비용은 훨씬 낮다는 것을 의미합니다. 코드 에이전트, 자동화된 분석, 기업용 워크플로를 배포하려는 개발자에게 높은 비용 효율성은 핵심 세일즈 포인트가 될 수 있습니다.
Gemini 3.8 Flash Cyber: 취약점 탐지 및 자동 조치에 초점
제미나이 3.8 플래시 사이버(Gemini 3.8 Flash Cyber)는 이번에 공개된 또 다른 주요 모델로, 주로 사이버 보안 방어 시나리오를 목표로 한다. 구글은 해당 모델이 광범위하게 제공되지는 않을 것이며, 대신 새로운 페어윈드(Fairwind) 프로그램을 통해 검증되고 신뢰할 수 있는 방어 팀에 제공될 것이라고 밝혔다.
사이버 보안 업계에서 일반적으로 사용되는 CyberGym 취약점 발견 벤치마크에서 제미나이 3.8 플래시 사이버는 86.2%를 기록해 제미나이 3.5 플래시 사이버의 77.5%보다 높았으며, GPT-5.6 Sol의 83.6%, Mythos 5의 83.8%, GPT-5.5-Cyber의 85.6%도 넘어섰다.
20개 프로그래밍 언어를 다루는 내부 실전 시나리오 테스트에서 제미나이 3.8 플래시 사이버는 71.0%의 취약점 발견 성공률을 기록하여 제미나이 3.7 플래시의 58.9%와 제미나이 3.5 플래시 사이버의 46.6%를 상회했다.
자동 복구 측면에서는 콜리니어(Collinear)가 진행한 CWE-Bench 테스트에서 제미나이 3.8 플래시 사이버가 47.2%의 pass@1을 달성하며 최상위 모델들의 47.8%에 근접했으나, 구글은 상대적으로 낮은 비용을 강조했다.
이 콘텐츠는 AI를 활용하여 번역되었으며, 명확성을 확보할 수 있도록 검토 과정을 거쳤습니다. 정보 제공 용도로만 제공됩니다.
추천 기사













코멘트 (0)
$ 버튼을 클릭하고, 종목 코드를 입력한 후 주식, ETF 또는 기타 티커를 연결합니다.