구글, 제미나이 3.7 플래시 출시: 코딩 및 에이전트 기능의 비약적 도약, 3주 만의 반복 주기로 저비용 모델의 새로운 속도 기록 경신
구글이 출시한 Gemini 3.7 Flash는 코딩, 에이전트 작업, 지식 노동에 초점을 맞춘 저비용 에이전트형 모델이다. 구글이 공개한 자료에 따르면, 새 모델은 소프트웨어 공학, 웹 개발, 복잡한 문서 처리 등 다양한 벤치마크에서 이전 세대인 3.6 Flash 대비 향상된 성능을 보였다. 특히 다단계 작업에서 계획 수립과 도구 호출 비중이 늘었고, 실행 경로 조정 능력이 개선되어 공학 워크플로에서 개발자의 수동 개입을 줄여줄 수 있다고 설명된다. 가격은 100만 토큰당 입력 0.75달러, 출력 3.75달러로 책정되었다.

TradingKey - 구글(GOOGL)이 Gemini 3.7 Flash를 출시하며 저비용 에이전트형 모델의 반복 진화를 한층 가속화했다. Flash 시리즈의 최신 버전인 Gemini 3.7 Flash는 Gemini 3.6 Flash 출시 후 단 3주 만에 공개되었으며, 코딩, 에이전트 작업, 복잡한 지식 노동 시나리오에 초점을 맞추고 있다.
구글은 새 모델이 소프트웨어 공학, 웹 개발, 지식 집약적 작업 분야에서 3.6 Flash 대비 현저한 성능 향상을 보인다고 밝혔다. 코딩 능력 측면에서 Gemini 3.7 Flash는 디버깅, 문제 해결, 상용화 수준의 코드 생성 작업을 더 잘 처리한다.
구글이 공개한 자료에 따르면, FrontierCode 1.1 Main 벤치마크 점수는 43.6%로 3.6 Flash의 34.4%보다 높았으며, 장기 소프트웨어 공학 테스트인 DeepSWE v1.1에서는 65.3%를 기록해 이전 버전의 49.0%를 상회했다.
웹 개발 분야에서 Gemini 3.7 Flash는 더 적은 프롬프트만으로도 완성도 높은 애플리케이션과 대화형 페이지를 생성할 수 있으며, 스크린샷, 이미지 또는 전체 디자인 시스템을 기반으로 UI 스타일을 재현할 수 있다. Arena.ai WebDev Arena에서의 Elo 점수는 1588점으로 Gemini 3.6 Flash의 1538점보다 높다. 신규 모델은 코딩 아레나, 기업 워크플로 자동화, 복잡한 문서 이해 등 다양한 테스트에서도 이전 세대 대비 향상된 성능을 보였다.
금융, 법률, 생명과학 등 복잡한 자료 처리가 필요한 시나리오에 대해 구글은 새 모델의 추론 정확도가 한층 향상되었다고 밝혔다. 구체적으로 Gemini 3.7 Flash는 복잡한 문서 처리 벤치마크인 GDP.pdf에서 3.6 Flash의 22.0%보다 높은 34.0%를 기록했으며, 기업 자동화 역량을 측정하는 AutomationBench에서는 30.4%를 기록해 이전 세대의 17.0% 대비 뚜렷한 개선세를 보였다.

출처: 구글 뉴스
구글은 Gemini 3.7 Flash가 다단계 작업에서 계획 수립과 도구 호출 비중을 늘렸고, 장애물에 직면했을 때 실행 경로를 더 잘 조정할 수 있으며, 지시 사항 이해도와 준수 능력을 향상시켜 공학 워크플로에서 개발자의 수동 개입과 시행착오를 줄여준다고 설명했다.
가격 책정 측면에서 Gemini 3.7 Flash의 입력 가격은 100만 토큰당 0.75달러, 출력 가격은 100만 토큰당 3.75달러다.
이 콘텐츠는 AI를 활용하여 번역되었으며, 명확성을 확보할 수 있도록 검토 과정을 거쳤습니다. 정보 제공 용도로만 제공됩니다.












코멘트 (0)
$ 버튼을 클릭하고, 종목 코드를 입력한 후 주식, ETF 또는 기타 티커를 연결합니다.