Google DeepMind는 8월 13일 Gemini 3.7 Flash를 공개했습니다. Gemini 3.6 Flash 이후 3주 만입니다. 모델만큼이나 출시 속도 자체가 핵심 이야기입니다.
무엇이 달라졌나
가장 큰 향상은 에이전트형 작업과 문서 작업에서 나타났습니다. 기업 워크플로 자동화를 평가하는 AutomationBench는 17.0%에서 30.4%로 올랐습니다. 장기 소프트웨어 엔지니어링을 다루는 DeepSWE v1.1는 49.0%에서 65.3%로 상승했습니다. GDP.pdf 문서 이해는 22.0%에서 34.0%로, FrontierCode 1.1의 프로덕션 코드 품질은 34.4%에서 43.6%로, WebDev Arena Elo는 1538에서 1588로 올랐습니다.
가격
초기 요금은 입력 토큰 100만 개당 0.75달러, 출력 100만 개당 3.75달러이며 2026년 12월 31일까지 유지됩니다. 이후에는 각각 1.50달러와 7.50달러로 오릅니다. 표준 요금 기준으로도 이는 이전 Flash 세대의 약 절반 수준입니다. 같은 출시에서 가격 인하와 성능 향상이 동시에 이뤄진 셈으로, 이것이야말로 Flash급 모델을 대규모 에이전트 루프의 기본 선택으로 만든 패턴입니다.
출시 첫날 배포
이 모델은 Google AI Studio, Android Studio, Gemini Enterprise Agent Platform, 그리고 160+개 국가의 AI Pro 및 Ultra 구독자를 위한 Spark에서 바로 사용할 수 있습니다. 같은 날 GitHub는 VS Code, Visual Studio, JetBrains, Xcode, Eclipse, CLI, 클라우드 에이전트, Copilot 앱 등 8개 화면의 Copilot 모델 선택기에 이를 추가했으며, 프리미엄 요청 승수 대신 공급자 목록 가격 기준으로 과금합니다. Vercel은 AI Gateway에 이를 50% 할인된 가격으로 올렸습니다.
수치에 대한 단서
이 모든 벤치마크는 벤더가 공개한 수치로, Google이 자사의 이전 모델과 비교해 자체적으로 수행한 결과입니다. 독립적인 재현은 보통 출시 뒤 몇 주가 걸리며, 특히 AutomationBench는 외부 이력이 거의 없습니다.
