
확인 기준: 2026-08-20T15:48:16+09:00
2026년 8월 20일 기준, Gemini 3.7은 ‘Gemini 3.7 Flash’ 단일 모델로 공개됐습니다. 핵심 변화는 일반 대화보다 코딩, 소프트웨어 엔지니어링, 에이전트 작업과 멀티모달 추론을 강화한 데 있습니다. API에서 시험하려면 모델 ID gemini-3.7-flash를 지정하면 됩니다.
Google은 2026년 8월 13일 Gemini 3.7 Flash를 GA(일반 제공) 모델로 발표했습니다. 공식 설명에서 이 모델은 코딩과 에이전트 작업을 위한 ‘workhorse 모델’로 소개됐으며, 여러 단계의 도구 실행과 실제 소프트웨어 개발 업무에 초점이 맞춰져 있습니다.
달라진 점은 ‘대화’보다 개발 작업에 가깝다
이전 Gemini 3.6 Flash와 비교할 때 Google이 강조한 개선 영역은 코드 이슈 해결, 실패하는 에이전트의 반복 감소, 디자인 시안을 반영한 웹·데스크톱 애플리케이션 생성, 기존 코드와 디자인 시안의 일치 여부 점검입니다. 따라서 단순히 답변 문장이 더 자연스러워졌는지를 보기보다, 코드베이스를 이해하고 테스트와 도구 호출을 이어 가는 능력을 확인하는 모델에 가깝습니다.
| 항목 | 확인된 Gemini 3.7 Flash 내용 |
|---|---|
| 모델 상태 | GA(일반 제공), 모델 ID는 gemini-3.7-flash |
| 입력 | 텍스트·이미지·동영상·오디오·PDF |
| 출력 | 텍스트 |
| 입력 한도 | 최대 1,048,576토큰 |
| 출력 한도 | 최대 65,536토큰 |
| 사고 수준 | low·medium·high 조절 가능, medium이 기본값 |
| 주요 도구·기능 | 코드 실행, 컴퓨터 사용(프리뷰), 파일 검색, 함수 호출, Google 검색·지도 기반 그라운딩, 구조화된 출력, URL 컨텍스트 |
| 지원하지 않는 기능 | 오디오 생성, 이미지 생성, Live API |
입력 형식은 넓지만 출력은 텍스트입니다. 이미지나 동영상, 오디오, PDF를 분석할 수 있어도 이미지 생성 모델이나 오디오 생성 모델로 사용할 수 있다는 뜻은 아닙니다. 공식 모델 페이지에는 오디오 생성, 이미지 생성, Live API가 지원되지 않는 것으로 표시돼 있습니다.
벤치마크 상승은 참고 자료로 봐야 한다
확인된 비교 보도에서는 DeepSWE v1.1 점수가 Gemini 3.6 Flash의 49.0%에서 Gemini 3.7 Flash의 65.3%로, FrontierCode 1.1 Main 점수가 34.4%에서 43.6%로 상승했습니다. 다만 이는 특정 벤치마크와 평가 설정에 따른 결과입니다. 모든 프로그래밍 언어, 프레임워크, 기업 코드베이스에서 같은 폭의 개선이 재현된다고 단정할 수는 없습니다.
현재 확인된 자료만으로는 Gemini 3.6 Flash와 3.7 Flash의 전체 공식 벤치마크 표, 장기간의 독립 코드베이스 테스트, 한국어 작업 품질에 대한 충분한 교차 검증 결과를 확인하기 어렵습니다.
시험하거나 이전할 때 확인할 순서
- Google AI Studio에서 Gemini 3.7 Flash를 시험하거나 Gemini API 사용 환경을 준비합니다.
- API를 사용할 경우 모델 ID gemini-3.7-flash를 지정합니다.
- 코드 이슈 해결, 도구 호출, 파일 검색, 구조화된 출력 등 실제 사용하려는 기능을 먼저 정합니다.
- 기존 Gemini 3.5 Flash 또는 이전 모델에서 이전한다면 더 이상 지원되지 않는 sampling 파라미터와 사전 입력된 모델 턴을 제거합니다.
- 토큰 사용량, 도구 호출 오류, 작업 완료율과 재시도 횟수를 기존 모델과 같은 조건에서 비교합니다.
무료·유료 계정별 일일 요청 수와 분당 요청 수 같은 세부 rate limit은 확인된 모델 페이지에서 하나의 확정된 숫자로 모두 제시되지 않았습니다. 따라서 도입 전에 계정 유형과 실제 프로젝트의 사용량을 기준으로 별도 확인이 필요합니다.
가격은 2026년 말까지와 이후가 다르다
| 구분 | 2026년 12월 31일까지 | 2027년 1월 1일부터 예정 |
|---|---|---|
| 표준 API 입력 | 100만 토큰당 0.75달러 | 100만 토큰당 1.50달러 |
| 표준 API 출력 | 100만 토큰당 3.75달러 | 100만 토큰당 7.50달러 |
| Batch·Flex 입력 | 100만 토큰당 0.375달러 | 100만 토큰당 0.75달러 |
| Batch·Flex 출력 | 100만 토큰당 1.875달러 | 100만 토큰당 3.75달러 |
표준 API 기준 도입 가격은 2026년 12월 31일까지 적용되고, 2027년 1월 1일부터 입력·출력 가격이 각각 1.50달러와 7.50달러로 변경될 예정입니다. 대량 처리용 Batch와 Flex 가격도 같은 시점에 조정될 예정이므로, 장기 운영 비용은 도입 가격만으로 계산하면 안 됩니다.
출시 이후 확인할 시나리오
향후 흐름은 아직 확정되지 않았습니다. 현재 자료로는 다음과 같은 조건별 시나리오를 나눠 보는 편이 적절합니다.
- 개발자용 에이전트 모델로 확산될 가능성: 1M 토큰 컨텍스트와 코드 실행, 함수 호출, 컴퓨터 사용, 파일 검색을 결합할 수 있습니다. 실제 코드베이스의 이슈 해결부터 테스트 실행까지 한 번에 수행하는 제품에서 채택이 늘어나는지가 신호입니다.
- 가격 경쟁력으로 대량 자동화 수요를 확보할 가능성: 2026년 말까지의 도입 가격이 고빈도 코드 생성이나 서브에이전트 작업의 비용 장벽을 낮출 수 있습니다. 가격이 오르는 2027년 1월 이후에도 사용량이 유지되는지가 중요합니다.
- 벤치마크와 실제 업무 성과 사이에 차이가 남을 가능성: 독립 재현 평가, 장기 실행 에이전트의 실패율, 도구 호출 오류, 보안과 프롬프트 인젝션 대응, 비용 대비 완료 작업 수를 추가로 확인해야 합니다.
- 소비자용 Gemini 앱보다 API·개발자 생태계에 먼저 자리 잡을 가능성: 현재 발표와 모델 문서의 초점은 API, Google AI Studio, 코딩과 에이전트 사용 사례에 있습니다. 한국 지역의 Gemini 앱 제공 시점이나 요금제별 모델 선택 가능 여부는 확인된 자료만으로 확정할 수 없습니다.
도입 판단은 ‘벤치마크가 올랐는가’만으로 끝내기보다, 사용하는 코드베이스에서 작업 완료율·실패 반복·도구 호출 오류·토큰 비용을 같은 조건으로 비교한 뒤 내리는 것이 안전합니다. 가격 변경 예정일인 2027년 1월 1일 이후 비용도 함께 계산해야 합니다.
정리하면 Gemini 3.7 Flash의 차별점은 장문 입력과 멀티모달 입력을 바탕으로 코딩·에이전트 작업을 여러 단계로 수행하도록 설계된 점입니다. 현재 확인된 사실은 2026년 8월 13일 GA 출시, 모델 사양과 지원 도구, 벤치마크 일부 상승, 그리고 2027년 1월 예정된 가격 변경까지입니다. 실제 성능과 제공 범위는 공식 문서의 후속 변경과 독립적인 사용성 평가를 함께 확인해야 합니다.