제미나이 3.7 플래시, 3주 만에 또 바뀐 이유와 실제 쓸 만한지 정리

제미나이 3.7 플래시(Gemini 3.7 Flash)가 2026년 8월 13일 공개됐습니다. 3.6 Flash가 나온 지 약 3주 만입니다. 이렇게 빠른 업데이트에 “지금 쓰는 3.6을 바꿔야 하나?”, “무료로 써볼 수 있나?” 같은 질문이 먼저 나올 수밖에 없습니다.

결론부터 말하면, 코딩이나 에이전트 작업이 주 용도라면 바꿀 근거가 있고, 가격도 오히려 내려갔습니다. 아래에서 하나씩 확인해 보겠습니다.

3.6에서 3주 만에 바뀐 것

구글은 이번 3.7 Flash를 “가장 유능한 Flash 모델”이라고 소개합니다. 공식 설명에서 강조하는 변화는 세 가지입니다.

  • 복잡한 코딩 작업 처리: complex coding을 명시적으로 내세웠습니다.
  • 에이전트 워크플로: agentic workflows, 즉 여러 단계를 스스로 판단하며 실행하는 작업에 최적화했다고 합니다.
  • 다단계 실행의 안정성: reliable multi-step execution을 별도로 언급합니다.

3.6 Flash까지는 “빠르고 저렴한 경량 모델”이 핵심 포지션이었는데, 3.7에서는 여기에 코딩·에이전트 성능을 본격적으로 얹은 셈입니다.

제미나이 3.7 플래시 벤치마크: 숫자로 보는 차이

가장 눈에 띄는 건 코딩 벤치마크입니다.

FrontierCode 1.1 Main 기준으로 3.6 Flash가 34.4%였던 점수가 3.7 Flash에서 43.6%로 올라갔습니다. 9.2%포인트 차이입니다. 경량 모델 안에서 이 정도 점프는 드문 편입니다.

DeepSWE V1.1 차트에서 Gemini 3.7 Flash가 낮은 비용과 높은 성능 영역에 위치한 산점도

DeepSWE V1.1 차트를 보면 더 직관적입니다. 가로축이 작업당 평균 비용, 세로축이 성능 점수인데, Gemini 3.7 Flash는 비용이 거의 최저 수준이면서 성능은 70% 근처에 위치합니다. 3.6 Flash가 약 45% 부근에 있었던 것과 비교하면 같은 가격대에서 성능이 크게 올라간 겁니다.

참고로 같은 차트에서 Claude Opus 5는 성능은 높지만 비용도 상당히 높은 영역에 있고, GPT-5.6 Sol도 비용 면에서 3.7 Flash보다 비쌉니다.

API 가격: 도입가가 절반

Google AI Studio 모델 선택 화면에서 Gemini 3.7 Flash 도입가 입력 $0.75 출력 $3.75 표기

Google AI Studio 가격 페이지에서 직접 확인한 수치입니다.

항목3.7 Flash 도입가3.6 Flash 출시 당시
입력 (100만 토큰당)$0.75$1.50
출력 (100만 토큰당)$3.75$7.50
도입가 기한2026년 12월 31일까지

3.6 Flash 대비 정확히 절반입니다. 다만 이 가격은 2026년 12월 31일까지 적용되는 도입가입니다. 이후에는 표준 요금으로 돌아갈 수 있으므로, 장기 비용 계획을 세운다면 이 점을 염두에 둘 필요가 있습니다.

무료로 지금 바로 써보는 방법

돈을 들이지 않고 오늘 바로 확인할 수 있는 경로가 있습니다.

  1. Google AI Studio 무료 티어: 모델 선택에서 gemini-3.7-flash를 고르면 됩니다. 입력 토큰, 출력 토큰, 컨텍스트 캐싱까지 무료로 표기되어 있습니다.
  2. 구글 안티그래비티(Antigravity): 역시 무료로 접근 가능합니다.
  3. 제미나이 앱: Google AI 프로·울트라 구독자라면 스파크 기능을 통해 사용할 수 있습니다.

API를 붙이기 전에 무료 티어에서 평소 작업을 넣어 보는 게 가장 확실한 판단 방법입니다.

속도 체감: 허풍은 아닌 듯

직접 써보면 속도가 가장 먼저 느껴집니다. 이 속도로 이 수준의 결과를 받을 수 있다는 게 솔직히 놀랍습니다. 비용과 알고리즘 효율 모두 개선됐다는 공식 발표가 있었는데, 체감상으로도 빈말은 아닙니다.

다만 속도 수치를 볼 때 한 가지 구분이 필요합니다. 초당 출력 토큰 수와 실제 작업 완료 시간은 다릅니다. 모델이 토큰을 만드는 구간에서의 속도와, 도구 호출·대기가 섞인 실제 에이전트 작업의 총 소요 시간은 차이가 날 수 있습니다.

바꿀 가치가 있는 사람, 아직인 사람

세 가지 기준으로 나눠 보면 간단합니다.

바꿀 근거가 있는 경우

  • API로 코딩 작업을 자주 보내는 개발자나 자동화 사용자
  • 에이전트 워크플로를 구성해서 다단계 작업을 돌리는 경우
  • 3.6 Flash의 코딩 결과물에 아쉬움이 있었던 경우

급하지 않은 경우

  • 주로 텍스트 요약이나 번역 같은 단순 작업만 하는 경우
  • 이미 다른 프리미엄 모델(Claude Opus 5 등)을 주력으로 쓰고 있고, Flash 계열을 보조로만 쓰는 경우

코딩 벤치마크 상승폭이 가장 크기 때문에, 코딩·에이전트 비중이 높을수록 체감 차이가 커집니다.

지금 확인하려면

Google AI Studio에서 모델 선택 화면을 열고 Gemini 3.7 Flash를 고르면 됩니다. 무료 티어에서 평소 보내던 프롬프트를 그대로 넣어 보세요. 3.6 결과와 비교하면 본인 작업에서 차이가 나는지 바로 알 수 있습니다.

도입가 기간이 2026년 12월 31일까지이므로, API 비용까지 확인하고 싶다면 이 기간 안에 테스트하는 게 유리합니다.

댓글 남기기