아레나 · AI 모델 리뷰

Gemini 3.5 Flash

제공: Google

Google의 속도 티어 플래그십: 에이전트 코딩에서 Gemini 3.1 Pro를 $1.50/$9에 능가, 다만 3 Flash보다 3배 비쌈

아레나 점수 4/5
추론3.5
코딩4.0
글쓰기3.0
속도5.0
가성비4.5
Gemini 3.5 Flash 방문코딩 에이전트대규모 에이전트 워크플로멀티모달 분석(영상, 오디오, PDF)대용량 API 트래픽의 고속 추론
가격

$9.00/1M out

유료 티어 균일가 1M당 $1.50/$9.00. 배치 API 50% 할인($0.75/$4.50), 컨텍스트 캐싱 $0.15/1M에 시간당 저장료 $1.00/1M, 무료 티어 제공

제공사

Google

컨텍스트 윈도우

1M tokens (1,048,576 in / 65,536 out)

입력 가격

$1.50/1M in

출력 가격

$9.00/1M out

모달리티

text, vision, audio, video, PDF in; text out

오픈 웨이트

없음

Gemini 3.5 Flash은(는) 어떤 툴인가?

2026년 5월 19일 Google I/O에서 출시된 Google의 고속 멀티모달 추론 모델입니다. 에이전트 및 코딩 벤치마크에서 Gemini 3.1 Pro를 능가하며(Terminal-Bench 2.1 76.2%, GDPval-AA 1656 Elo), 다른 프런티어 모델보다 약 4배 빠르게 출력을 생성합니다. 조절 가능한 사고 effort 레벨과 1M 토큰 컨텍스트 윈도우를 갖췄습니다.

Gemini 3.5 Flash의 장단점

장점

  • 에이전트 벤치마크에서 Gemini 3.1 Pro를 능가합니다: Terminal-Bench 2.1 76.2%, GDPval-AA 1656 Elo(3.1 Pro는 1314), MCP Atlas 83.6%
  • high 사고 effort에서 Artificial Analysis Intelligence Index 50으로, 추적 대상 170개 모델 중 10위
  • 매우 빠른 생성 속도(Artificial Analysis 기준 약 185 output tokens/sec). Google은 다른 프런티어 모델보다 4배 빠른 출력을 주장합니다
  • 1M 토큰 컨텍스트 윈도우(1,048,576)와 멀티모달 입력: 텍스트, 이미지, 오디오, 영상, PDF
  • Gemini 3.1 Pro보다 25% 저렴하면서($1.50/$9 vs $2/$12) 프로덕션 에이전트 워크로드에서는 오히려 앞섭니다
  • 조절 가능한 사고 effort(minimal/low/medium/high), 50% 배치 할인, $0.15/1M 컨텍스트 캐싱

단점

  • Gemini 3 Flash($0.50/$3.00) 대비 3배, 2.5 Flash 대비 5-6배 가격 인상: HN 개발자들은 Google이 가격 저항선을 시험한다고 봤습니다
  • 과욕과 장황함: 완료 기준을 무시하고 지시 이상으로 덧붙인다는 개발자 보고가 있습니다(Claude의 'Sonnet 3.7 시절'에 비유됨)
  • Flash 서빙 안정성 불만: 피크 시간대에 503 오류가 잦다는 개발자 보고가 있습니다
  • 임의의 툴이 주어지는 장기 에이전트 작업에 약합니다, Google 모델에서 반복적으로 지적되는 패턴입니다
  • 첫 토큰까지의 시간이 깁니다(Artificial Analysis 기준 high 사고 effort에서 약 23초). 지연 시간에 민감한 챗에는 부적합합니다

아레나의 평결

에이전트 코딩이나 대용량 멀티모달 파이프라인을 운영하면서 Pro급 품질을 4배 속도로 원한다면 Gemini 3.5 Flash를 선택하십시오: Terminal-Bench와 GDPval에서 실제로 Gemini 3.1 Pro를 이기면서 25% 저렴합니다. Flash 라인을 저가 티어로 써 왔다면 피하십시오, 전작 Gemini 3 Flash보다 3배 비싸며, 저가 옵션은 여전히 $0.50/$3.00의 3 Flash입니다. high 사고 effort에서 지연 시간에 민감한 챗(첫 토큰까지 약 23초)이나, 덧붙임 없는 엄격한 출력이 필요한 경우에도 장황함이 발목을 잡으니 건너뛰십시오.

엄지 위인가, 엄지 아래인가

평결을 내리세요

Gemini 3.5 Flash을(를) 추천하시겠습니까, 아니면 대중에게 경고하시겠습니까?

50%대중 점수 · 0

Gemini 3.5 Flash 대안 베스트

모든 대안 보기
1
Claude Haiku 4.5

Anthropic의 최고속 모델: Sonnet 4.5 코딩 실력의 약 90%를 1M 토큰당 $1/$5에, 200K 컨텍스트.

$5/1M out67%(2)
Visit
2
Claude Fable 5

Anthropic의 2026년 6월 Mythos급 플래그십: SWE-bench Pro 80.3%, 다른 모든 프런티어 모델을 11점 차로 앞섬

$50/1M out63%(4)
Visit
3
Claude Opus 4.7

Anthropic의 2026년 4월 Opus: SWE-bench Verified 87.6%, 1M 컨텍스트, 고해상도 비전, 현재는 Opus 4.8에 뒤처짐

$25/1M out57%(3)
Visit

Gemini 3.5 Flash 1:1 비교

Gemini 3.5 Flash: 자주 묻는 질문

Gemini 3.5 Flash의 1M 토큰당 비용은 얼마인가요?

Gemini 3.5 Flash은(는) 입력 토큰 1M당 $1.50/1M in, 출력 토큰 1M당 $9.00/1M out입니다. 유료 티어 균일가 1M당 $1.50/$9.00. 배치 API 50% 할인($0.75/$4.50), 컨텍스트 캐싱 $0.15/1M에 시간당 저장료 $1.00/1M, 무료 티어 제공