A arena · análise de modelo de IA
Gemini 3.5 Flash
por Google
O carro-chefe da linha rápida do Google: supera o Gemini 3.1 Pro em código agêntico a $1.50/$9, 3x mais caro que o 3 Flash
$9.00/1M out
Nível pago a tarifa fixa de $1.50/$9.00 por 1M; batch API com 50% de desconto ($0.75/$4.50), context caching a $0.15/1M mais $1.00/1M por hora de armazenamento, plano gratuito disponível
1M tokens (1,048,576 in / 65,536 out)
$1.50/1M in
$9.00/1M out
text, vision, audio, video, PDF in; text out
Não
O que é o Gemini 3.5 Flash?
Modelo multimodal rápido de raciocínio do Google, lançado em 19 de maio de 2026 no Google I/O. Supera o Gemini 3.1 Pro em benchmarks agênticos e de código (Terminal-Bench 2.1 76.2%, GDPval-AA 1656 de Elo) enquanto gera saída cerca de 4x mais rápido que outros modelos de fronteira. Janela de contexto de 1M de tokens com níveis de effort de thinking ajustáveis.
Gemini 3.5 Flash: prós e contras
Prós
- Supera o Gemini 3.1 Pro em benchmarks agênticos: 76.2% no Terminal-Bench 2.1, 1656 de Elo no GDPval-AA (contra 1314 do 3.1 Pro), 83.6% no MCP Atlas
- Artificial Analysis Intelligence Index de 50 em effort de thinking alto, ficando em #10 de 170 modelos monitorados
- Geração muito rápida (~185 tokens de saída/seg segundo a Artificial Analysis); o Google afirma saída 4x mais rápida que outros modelos de fronteira
- Janela de contexto de 1M de tokens (1,048,576) com entrada multimodal: texto, imagem, áudio, vídeo, PDF
- 25% mais barato que o Gemini 3.1 Pro ($1.50/$9 vs $2/$12) enquanto o supera em cargas de agentes em produção
- Effort de thinking ajustável (minimal/low/medium/high) mais 50% de desconto no batch e context caching a $0.15/1M
Contras
- Aumento de preço de 3x sobre o Gemini 3 Flash ($0.50/$3.00) e de 5-6x sobre o 2.5 Flash; devs do HN viram o Google testando a tolerância a preço
- Afobado e verboso: devs relatam que ele ignora critérios de conclusão e enfeita além das instruções (comparado ao 'momento Sonnet 3.7' do Claude)
- Queixas de confiabilidade no serving do Flash: desenvolvedores relatam erros 503 frequentes em horários de pico
- Mais fraco em tarefas agênticas de longo horizonte com disponibilidade arbitrária de ferramentas, um tema recorrente que devs relatam com modelos do Google
- Alto tempo até o primeiro token (~23s em effort de thinking alto segundo a Artificial Analysis), péssimo para chat sensível a latência
O veredicto da arena
Escolha o Gemini 3.5 Flash se você roda código agêntico ou pipelines multimodais de alto volume e quer qualidade quase nível Pro a 4x a velocidade: ele de fato supera o Gemini 3.1 Pro no Terminal-Bench e no GDPval custando 25% menos. Evite-o se você usava a linha Flash como nível econômico, já que ele custa 3x o antecessor Gemini 3 Flash, que continua sendo a opção barata a $0.50/$3.00. Pule-o também para chat sensível a latência em effort de thinking alto (~23s até o primeiro token) ou para saídas estritas, sem enfeites, onde a verbosidade dele joga contra.
Polegar para cima ou para baixo
Dê seu veredicto
Você recomendaria o Gemini 3.5 Flash ou avisaria a multidão para ficar longe?
Melhores alternativas ao Gemini 3.5 Flash
Todas as alternativasO modelo mais rápido da Anthropic: cerca de 90% da habilidade de código do Sonnet 4.5 a $1/$5 por 1M de tokens, contexto de 200K.
O carro-chefe da classe Mythos da Anthropic de junho de 2026: 80.3% no SWE-bench Pro, 11 pontos à frente de todos os outros modelos de fronteira
O Opus da Anthropic de abril de 2026: 87.6% no SWE-bench Verified, contexto de 1M, visão de alta resolução, hoje atrás do Opus 4.8
Compare o Gemini 3.5 Flash frente a frente
Gemini 3.5 Flash: perguntas frequentes
Quanto custa o Gemini 3.5 Flash por 1M de tokens?
O Gemini 3.5 Flash custa $1.50/1M in por 1M de tokens de entrada e $9.00/1M out por 1M de tokens de saída. Nível pago a tarifa fixa de $1.50/$9.00 por 1M; batch API com 50% de desconto ($0.75/$4.50), context caching a $0.15/1M mais $1.00/1M por hora de armazenamento, plano gratuito disponível