สังเวียน · รีวิวโมเดล AI
Gemini 3.5 Flash
โดย Google
เรือธงสายความเร็วของ Google: ชนะ Gemini 3.1 Pro ในงานโค้ดแบบ agentic ที่ $1.50/$9 แต่แพงกว่า 3 Flash ถึง 3 เท่า
$9.00/1M out
แพ็กเกจจ่ายเงินเรตเดียว $1.50/$9.00 ต่อ 1M; batch API ลด 50% ($0.75/$4.50), context caching $0.15/1M บวกค่าเก็บ $1.00/1M ต่อชั่วโมง มีแพ็กเกจฟรีให้ใช้
1M tokens (1,048,576 in / 65,536 out)
$1.50/1M in
$9.00/1M out
text, vision, audio, video, PDF in; text out
ไม่มี
Gemini 3.5 Flash คืออะไร?
โมเดลใช้เหตุผลแบบมัลติโหมดความเร็วสูงของ Google เปิดตัว 19 พฤษภาคม 2026 ที่งาน Google I/O ทำได้ดีกว่า Gemini 3.1 Pro บน benchmark สาย agentic และโค้ด (Terminal-Bench 2.1 76.2%, GDPval-AA 1656 Elo) พร้อมสร้าง output เร็วกว่าโมเดล frontier อื่นราว 4x มี context window 1M โทเค็นพร้อมระดับ thinking effort ปรับได้
ข้อดีและข้อเสียของ Gemini 3.5 Flash
ข้อดี
- ชนะ Gemini 3.1 Pro บน benchmark สาย agentic: 76.2% Terminal-Bench 2.1, 1656 Elo GDPval-AA (เทียบกับ 1314 ของ 3.1 Pro), 83.6% MCP Atlas
- Artificial Analysis Intelligence Index 50 ที่ thinking effort สูง ติดอันดับ #10 จาก 170 โมเดลที่ติดตาม
- สร้าง output เร็วมาก (~185 โทเค็น/วินาที ตาม Artificial Analysis) Google อ้างว่าเร็วกว่าโมเดล frontier อื่น 4x
- Context window 1M โทเค็น (1,048,576) พร้อม input มัลติโหมด: ข้อความ ภาพ เสียง วิดีโอ PDF
- ถูกกว่า Gemini 3.1 Pro ถึง 25% ($1.50/$9 เทียบกับ $2/$12) แต่ทำได้ดีกว่าในงาน agent ระดับ production
- Thinking effort ปรับได้ (minimal/low/medium/high) บวกส่วนลด batch 50% และ context caching ที่ $0.15/1M
ข้อเสีย
- ราคาเพิ่ม 3 เท่าจาก Gemini 3 Flash ($0.50/$3.00) และ 5-6 เท่าจาก 2.5 Flash นักพัฒนาบน HN มองว่า Google กำลังหยั่งเชิงเพดานราคา
- กระตือรือร้นเกินและเยิ่นเย้อ: นักพัฒนารายงานว่ามันมองข้ามเกณฑ์งานเสร็จและแต่งเติมเกินคำสั่ง (ถูกเทียบกับ 'Sonnet 3.7 moment' ของ Claude)
- มีเสียงบ่นเรื่องความเสถียรของการเสิร์ฟสาย Flash: นักพัฒนารายงาน error 503 บ่อยช่วงพีค
- อ่อนกว่าในงาน agentic ระยะยาวที่เครื่องมือมีให้แบบสุ่ม ซึ่งเป็นธีมซ้ำๆ ที่นักพัฒนารายงานกับโมเดลของ Google
- Time-to-first-token สูง (~23 วินาทีที่ thinking effort สูง ตาม Artificial Analysis) ไม่เหมาะกับแชทที่อ่อนไหวต่อ latency
คำตัดสินของสังเวียน
เลือก Gemini 3.5 Flash ถ้าคุณรัน pipeline สายโค้ดแบบ agentic หรือมัลติโหมดปริมาณสูง และต้องการคุณภาพใกล้ระดับ Pro ที่ความเร็ว 4x: มันชนะ Gemini 3.1 Pro จริงบน Terminal-Bench และ GDPval แถมถูกกว่า 25% ควรเลี่ยงถ้าคุณเคยใช้สาย Flash เป็นชั้นราคาประหยัด เพราะมันแพงกว่ารุ่นก่อน Gemini 3 Flash ถึง 3 เท่า ซึ่งยังเป็นตัวเลือกถูกที่ $0.50/$3.00 และข้ามไปเช่นกันสำหรับแชทที่อ่อนไหวต่อ latency ที่ thinking effort สูง (~23 วินาทีกว่าจะได้โทเค็นแรก) หรือ output แบบเคร่งครัดห้ามแต่งเติม ที่ความเยิ่นเย้อของมันจะกลายเป็นศัตรู
ยกนิ้วให้หรือคว่ำนิ้วลง
ออกคำตัดสินของคุณ
คุณจะแนะนำ Gemini 3.5 Flash หรือจะเตือนฝูงชนให้ถอยห่าง?
ทางเลือกที่ดีที่สุดแทน Gemini 3.5 Flash
ทางเลือกทั้งหมดโมเดลที่เร็วที่สุดของ Anthropic: ฝีมือโค้ดราว 90% ของ Sonnet 4.5 ที่ $1/$5 ต่อ 1M โทเค็น context 200K
เรือธงคลาส Mythos ของ Anthropic เดือน มิ.ย. 2026: 80.3% บน SWE-bench Pro นำโมเดล frontier ทุกตัวอยู่ 11 แต้ม
Opus ของ Anthropic เดือน เม.ย. 2026: SWE-bench Verified 87.6%, context 1M, วิชันความละเอียดสูง ปัจจุบันตามหลัง Opus 4.8
เปรียบเทียบ Gemini 3.5 Flash แบบตัวต่อตัว
Gemini 3.5 Flash: คำถามที่พบบ่อย
Gemini 3.5 Flash ราคาเท่าไหร่ต่อ 1M tokens?
Gemini 3.5 Flash ราคา $1.50/1M in ต่อ 1M input tokens และ $9.00/1M out ต่อ 1M output tokens แพ็กเกจจ่ายเงินเรตเดียว $1.50/$9.00 ต่อ 1M; batch API ลด 50% ($0.75/$4.50), context caching $0.15/1M บวกค่าเก็บ $1.00/1M ต่อชั่วโมง มีแพ็กเกจฟรีให้ใช้