สังเวียน · รีวิวโมเดล AI

Kimi K3

โดย Moonshot AI

โมเดล MoE ขนาด 2.8 ล้านล้านพารามิเตอร์จาก Moonshot ที่จุดกระแส 'ช่วงเวลา DeepSeek รอบใหม่' ด้วยคะแนนใกล้ระดับ frontier ในราคา $3/$15

คะแนนสังเวียน 3.7/557% แนะนำ · 3 โหวต
การใช้เหตุผล4.5
การเขียนโค้ด4.5
งานเขียน4.0
ความเร็ว2.0
ความคุ้มค่า3.5
เยี่ยมชม Kimi K3งานเขียนโค้ดและ agent ระดับ frontier นอกกลุ่มคลาวด์ของสหรัฐฯการสร้างงาน frontend (ครองอันดับสูงสุดบน leaderboard ของ Arena.ai)การทำ automation สำหรับ workflow ของ SaaS และการจัดการเครื่องมือทีมที่วางแผนจะรัน open weights ระดับ 3 ล้านล้านพารามิเตอร์ด้วยตัวเอง
ราคา

$15/1M out

ราคาตามรายการอย่างเป็นทางการของ API จาก Moonshot สำหรับ kimi-k3 คือ $3/1M สำหรับอินพุต (cache miss), $0.30/1M เมื่อ cache hit, และ $15/1M สำหรับเอาต์พุตซึ่งรวม reasoning trace ด้วย ในอัตราคงที่ตลอดบริบท 1M (ไม่มีการแบ่งระดับตามความยาว) ราคาเดียวกันคือ $3/$15 มีให้ใช้บน OpenRouter เช่นกัน (แต่ไม่มีการเปิดเผยราคา cache ที่นั่น) ถือเป็นการปรับขึ้นราคา 3 เท่าจากราคา $0.95/$4 ของ Kimi K2.6 ตรวจสอบยืนยันจาก platform.kimi.ai/docs/pricing/chat-k3 เมื่อเดือนกรกฎาคม 2026

ผู้ให้บริการ

Moonshot AI

Context window

1M tokens

ราคา input

$3/1M in

ราคา output

$15/1M out

โมดาลิตี

text, vision, video input

Open weights

ไม่มี

Kimi K3 คืออะไร?

เปิดตัวเมื่อวันที่ 16 กรกฎาคม 2026 โดย Moonshot AI บริษัทสัญชาติจีนที่มีฐานอยู่ในปักกิ่ง และเปิดตัวอย่างเป็นทางการที่งาน World AI Conference ในเซี่ยงไฮ้ Kimi K3 เป็นโมเดล Mixture-of-Experts ขนาด 2.8 ล้านล้านพารามิเตอร์ (มี 896 experts ทำงานพร้อมกัน 16 ตัวต่อโทเคน) พร้อมหน้าต่างบริบท 1M โทเคน และรองรับอินพุตแบบ native ทั้งข้อความ รูปภาพ และวิดีโอ รหัส API kimi-k3 มีราคา $3/1M สำหรับอินพุต ($0.30 เมื่อ cache hit) และ $15/1M สำหรับเอาต์พุต ในอัตราคงที่ตลอดทั้งหน้าต่างบริบท และมีให้ใช้งานบน OpenRouter ด้วย โมเดลนี้ทำอันดับ #3 บน Artificial Analysis Intelligence Index ในวันเปิดตัว ใกล้เคียงกับ Claude Opus 4.8 และ GPT-5.5 จนเกิดพาดหัวข่าวเรื่อง 'ช่วงเวลา DeepSeek รอบใหม่' และแรงเทขายในกลุ่มหุ้นเซมิคอนดักเตอร์ ส่วน open weights (ขนาดราว 594 GB รูปแบบ MXFP4) มีการประกาศว่าจะเผยแพร่วันที่ 27 กรกฎาคม 2026 ซึ่งยังไม่เผยแพร่จริงในช่วงเวลาที่จัดทำข้อมูลนี้ และคาดว่าจะมาพร้อมสัญญาอนุญาตแบบ Modified-MIT แต่ยังไม่ได้รับการยืนยัน

ข้อดีและข้อเสียของ Kimi K3

ข้อดี

  • อันดับ #3 บน Artificial Analysis Intelligence Index (คะแนน 57) ในวันเปิดตัว ใกล้เคียงกับ Claude Opus 4.8 และ GPT-5.5 นับเป็นระยะห่างที่ใกล้ที่สุดเท่าที่ห้องแล็บจีนเคยทำได้เมื่อเทียบกับ frontier แบบปิดของสหรัฐฯ
  • ทำคะแนน 93.4% บน SWE-bench Verified ด้วยระบบทดสอบอิสระของ Vals AI (GPT-5.6 Sol: 96.2%, Claude Fable 5: 95.0%) และครองอันดับ #1 บน Frontend Code Arena ของ Arena.ai ด้วยคะแนน 1679 นำหน้า Fable 5
  • ทำคะแนน 93.5% บน GPQA Diamond (อยู่ระหว่างคะแนน 92.6% ของ Fable 5 กับ 94.1% ของ GPT-5.6) ทำได้ 96.1% บน AIME 2025 และได้ Elo 1668 บน GDPval-AA v2 ซึ่งวัดงาน agentic เป็นรองเพียง Fable 5 เท่านั้น
  • มีศักยภาพด้าน agentic ที่โดดเด่น โดยครองอันดับ #1 บน AutomationBench-AA สำหรับ workflow ประเภท SaaS (53%) นำทาง terminal และ repo ในงานระยะยาวผ่าน Kimi Code และใช้ output token น้อยกว่า K2 ราว 21% ในขณะที่ได้ความสามารถสูงกว่า
  • ราคา $3/$15 ต่อ 1M โทเคน (อินพุตลดเหลือ $0.30 เมื่อ cache hit) ในอัตราคงที่ตลอดบริบท 1M ยังคงต่ำกว่าราคาของโมเดล frontier แบบปิดจากสหรัฐฯ มาก มี API ที่ใช้งานร่วมกับรูปแบบของ OpenAI ได้ และมีให้ใช้งานบน OpenRouter
  • รองรับอินพุตหลายรูปแบบแบบ native (ข้อความ รูปภาพ วิดีโอ) และ open weights ที่ประกาศว่าจะเผยแพร่วันที่ 27 กรกฎาคม 2026 ภายใต้สัญญาอนุญาตที่คาดว่าจะเป็นแบบ Modified-MIT ทำให้เป็นโมเดล frontier แบบ open weights ระดับ 3 ล้านล้านพารามิเตอร์ตัวแรก

ข้อเสีย

  • ราคาพุ่งขึ้น 3 เท่าจาก Kimi K2.6 (จาก $0.95/$4 เป็น $3/$15) ทำให้เป็นโมเดลจีนที่แพงที่สุดเท่าที่เคยเปิดตัวมา และมีราคาเทียบเท่ากับราคาตามรายการของ Claude Sonnet 5 ยุคของ 'ถูกกว่าโมเดลสหรัฐฯ 10 เท่า' จึงถือว่าจบลงแล้ว (Simon Willison เป็นผู้บันทึกการปรับขึ้นราคาครั้งนี้)
  • ช้า โดยทำความเร็วได้เพียง 33 output token ต่อวินาที อยู่ในอันดับที่ #145 จากโมเดลทั้งหมด 190 ตัวบน Artificial Analysis จึงไม่เหมาะกับการใช้งานแบบโต้ตอบ
  • อัตราการหลอนของโมเดล (hallucination) เพิ่มขึ้นจาก 39% (K2.6) เป็น 51% บน AA-Omniscience เนื่องจากโมเดลพยายามตอบคำถามที่เดิมเคยปฏิเสธ (Fable 5 อยู่ในระดับใกล้เคียงกันที่ 54.9%)
  • มีการเซนเซอร์ทางการเมืองในหัวข้ออ่อนไหวเมื่อใช้ภาษาจีนกลาง (หลบเลี่ยงเมื่อพูดถึง Xi, พรรคคอมมิวนิสต์จีน, เทียนอันเหมิน) และข้อมูล API อยู่ภายใต้เขตอำนาจศาลของปักกิ่ง ซึ่งเป็นอุปสรรคด้านการปฏิบัติตามกฎระเบียบสำหรับหลายองค์กรในสหภาพยุโรปและระดับองค์กร นอกจากนี้ UK AISI/CAISI ยังพบว่ามาตรการป้องกันด้านความปลอดภัยไซเบอร์ของโมเดลไม่สามารถสกัดความพยายามพัฒนา exploit ได้ระหว่างการทดสอบ
  • คำว่า 'open weights' ยังเป็นเพียงทฤษฎีสำหรับผู้ใช้ส่วนใหญ่ เพราะขนาดไฟล์ราว 594 GB ในรูปแบบ native MXFP4 ต้องใช้ดาต้าเซ็นเตอร์แบบหลาย GPU ในการรันเอง และตัวไฟล์น้ำหนักโมเดล (รวมถึงสัญญาอนุญาตฉบับสมบูรณ์) ยังไม่ได้เผยแพร่ในช่วงเวลาที่ทำการรีวิว

คำตัดสินของสังเวียน

Kimi K3 คือหลักฐานที่หนักแน่นที่สุดจนถึงตอนนี้ว่าตำแหน่ง frontier ไม่ได้ผูกขาดโดยสหรัฐฯ อีกต่อไป ด้วยอันดับ #3 บน Artificial Analysis คะแนน GPQA และ SWE-bench Verified ระดับแนวหน้า และอันดับ frontend-code arena ที่ดีที่สุดในวงการ ทั้งหมดนี้ในราคาเพียงประมาณครึ่งหนึ่งถึงหนึ่งในสามของราคาโมเดล frontier แบบปิดจากสหรัฐฯ ควรเลือกใช้สำหรับงาน agentic coding งาน frontend และ automation ของ SaaS ซึ่งเป็นจุดที่คะแนน benchmark ของโมเดลนี้แข็งแกร่งที่สุด หรือหากแผนงานต้องพึ่งพาการรันโมเดลระดับ frontier ด้วยตัวเองเมื่อไฟล์น้ำหนักถูกเผยแพร่ ควรหลีกเลี่ยงสำหรับผลิตภัณฑ์ที่ต้องโต้ตอบแบบเรียลไทม์ (33 โทเคนต่อวินาทีถือว่าช้า) สำหรับเนื้อหาที่แตะประเด็นการเมืองอ่อนไหวหรือมีข้อกำหนดด้านที่ตั้งข้อมูลในสหภาพยุโรปที่เข้มงวด (การเซนเซอร์ภาษาจีนกลาง เขตอำนาจศาลปักกิ่ง) และสำหรับงาน retrieval ที่ต้องการความแม่นยำสูง เนื่องจากอัตราการหลอน 51% บน AA-Omniscience จำเป็นต้องมีชั้นการตรวจสอบเพิ่มเติม ทีมที่ให้ความสำคัญกับต้นทุนเป็นพิเศษควรทราบว่า DeepSeek V4 ยังคงให้ปริมาณโทเคนต่อดอลลาร์มากกว่ามาก จุดขายของ K3 คือความสามารถสูงสุดต่อดอลลาร์ ไม่ใช่โทเคนราคาถูกที่สุด

ยกนิ้วให้หรือคว่ำนิ้วลง

ออกคำตัดสินของคุณ

คุณจะแนะนำ Kimi K3 หรือจะเตือนฝูงชนให้ถอยห่าง?

57%คะแนนฝูงชน · 3

ทางเลือกที่ดีที่สุดแทน Kimi K3

ทางเลือกทั้งหมด
1
Claude Haiku 4.5

โมเดลที่เร็วที่สุดของ Anthropic: ฝีมือโค้ดราว 90% ของ Sonnet 4.5 ที่ $1/$5 ต่อ 1M โทเค็น context 200K

$5/1M out67%(2)
Visit
2
Claude Opus 5

รุ่นอัปเดต Opus ของ Anthropic เดือนกรกฎาคม 2026 ให้ความสามารถใกล้เคียง Fable 5 ในราคาเพียงครึ่งเดียว ราคาคงเดิมที่ $5/$25 เท่า Opus 4.8

$25/1M out63%(4)
Visit
3
Claude Fable 5

เรือธงคลาส Mythos ของ Anthropic เดือน มิ.ย. 2026: 80.3% บน SWE-bench Pro นำโมเดล frontier ทุกตัวอยู่ 11 แต้ม

$50/1M out63%(4)
Visit

เปรียบเทียบ Kimi K3 แบบตัวต่อตัว

ฝูงชนว่าอย่างไร

กัปตันเชิร์น

Tried it for our knowledge-base assistant and the hallucination rate is real: it confidently invented two API endpoints in one afternoon. 33 tokens per second on top of that. Back to waiting for the open weights to fine-tune.

โกลเดน ธัมบิคัส

Our Zapier-style automation stack runs on it now. Tool orchestration that GPT-5.5 fumbled works reliably, and the cache-hit pricing makes repeated workflows genuinely cheap.

นักบุญดีพลอยอุส

The Frontend Arena ranking is deserved. Gave it the same dashboard spec I gave Fable 5 and K3's React came out cleaner, with fewer invented props. At $3/$15 through OpenRouter it was a drop-in swap.

Kimi K3: คำถามที่พบบ่อย

Kimi K3 ราคาเท่าไหร่ต่อ 1M tokens?

Kimi K3 ราคา $3/1M in ต่อ 1M input tokens และ $15/1M out ต่อ 1M output tokens ราคาตามรายการอย่างเป็นทางการของ API จาก Moonshot สำหรับ kimi-k3 คือ $3/1M สำหรับอินพุต (cache miss), $0.30/1M เมื่อ cache hit, และ $15/1M สำหรับเอาต์พุตซึ่งรวม reasoning trace ด้วย ในอัตราคงที่ตลอดบริบท 1M (ไม่มีการแบ่งระดับตามความยาว) ราคาเดียวกันคือ $3/$15 มีให้ใช้บน OpenRouter เช่นกัน (แต่ไม่มีการเปิดเผยราคา cache ที่นั่น) ถือเป็นการปรับขึ้นราคา 3 เท่าจากราคา $0.95/$4 ของ Kimi K2.6 ตรวจสอบยืนยันจาก platform.kimi.ai/docs/pricing/chat-k3 เมื่อเดือนกรกฎาคม 2026