アリーナ · AIモデルレビュー
Llama 4 (Scout / Maverick)
開発:Meta
MetaのオープンウェイトMoEデュオ:アクティブ17Bパラメータ、ネイティブ画像入力、公称10M tokensコンテキスト
$0.60/1M out (Maverick, hosted)
Meta純正の有料APIはなく、Maverickの一般的なサードパーティホスティング料金を掲載しています(ScoutはDeepInfraで約$0.10/$0.30 per 1Mから、Groqで$0.11/$0.34)。ホスト版Scoutのコンテキストは公称10Mよりはるかに低く制限されています(例:DeepInfraで約320K)。
Meta
10M tokens (Scout) / 1M (Maverick)
$0.15/1M in (Maverick, hosted)
$0.60/1M out (Maverick, hosted)
text, vision (image input)
あり
Llama 4 (Scout / Maverick) とは?
2025年4月5日にリリースされた、Meta初のネイティブマルチモーダルなmixture-of-expertsオープンウェイトモデルです。Scout(総パラメータ109B、16エキスパート)は公称10M tokensコンテキストでシングルGPU展開を狙い、Maverick(総400B、128エキスパート)は1M tokensウィンドウのフラッグシップチャットモデルです。
Llama 4 (Scout / Maverick) の長所と短所
長所
- MoEの効率性:トークンあたりアクティブなのは17Bパラメータのみ(Scout 109B/16エキスパート、Maverick 400B/128エキスパート)で、わずかな計算量でGPT-4o級に迫るチャット性能を実現します
- ホスト型推論が非常に安価:Maverickは入力約$0.15/1M・出力約$0.60/1Mから、ScoutはDeepInfraで約$0.10/$0.30、Groqで$0.11/$0.34からです
- オープンウェイトモデルでネイティブのearly-fusionマルチモーダリティ(テキストと画像、8枚までテスト済み)を実現しています
- リリース時点でオープンウェイト最大の公称コンテキスト:Scoutで10M tokens、Maverickで1Mです
- ScoutはInt4量子化でH100 GPU 1枚に収まり、200言語で事前学習されています
- 高スループット:アクティブ17Bパラメータで高速プロバイダーなら500+ tokens/sに達します(GroqはScoutを594 TPSと掲載)
短所
- ベンチマークへの信頼が毀損:Metaは未公開のチャット最適化版MaverickをLMArenaに提出し(ELO 1417)、公開ウェイトのスコアはそれより低いため開発者から誤解を招くと批判されました
- 長文コンテキストの主張は実際には崩壊:ScoutのFiction.LiveBench 128Kスコアは約15.6%(Gemini 2.5 Proは90.6%)で、ホスティング各社はScoutを10Mよりはるかに低く制限しています(例:DeepInfraで約320K)
- コーディングはr/LocalLlamaとHNで酷評され、実際の開発タスクでは同価格帯のDeepSeek V3に負けています
- OSI基準のオープンソースではありません:ライセンスはEU所在企業を除外し、700M MAU超には特別ライセンスを要求し、Llamaブランド表記を義務付けます
- 総パラメータ109B/400BはコンシューマーGPUには大きすぎ、系譜も停滞:推論特化版は出荷されず、Behemothはリリースされないままです
アリーナの評決
EU域外で、大量のチャット、抽出、多言語ワークロード向けに安価で高速なセルフホスト可能のマルチモーダルモデルが必要ならLlama 4を選んでください。MaverickはGPT-4o級の品質に約10分の1の価格で迫ります。コーディング、高度な推論、本物の100万トークン検索には避けるべきで、DeepSeek、Qwen 3、Geminiが明確に上回ります。Llama 3.3 70Bと比べればネイティブビジョンと長いウィンドウが加わりましたが、純粋なテキスト品質では旧来の密モデルやQwenの方が信頼できると多くの開発者が感じており、10Mコンテキストはほぼ紙の上の数字です。
親指を上げるか、下げるか
あなたの審判を下す
Llama 4 (Scout / Maverick) を推薦しますか?それとも観客に警告しますか?
Llama 4 (Scout / Maverick) の代替ツールTOP
すべての代替ツールAnthropic最速のモデル:Sonnet 4.5の約90%のコーディング力を$1/$5 per 1M tokensで、200Kコンテキスト。
Anthropicの2026年6月Mythosクラスフラッグシップ:SWE-bench Proで80.3%、他のあらゆるフロンティアモデルに11ポイントの差
Anthropicの2026年4月Opus:SWE-bench Verified 87.6%、1Mコンテキスト、高解像度ビジョン、現在はOpus 4.8に後れ
Llama 4 (Scout / Maverick) を1対1で比較
Llama 4 (Scout / Maverick):よくある質問
Llama 4 (Scout / Maverick) の100万トークンあたりの料金は?
Llama 4 (Scout / Maverick) の料金は、入力100万トークンあたり$0.15/1M in (Maverick, hosted)、出力100万トークンあたり$0.60/1M out (Maverick, hosted)です。 Meta純正の有料APIはなく、Maverickの一般的なサードパーティホスティング料金を掲載しています(ScoutはDeepInfraで約$0.10/$0.30 per 1Mから、Groqで$0.11/$0.34)。ホスト版Scoutのコンテキストは公称10Mよりはるかに低く制限されています(例:DeepInfraで約320K)。