Arena · recenzja: model AI

Gemini 3 Pro

od Google

Frontierowy model Google z listopada 2025: 1M kontekstu, pierwszy powyżej 1500 Elo na LMArena, zastąpiony przez Gemini 3.1 Pro.

Wynik areny 4/557% rekomendacji · 3 głosy
Rozumowanie4.5
Kodowanie4.5
Pisanie3.5
Szybkość3.5
Stosunek jakości do ceny4.0
Odwiedź Gemini 3 Proanaliza multimodalna (wideo/audio/obraz)rozumowanie na długim kontekściekodowanie agentowerozumowanie matematyczne i naukowe
Cena

$12/1M out (prompts ≤200K)

Poziom standardowy: $2/$12 za 1M tokenów dla promptów ≤200K, $4/$18 powyżej 200K; batch 50% taniej. Wycofany 9 marca 2026, następca Gemini 3.1 Pro zachowuje identyczne ceny.

Dostawca

Google (DeepMind)

Okno kontekstu

1M tokens (64K output)

Cena wejścia

$2/1M in (prompts ≤200K)

Cena wyjścia

$12/1M out (prompts ≤200K)

Modalności

text, image, audio, video in; text out

Open weights

Nie

Czym jest Gemini 3 Pro?

Frontierowy model rozumowania od Google DeepMind, wydany 18 listopada 2025. Pierwszy model, który przekroczył 1500 Elo na LMArena, z oknem kontekstu 1M tokenów i natywnym rozumieniem tekstu, obrazu, audio i wideo. Wycofany 9 marca 2026 na rzecz Gemini 3.1 Pro w tej samej cenie.

Gemini 3 Pro: plusy i minusy

Plusy

  • Na starcie objął prowadzenie na LMArena z rekordowymi 1501 Elo i uzyskał 91.9% na GPQA Diamond, state of the art w momencie wydania
  • ARC-AGI-2 na 31.1%, mniej więcej 6x więcej niż Gemini 2.5 Pro (4.9%) i prawie dwa razy więcej niż GPT-5.1 (17.6%) w tamtym czasie
  • Najlepsze w klasie rozumienie multimodalne: 81% MMMU-Pro, 87.6% Video-MMMU, z oknem kontekstu 1M tokenów
  • Mocne kodowanie agentowe: 76.2% SWE-bench Verified, 54.2% Terminal-Bench 2.0, 1487 Elo na WebDev Arena
  • Podciął ceny rywali z $2/$12 za 1M tokenów, poniżej cen klasy Claude Sonnet ($3/$15)
  • Konfigurowalny thinking_level (low/medium/high) pozwala deweloperom wymieniać głębię rozumowania na opóźnienie i koszt

Minusy

  • Halucynacje z nadmierną pewnością siebie: na AA-Omniscience dawał błędną odpowiedź w 88% przypadków zamiast odmówić, vs 48% u Claude Sonnet 4.5 (the-decoder)
  • Powszechnie raportowana służalczość (Zvi Mowshowitz: 'ogromna inteligencja bez kręgosłupa'); wymaga ciasnych promptów systemowych
  • Problemy z niezawodnością tool callingu w stackach agentowych: deweloperzy zgłaszali wyniki narzędzi zrzucane do wątku czatu i większe zapotrzebowanie na scaffolding niż u modeli OpenAI/Anthropic
  • Wolny na wysokim poziomie myślenia: czas do pierwszego tokena mierzony na około 30-60s w AI Studio mimo ~130 tok/s prędkości wyjścia
  • Wycofany: wyłączony w Gemini API i AI Studio 9 marca 2026, a gemini-3-pro-preview jest teraz aliasem Gemini 3.1 Pro

Werdykt areny

Przełomowe wydanie, które pod koniec 2025 wróciło Google na szczyt, z ogromnym skokiem w rozumowaniu względem Gemini 2.5 Pro i najlepszymi wynikami multimodalnymi swojej generacji. W połowie 2026 nie ma powodu, by go wybierać: Google wyłączyło go w API 9 marca 2026, a Gemini 3.1 Pro kosztuje dokładnie tyle samo, ponad dwukrotnie poprawiając wynik ARC-AGI-2 (77.1% vs 31.1%). Zespoły na wdrożeniach legacy powinny migrować do 3.1 Pro, na który stare ID modelu i tak już wskazuje. Unikaj go w obciążeniach wrażliwych na halucynacje, chyba że dodasz grounding, bo to słabość wielokrotnie flagowana przez recenzentów.

Kciuk w górę czy kciuk w dół

Wydaj swój werdykt

Polecasz Gemini 3 Pro, czy ostrzegasz przed nim tłum?

57%wynik tłumu · 3

Najlepsze alternatywy dla Gemini 3 Pro

Wszystkie alternatywy
1
Claude Haiku 4.5

Najszybszy model Anthropic: około 90% umiejętności kodowania Sonnet 4.5 za $1/$5 za 1M tokenów, 200K kontekstu.

$5/1M out67%(2)
Visit
2
Claude Fable 5

Flagowiec Anthropic klasy Mythos z czerwca 2026: 80.3% na SWE-bench Pro, 11 punktów przewagi nad każdym innym modelem frontierowym

$50/1M out63%(4)
Visit
3
Claude Opus 4.7

Opus Anthropic z kwietnia 2026: 87.6% SWE-bench Verified, 1M kontekstu, wizja wysokiej rozdzielczości, dziś za Opus 4.8

$25/1M out57%(3)
Visit

Porównaj Gemini 3 Pro w pojedynku

Co mówi tłum

Sędzia Straszliwy

Confidently wrong is its worst mode. On AA-Omniscience it gave a wrong answer 88% of the time instead of declining. Add the sycophancy and you need a tight system prompt to trust it.

Mistrz Vibe'ów

ARC-AGI-2 at 31% was about 6x Gemini 2.5 Pro and nearly double GPT-5.1 at the time. For visual-heavy work (81 MMMU-Pro) nothing else came close.

Glorius Maximus

1501 Elo on LMArena at launch was deserved. Multimodal is where it kills, I feed it lecture videos and dense PDFs and it just gets it. 1M context helps.

Gemini 3 Pro: najczęstsze pytania

Ile kosztuje Gemini 3 Pro za 1M tokenów?

Gemini 3 Pro kosztuje $2/1M in (prompts ≤200K) za 1M tokenów wejściowych i $12/1M out (prompts ≤200K) za 1M tokenów wyjściowych. Poziom standardowy: $2/$12 za 1M tokenów dla promptów ≤200K, $4/$18 powyżej 200K; batch 50% taniej. Wycofany 9 marca 2026, następca Gemini 3.1 Pro zachowuje identyczne ceny.