Gemini 3.1 Pro Preview
Gemini 3.1 Pro Preview od Google AI: $2 wejście i $12 wyjście za 1M tokenów, kontekst 1.0M. Wywołuj przez bramkę LLM odnogi.
Gemini 3.1 Pro Preview jest dostarczany przez Google AI i wywoływany przez odnogę tym samym formatem zgodnym z OpenAI, co każdy inny model w katalogu. To model rozumujący — zużywa dodatkowe tokeny wyjściowe na rozumowanie, więc przy trudnych zadaniach licz się z wyższym kosztem wyjścia. Przyjmuje obrazy obok tekstu. Obsługuje wywoływanie narzędzi i funkcji. Można wymusić zwracanie ustrukturyzowanego JSON-a. Okno kontekstu 1.0M tokenów wyznacza, ile wejścia zmieścisz w jednym wywołaniu. Pamięć podręczna wejścia kosztuje $0.2 za 1M tokenów, więc powtarzane prefiksy są tańsze.
Specyfikacja i cena
| Dostawca | Google AI |
|---|---|
| ID modelu | gemini-3.1-pro-preview |
| Okno kontekstu | 1.0M tokenów |
| Maks. wyjście | 66K tokenów |
| Możliwości | Reasoning, Vision, Tools, JSON mode, Streaming |
| Za 1M tokenów | Koszt dostawcy | Twoja cena na planie Free+7% |
|---|---|---|
| Wejście | $2 | $2.15 |
| Wyjście | $12 | $12.90 |
| Pamięć podręczna wejścia | $0.2 | $0.215 |
Koszt dostawcy to cena katalogowa za milion tokenów zapisana w katalogu odnoga; Twoja cena stosuje marżę planu tym samym wzorem, który rozlicza każdy request — zobacz cennik. Cennik
Wywołaj przez odnogę
const res = await fetch("https://api.odnoga.com/v1/chat/completions", {
method: "POST",
headers: {
Authorization: `Bearer ${process.env.ODNOGA_API_KEY}`,
"Content-Type": "application/json",
},
body: JSON.stringify({
model: "gemini-3.1-pro-preview",
messages: [{ role: "user", content: "Hello" }],
}),
});
Ten sam format wywołania dla każdego dostawcy — zmieniasz identyfikator modelu, a odnoga zajmuje się kluczami, routingiem, limitami i rozliczeniem kosztów.
Jak używać Gemini 3.1 Pro Preview
Zweryfikowano 2026-09-14
Najlepszy do
- Złożone problemy na mieszanych źródłach: Google opisuje go jako swój najbardziej zaawansowany model Gemini do rozumowania, obsługujący tekst, audio, obrazy, wideo, PDF-y i całe repozytoria kodu.
- Zachowania inżynierskie i workflow agentowe wymagające precyzyjnego użycia narzędzi i niezawodnego wykonania wielu kroków.
- Analiza bardzo dużych wejść przy oknie 1M tokenów.
- Zadania, w których spójność faktograficzna i oszczędność tokenów ważą więcej niż surowa szybkość.
Nie wybieraj go, gdy
- Masowy ruch wrażliwy na opóźnienie — właściwą odpowiedzią jest poziom Flash.
- Wsadowa praca wrażliwa na koszt: cena poziomu Pro szybko daje o sobie znać przy skali.
- Ścieżki produkcyjne, które nie zniosą zmiany id modelu w wersji preview.
Praktyczne wskazówki dla odnogi
- 01Użyj go do trudnego ogona ruchu, a poziomu Flash do reszty — routing per prompt to właśnie sens bramki.
- 02Daj mu źródła, a nie ich streszczenie; jego przewagą jest rozumienie dużych, mieszanych wejść.
- 03Ponieważ to id w wersji preview, przypnij je do wersji zarządzanego promptu i zostaw poprzedni model gotowy do natychmiastowego powrotu.
- 04Śledź koszt per tenant: rozumowanie na poziomie Pro przy długim wejściu to najdroższa kombinacja w każdym katalogu.
Ile kosztuje miesiąc
1 000 wywołań miesięcznie, po 10 000 tokenów wejścia i 2 000 tokenów wyjścia, w Twojej cenie na planie Free (koszt dostawcy +7%):
| Wejście (10M tokenów) | $21.51 |
|---|---|
| Wyjście (2M tokenów) | $25.81 |
| Twój koszt miesięcznie na planie Free | $47.31 |
Koszt katalogowy dostawcy $44.00 + marża odnogi $3.31 (+7%). Pamięć podręczna wejścia lub ponowne użycie odpowiedzi ją obniża; odnoga zapisuje obie wartości dla każdego requestu.
Gemini 3.1 Pro Preview w porównaniu
| Model | Kontekst | Wejście / 1M | Wyjście / 1M | Możliwości |
|---|---|---|---|---|
| Gemini 3.1 Pro Preview | 1.0M | $2 | $12 | Reasoning, Vision, Tools, JSON mode, Streaming |
| Gemini 2.5 Computer Use | 131K | $1 | $5 | Vision, Tools, JSON mode, Streaming |
| Gemini 2.5 Flash Image (Nano Banana) | 33K | $0.3 | $2.50 | Vision |
Pytania
- Do czego stworzono Gemini 3.1 Pro Preview?
- Google opisuje go jako dopracowanie serii Gemini 3 Pro: lepsze myślenie, wyższa efektywność tokenowa i bardziej ugruntowane, spójne faktograficznie odpowiedzi, z optymalizacją pod inżynierię oprogramowania i workflow agentowe.
- Czy uruchamiać model preview na produkcji?
- Tylko z przypiętą wersją promptu i przetestowanym modelem zapasowym. odnoga pozwala cofnąć etykietę produkcyjną na poprzedni model bez zmian w aplikacji.
- Czy kontekst 1M jest wart swojej ceny?
- Czasem. Porównaj prompt z długim kontekstem z wariantem opartym na wyszukiwaniu na tych samych zamrożonych przypadkach — laboratorium pokazuje tokeny i koszt obok zdawalności, więc kompromis jest zmierzony, a nie przedyskutowany.
Wszystkie modele · Cennik · Dokumentacja · Porównaj modele w laboratorium ewaluacji
Źródła: Google AI for Developers — Gemini 3.1 Pro preview, Google DeepMind — Gemini 3.1 Pro model card
Inne modele Google AI
Gemini 2.5 Computer Use
$1 / $5 za 1M
Gemini 2.5 Flash Image (Nano Banana)
$0.3 / $2.50 za 1M
Gemini 2.5 Flash Native Audio (Live)
$0.5 / $2 za 1M
Gemini 2.5 Flash TTS
$0.5 / $10 za 1M
Gemini 2.5 Pro
$1.25 / $10 za 1M
Gemini 2.5 Pro TTS
$1 / $20 za 1M
Gemini 3 Flash Preview
$0.5 / $3 za 1M
Gemini 3 Pro Image (Nano Banana Pro)
$2 / $12 za 1M