Gemini 3.5 Flash-Lite

Gemini 3.5 Flash-Lite od Google AI: $0.3 wejście i $2.50 wyjście za 1M tokenów, kontekst 1.0M. Wywołuj przez bramkę LLM odnogi.

ReasoningVisionToolsJSON modeStreaming

Gemini 3.5 Flash-Lite jest dostarczany przez Google AI i wywoływany przez odnogę tym samym formatem zgodnym z OpenAI, co każdy inny model w katalogu. To model rozumujący — zużywa dodatkowe tokeny wyjściowe na rozumowanie, więc przy trudnych zadaniach licz się z wyższym kosztem wyjścia. Przyjmuje obrazy obok tekstu. Obsługuje wywoływanie narzędzi i funkcji. Można wymusić zwracanie ustrukturyzowanego JSON-a. Okno kontekstu 1.0M tokenów wyznacza, ile wejścia zmieścisz w jednym wywołaniu. Pamięć podręczna wejścia kosztuje $0.03 za 1M tokenów, więc powtarzane prefiksy są tańsze.

Specyfikacja i cena

DostawcaGoogle AI
ID modelugemini-3.5-flash-lite
Okno kontekstu1.0M tokenów
Maks. wyjście66K tokenów
MożliwościReasoning, Vision, Tools, JSON mode, Streaming
Twój plan
Za 1M tokenówKoszt dostawcyTwoja cena na planie Free+7%
Wejście$0.3$0.323
Wyjście$2.50$2.69
Pamięć podręczna wejścia$0.03$0.032

Koszt dostawcy to cena katalogowa za milion tokenów zapisana w katalogu odnoga; Twoja cena stosuje marżę planu tym samym wzorem, który rozlicza każdy request — zobacz cennik. Cennik

Wywołaj przez odnogę

const res = await fetch("https://api.odnoga.com/v1/chat/completions", {
  method: "POST",
  headers: {
    Authorization: `Bearer ${process.env.ODNOGA_API_KEY}`,
    "Content-Type": "application/json",
  },
  body: JSON.stringify({
    model: "gemini-3.5-flash-lite",
    messages: [{ role: "user", content: "Hello" }],
  }),
});

Ten sam format wywołania dla każdego dostawcy — zmieniasz identyfikator modelu, a odnoga zajmuje się kluczami, routingiem, limitami i rozliczeniem kosztów.

Jak używać Gemini 3.5 Flash-Lite

Opracowano na podstawie danych tego modelu w katalogu odnogi.

Najlepszy do

  • Problemy wieloetapowe, które trzeba rozpisać: planowanie, debugowanie, uzgadnianie danych, analiza z krokami pośrednimi.
  • Zadania łączące obraz z tekstem — zrzuty ekranu, skany dokumentów, wykresy, zdjęcia produktów.
  • Agenci i workflow wywołujące Twoje funkcje — model obsługuje wywoływanie narzędzi.
  • Wyjście nadające się do zapisu w bazie — wymuszony JSON.
  • Długie wejścia: okno 1.0M tokenów mieści całe umowy, repozytoria lub transkrypcje w jednym requeście.
  • Czaty dla użytkownika, gdzie odpowiedź ma pojawiać się w trakcie pisania.

Nie wybieraj go, gdy

  • Proste, częste wywołania — rozumowanie zużywa dodatkowe tokeny wyjściowe, więc model bez rozumowania z tego samego katalogu bywa tańszy i szybszy.
  • Zadania, gdzie błędna odpowiedź jest kosztowna bez kontroli człowieka — żaden model w katalogu tego nie znosi.

Praktyczne wskazówki dla odnogi

  1. 01Przypnij id modelu do wersji zarządzanego promptu — zmiana modelu jest wtedy zmianą wersji, którą można porównać i wycofać, a nie edycją w kodzie aplikacji.
  2. 02Porównaj go z 2–8 innymi modelami na tych samych zamrożonych przypadkach testowych w laboratorium ewaluacji, zanim ustawisz go jako domyślny w produkcji.
  3. 03Trzymaj stałą część promptu na początku: cache wejścia kosztuje $0.03 za 1M tokenów zamiast $0.3.
  4. 04Przy powtarzalnych, deterministycznych wywołaniach odnoga zwraca zapisaną odpowiedź i nie nalicza tokenów vendora — wyłącz to dla treści kreatywnych.
  5. 05Proś o JSON przez format odpowiedzi, a nie w treści promptu — schemat jest wtedy wymuszony, a nie sugerowany.
  6. 06Zaplanuj budżet tokenów wyjściowych: rozumowanie liczy się po stronie wyjścia, więc krótka odpowiedź nadal bywa drogim wywołaniem.
  7. 07Ustaw model zapasowy na trasie, by awaria vendora obniżała jakość zamiast zwracać błąd, oraz budżet na tenanta, by jeden klient nie wydał całego miesiąca.

Ile kosztuje miesiąc

1 000 wywołań miesięcznie, po 10 000 tokenów wejścia i 2 000 tokenów wyjścia, w Twojej cenie na planie Free (koszt dostawcy +7%):

Wejście (10M tokenów)$3.23
Wyjście (2M tokenów)$5.38
Twój koszt miesięcznie na planie Free$8.60

Koszt katalogowy dostawcy $8.00 + marża odnogi $0.602 (+7%). Pamięć podręczna wejścia lub ponowne użycie odpowiedzi ją obniża; odnoga zapisuje obie wartości dla każdego requestu.

Gemini 3.5 Flash-Lite w porównaniu

ModelKontekstWejście / 1MWyjście / 1MMożliwości
Gemini 3.5 Flash-Lite1.0M$0.3$2.50Reasoning, Vision, Tools, JSON mode, Streaming
Gemini 2.5 Computer Use131K$1$5Vision, Tools, JSON mode, Streaming
Gemini 2.5 Flash Image (Nano Banana)33K$0.3$2.50Vision

Pytania

Ile kosztuje Gemini 3.5 Flash-Lite za 1M tokenów?
Google AI podaje $0.3 / $2.50 za 1M tokenów wejścia / wyjścia w katalogu odnoga. Przez odnoga płacisz cenę vendora plus marżę planu, a każdy request zapisuje obie wartości.
Do czego najlepiej nadaje się Gemini 3.5 Flash-Lite?
Problemy wieloetapowe, które trzeba rozpisać: planowanie, debugowanie, uzgadnianie danych, analiza z krokami pośrednimi. Zadania łączące obraz z tekstem — zrzuty ekranu, skany dokumentów, wykresy, zdjęcia produktów. Agenci i workflow wywołujące Twoje funkcje — model obsługuje wywoływanie narzędzi.
Czy mogę przełączyć się na Gemini 3.5 Flash-Lite bez zmiany kodu?
Tak. odnoga udostępnia jeden endpoint zgodny z OpenAI — przełączenie to wysłanie "gemini-3.5-flash-lite" jako id modelu lub zmiana w wersji zarządzanego promptu, bez wdrożenia aplikacji.
Jak duże jest okno kontekstu Gemini 3.5 Flash-Lite?
1.0M tokenów wejścia, do 66K tokenów wyjścia na odpowiedź.

Wszystkie modele · Cennik · Dokumentacja · Porównaj modele w laboratorium ewaluacji

Jedna bramka, każdy model.