grok-4.6
grok-4.6 od xAI: $2 wejście i $6 wyjście za 1M tokenów, kontekst 500K. Wywołuj przez bramkę LLM odnogi.
grok-4.6 jest dostarczany przez xAI i wywoływany przez odnogę tym samym formatem zgodnym z OpenAI, co każdy inny model w katalogu. To model rozumujący — zużywa dodatkowe tokeny wyjściowe na rozumowanie, więc przy trudnych zadaniach licz się z wyższym kosztem wyjścia. Przyjmuje obrazy obok tekstu. Obsługuje wywoływanie narzędzi i funkcji. Okno kontekstu 500K tokenów wyznacza, ile wejścia zmieścisz w jednym wywołaniu. Pamięć podręczna wejścia kosztuje $0.5 za 1M tokenów, więc powtarzane prefiksy są tańsze.
Specyfikacja i cena
| Dostawca | xAI |
|---|---|
| ID modelu | grok-4.6 |
| Okno kontekstu | 500K tokenów |
| Maks. wyjście | — |
| Możliwości | Reasoning, Vision, Tools, Streaming |
| Za 1M tokenów | Koszt dostawcy | Twoja cena na planie Free+7% |
|---|---|---|
| Wejście | $2 | $2.15 |
| Wyjście | $6 | $6.45 |
| Pamięć podręczna wejścia | $0.5 | $0.538 |
Koszt dostawcy to cena katalogowa za milion tokenów zapisana w katalogu odnoga; Twoja cena stosuje marżę planu tym samym wzorem, który rozlicza każdy request — zobacz cennik. Cennik
Wywołaj przez odnogę
const res = await fetch("https://api.odnoga.com/v1/chat/completions", {
method: "POST",
headers: {
Authorization: `Bearer ${process.env.ODNOGA_API_KEY}`,
"Content-Type": "application/json",
},
body: JSON.stringify({
model: "grok-4.6",
messages: [{ role: "user", content: "Hello" }],
}),
});
Ten sam format wywołania dla każdego dostawcy — zmieniasz identyfikator modelu, a odnoga zajmuje się kluczami, routingiem, limitami i rozliczeniem kosztów.
Jak używać grok-4.6
Zweryfikowano 2026-09-14
Najlepszy do
- Kodowanie, zadania agentowe i praca wiedzowa — trzy zastosowania wskazane przez xAI dla tego frontierowego modelu.
- Długie wejścia: okno 500 000 tokenów, wejście tekstowe i obrazowe.
- Workflow oparte na narzędziach: obsługuje wywoływanie funkcji i ustrukturyzowane wyjście.
- Pytania badawcze, gdzie chcesz też wyszukiwania na żywo, rozliczanego za zwrócone pozycje.
Nie wybieraj go, gdy
- Prompty, które przypadkiem przekraczają 200 000 tokenów: powyżej tego progu xAI podwaja cenę za token, więc odrobinę za duży prompt kosztuje dwa razy więcej.
- Bardzo częste, trywialne wywołania — tańszy będzie poziom mini.
- Obciążenia z rygorystycznymi wymogami rezydencji danych w UE, dopóki nie potwierdzisz potrzebnego routingu.
Praktyczne wskazówki dla odnogi
- 01Pilnuj progu 200 000 tokenów: przycinaj lub wyszukuj zamiast wklejać, a rejestr odnoga pokaże, które requesty go przekroczyły.
- 02Cache wejścia kosztuje jedną czwartą ceny wejścia — trzymaj stały prefiks na początku.
- 03Wyszukiwanie na żywo rozlicza się za zwrócone pozycje, więc ogranicz ich liczbę w requeście.
- 04Zamroź prawdziwy request produkcyjny przez przechwytywanie odnoga i porównaj na nim Grok 4.6 z obecnym modelem; deklaracje o frontierze warto sprawdzić na własnych danych.
Ile kosztuje miesiąc
1 000 wywołań miesięcznie, po 10 000 tokenów wejścia i 2 000 tokenów wyjścia, w Twojej cenie na planie Free (koszt dostawcy +7%):
| Wejście (10M tokenów) | $21.51 |
|---|---|
| Wyjście (2M tokenów) | $12.90 |
| Twój koszt miesięcznie na planie Free | $34.41 |
Koszt katalogowy dostawcy $32.00 + marża odnogi $2.41 (+7%). Pamięć podręczna wejścia lub ponowne użycie odpowiedzi ją obniża; odnoga zapisuje obie wartości dla każdego requestu.
grok-4.6 w porównaniu
| Model | Kontekst | Wejście / 1M | Wyjście / 1M | Możliwości |
|---|---|---|---|---|
| grok-4.6 | 500K | $2 | $6 | Reasoning, Vision, Tools, Streaming |
| Grok 3 | 131K | $3 | $15 | Vision, Tools, JSON mode, Streaming |
| Grok 3 Mini | 131K | $0.3 | $0.5 | Reasoning, Tools, JSON mode, Streaming |
Pytania
- Do czego stworzono Grok 4.6?
- xAI opisuje go jako model frontierowy do kodowania, zadań agentowych i pracy wiedzowej, z oknem 500 000 tokenów, wejściem tekstowym i obrazowym, wywoływaniem funkcji, ustrukturyzowanym wyjściem i rozumowaniem.
- Czemu rachunek skoczył przy jednym długim requeście?
- xAI wycenia prompty od 200 000 tokenów mniej więcej dwukrotnie drożej. odnoga zapisuje rozmiar promptu i zastosowaną stawkę per request, więc widać dokładnie, które wywołania przekroczyły próg.
- Jak rozliczane jest wyszukiwanie na żywo?
- Za zwrócone pozycje, nie za wywołanie. Ogranicz liczbę wyników w requeście i sprawdzaj kolumnę kosztu narzędzi w rejestrze odnoga.
Wszystkie modele · Cennik · Dokumentacja · Porównaj modele w laboratorium ewaluacji