Claude Haiku 4.5
Claude Haiku 4.5 od Anthropic: $1 wejście i $5 wyjście za 1M tokenów, kontekst 200K. Wywołuj przez bramkę LLM odnogi.
Claude Haiku 4.5 jest dostarczany przez Anthropic i wywoływany przez odnogę tym samym formatem zgodnym z OpenAI, co każdy inny model w katalogu. Przyjmuje obrazy obok tekstu. Obsługuje wywoływanie narzędzi i funkcji. Można wymusić zwracanie ustrukturyzowanego JSON-a. Okno kontekstu 200K tokenów wyznacza, ile wejścia zmieścisz w jednym wywołaniu. Pamięć podręczna wejścia kosztuje $0.1 za 1M tokenów, więc powtarzane prefiksy są tańsze.
Specyfikacja i cena
| Dostawca | Anthropic |
|---|---|
| ID modelu | claude-haiku-4-5 |
| Okno kontekstu | 200K tokenów |
| Maks. wyjście | 64K tokenów |
| Możliwości | Vision, Tools, JSON mode, Streaming |
| Za 1M tokenów | Koszt dostawcy | Twoja cena na planie Free+7% |
|---|---|---|
| Wejście | $1 | $1.08 |
| Wyjście | $5 | $5.38 |
| Pamięć podręczna wejścia | $0.1 | $0.108 |
Koszt dostawcy to cena katalogowa za milion tokenów zapisana w katalogu odnoga; Twoja cena stosuje marżę planu tym samym wzorem, który rozlicza każdy request — zobacz cennik. Cennik
Wywołaj przez odnogę
const res = await fetch("https://api.odnoga.com/v1/chat/completions", {
method: "POST",
headers: {
Authorization: `Bearer ${process.env.ODNOGA_API_KEY}`,
"Content-Type": "application/json",
},
body: JSON.stringify({
model: "claude-haiku-4-5",
messages: [{ role: "user", content: "Hello" }],
}),
});
Ten sam format wywołania dla każdego dostawcy — zmieniasz identyfikator modelu, a odnoga zajmuje się kluczami, routingiem, limitami i rozliczeniem kosztów.
Jak używać Claude Haiku 4.5
Zweryfikowano 2026-09-14
Najlepszy do
- Częste zadania, które mimo to wymagają sensownej oceny: Anthropic nazywa go najszybszym modelem o niemal frontierowej inteligencji.
- Funkcje interaktywne, gdzie czas odpowiedzi jest częścią produktu.
- Klasyfikacja, ekstrakcja, streszczanie i routing na skalę.
- Tani pierwszy etap przed Sonnet 5 lub Opus 5.
Nie wybieraj go, gdy
- Długie samodzielne przebiegi agenta i głębokie rozumowanie wieloetapowe.
- Bardzo duże wejścia: okno to 200K tokenów, a nie 1M jak w generacji Sonnet i Opus 5.
- Finalne teksty dla klienta, gdzie o wyniku decyduje niuans.
Praktyczne wskazówki dla odnogi
- 01Zamknij zadanie i podaj jawny schemat wyjścia — właśnie wtedy szybkie modele są najbardziej niezawodne.
- 02Kieruj według trudności: najpierw Haiku, eskalacja przy niskiej pewności. odnoga zapisuje oba etapy, więc udowodnisz, że podział jest tańszy.
- 03Włącz ponowne użycie odpowiedzi odnoga dla deterministycznych wywołań; identyczne powtórzenia nic wtedy nie kosztują u vendora.
- 04Sprawdź limit kontekstu 200K, zanim użyjesz promptu napisanego pod model z oknem 1M.
Ile kosztuje miesiąc
1 000 wywołań miesięcznie, po 10 000 tokenów wejścia i 2 000 tokenów wyjścia, w Twojej cenie na planie Free (koszt dostawcy +7%):
| Wejście (10M tokenów) | $10.75 |
|---|---|
| Wyjście (2M tokenów) | $10.75 |
| Twój koszt miesięcznie na planie Free | $21.51 |
Koszt katalogowy dostawcy $20.00 + marża odnogi $1.51 (+7%). Pamięć podręczna wejścia lub ponowne użycie odpowiedzi ją obniża; odnoga zapisuje obie wartości dla każdego requestu.
Claude Haiku 4.5 w porównaniu
| Model | Kontekst | Wejście / 1M | Wyjście / 1M | Możliwości |
|---|---|---|---|---|
| Claude Haiku 4.5 | 200K | $1 | $5 | Vision, Tools, JSON mode, Streaming |
| Claude Fable 5 | 1M | $10 | $50 | Vision, Tools, Streaming |
| Claude Fable 5.1 | 1M | $10 | $50 | Vision, Tools, Streaming |
Pytania
- Jak szybki naprawdę jest Claude Haiku 4.5?
- Anthropic pozycjonuje go jako swój najszybszy model o niemal frontierowej inteligencji, z kontekstem 200K i wyjściem do 64K. Zmierz opóźnienie na własnych promptach — laboratorium ewaluacji zapisuje medianę opóźnienia per model.
- Czy Haiku zastąpi Sonnet na produkcji?
- Przy zamkniętych, dobrze opisanych zadaniach często tak. Zamroź reprezentatywne przypadki, uruchom oba i pozwól zdecydować kolumnom zdawalności i kosztu.
- Jaki jest najtańszy bezpieczny układ?
- Haiku jako domyślny, mocniejszy model zapasowy przy błędzie lub niskiej pewności, budżet na tenanta i ponowne użycie odpowiedzi dla deterministycznych promptów.
Wszystkie modele · Cennik · Dokumentacja · Porównaj modele w laboratorium ewaluacji
Źródła: Anthropic — Claude Haiku 4.5 overview, Anthropic — models overview