GPT-4o Transcribe

GPT-4o Transcribe od OpenAI: $2.50 wejście i $10 wyjście za 1M tokenów, kontekst —. Wywołuj przez bramkę LLM odnogi.

Streaming

GPT-4o Transcribe jest dostarczany przez OpenAI i wywoływany przez odnogę tym samym formatem zgodnym z OpenAI, co każdy inny model w katalogu.

Specyfikacja i cena

DostawcaOpenAI
ID modelugpt-4o-transcribe
Okno kontekstu— tokenów
Maks. wyjście
MożliwościStreaming
Twój plan
Za 1M tokenówKoszt dostawcyTwoja cena na planie Free+7%
Wejście$2.50$2.69
Wyjście$10$10.75
Pamięć podręczna wejścia

Koszt dostawcy to cena katalogowa za milion tokenów zapisana w katalogu odnoga; Twoja cena stosuje marżę planu tym samym wzorem, który rozlicza każdy request — zobacz cennik. Cennik

Wywołaj przez odnogę

const res = await fetch("https://api.odnoga.com/v1/chat/completions", {
  method: "POST",
  headers: {
    Authorization: `Bearer ${process.env.ODNOGA_API_KEY}`,
    "Content-Type": "application/json",
  },
  body: JSON.stringify({
    model: "gpt-4o-transcribe",
    messages: [{ role: "user", content: "Hello" }],
  }),
});

Ten sam format wywołania dla każdego dostawcy — zmieniasz identyfikator modelu, a odnoga zajmuje się kluczami, routingiem, limitami i rozliczeniem kosztów.

Jak używać GPT-4o Transcribe

Opracowano na podstawie danych tego modelu w katalogu odnogi.

Najlepszy do

  • Wywołania masowe i wrażliwe na opóźnienie: klasyfikacja, ekstrakcja, routing, krótkie przeredagowania i streszczenia.
  • Czaty dla użytkownika, gdzie odpowiedź ma pojawiać się w trakcie pisania.

Nie wybieraj go, gdy

  • Zadania wymagające odczytu obrazu — ten model przyjmuje tylko tekst.
  • Pętle agentowe wywołujące Twoje funkcje — brak obsługi narzędzi.
  • Procesy wymagające gwarantowanego JSON-a — parsuj defensywnie albo wybierz model z wymuszonym JSON-em.
  • Zadania, gdzie błędna odpowiedź jest kosztowna bez kontroli człowieka — żaden model w katalogu tego nie znosi.

Praktyczne wskazówki dla odnogi

  1. 01Przypnij id modelu do wersji zarządzanego promptu — zmiana modelu jest wtedy zmianą wersji, którą można porównać i wycofać, a nie edycją w kodzie aplikacji.
  2. 02Porównaj go z 2–8 innymi modelami na tych samych zamrożonych przypadkach testowych w laboratorium ewaluacji, zanim ustawisz go jako domyślny w produkcji.
  3. 03Przy powtarzalnych, deterministycznych wywołaniach odnoga zwraca zapisaną odpowiedź i nie nalicza tokenów vendora — wyłącz to dla treści kreatywnych.
  4. 04Ustaw model zapasowy na trasie, by awaria vendora obniżała jakość zamiast zwracać błąd, oraz budżet na tenanta, by jeden klient nie wydał całego miesiąca.

Ile kosztuje miesiąc

1 000 wywołań miesięcznie, po 10 000 tokenów wejścia i 2 000 tokenów wyjścia, w Twojej cenie na planie Free (koszt dostawcy +7%):

Wejście (10M tokenów)$26.88
Wyjście (2M tokenów)$21.51
Twój koszt miesięcznie na planie Free$48.39

Koszt katalogowy dostawcy $45.00 + marża odnogi $3.39 (+7%). Pamięć podręczna wejścia lub ponowne użycie odpowiedzi ją obniża; odnoga zapisuje obie wartości dla każdego requestu.

GPT-4o Transcribe w porównaniu

ModelKontekstWejście / 1MWyjście / 1MMożliwości
GPT-4o Transcribe$2.50$10Streaming
ChatGPT (chat-latest)400K$5$30Vision, Tools, JSON mode, Streaming
GPT Image 1 mini$2$8Vision

Pytania

Ile kosztuje GPT-4o Transcribe za 1M tokenów?
OpenAI podaje $2.50 / $10 za 1M tokenów wejścia / wyjścia w katalogu odnoga. Przez odnoga płacisz cenę vendora plus marżę planu, a każdy request zapisuje obie wartości.
Do czego najlepiej nadaje się GPT-4o Transcribe?
Wywołania masowe i wrażliwe na opóźnienie: klasyfikacja, ekstrakcja, routing, krótkie przeredagowania i streszczenia. Czaty dla użytkownika, gdzie odpowiedź ma pojawiać się w trakcie pisania.
Czy mogę przełączyć się na GPT-4o Transcribe bez zmiany kodu?
Tak. odnoga udostępnia jeden endpoint zgodny z OpenAI — przełączenie to wysłanie "gpt-4o-transcribe" jako id modelu lub zmiana w wersji zarządzanego promptu, bez wdrożenia aplikacji.

Wszystkie modele · Cennik · Dokumentacja · Porównaj modele w laboratorium ewaluacji

Gdzie mieści się ten model

Jedna bramka, każdy model.