GPT Realtime Whisper

GPT Realtime Whisper od OpenAI: rozliczany za jednostkę mediów (sekundę, obraz lub minutę audio), kontekst —. Wywołuj przez bramkę LLM odnogi; stawkę znajdziesz na stronie cennika.

Streaming

GPT Realtime Whisper jest dostarczany przez OpenAI i wywoływany przez odnogę tym samym formatem zgodnym z OpenAI, co każdy inny model w katalogu.

Specyfikacja i cena

DostawcaOpenAI
ID modelugpt-realtime-whisper
Okno kontekstu— tokenów
Maks. wyjście
CennikZa jednostkę mediów (sekunda / obraz / minuta) — zobacz cennik
MożliwościStreaming

Koszt dostawcy to cena katalogowa za milion tokenów zapisana w katalogu odnoga; Twoja cena stosuje marżę planu tym samym wzorem, który rozlicza każdy request — zobacz cennik. Cennik

Wywołaj przez odnogę

const res = await fetch("https://api.odnoga.com/v1/chat/completions", {
  method: "POST",
  headers: {
    Authorization: `Bearer ${process.env.ODNOGA_API_KEY}`,
    "Content-Type": "application/json",
  },
  body: JSON.stringify({
    model: "gpt-realtime-whisper",
    messages: [{ role: "user", content: "Hello" }],
  }),
});

Ten sam format wywołania dla każdego dostawcy — zmieniasz identyfikator modelu, a odnoga zajmuje się kluczami, routingiem, limitami i rozliczeniem kosztów.

Jak używać GPT Realtime Whisper

Opracowano na podstawie danych tego modelu w katalogu odnogi.

Najlepszy do

  • Wywołania masowe i wrażliwe na opóźnienie: klasyfikacja, ekstrakcja, routing, krótkie przeredagowania i streszczenia.
  • Czaty dla użytkownika, gdzie odpowiedź ma pojawiać się w trakcie pisania.

Nie wybieraj go, gdy

  • Zadania wymagające odczytu obrazu — ten model przyjmuje tylko tekst.
  • Pętle agentowe wywołujące Twoje funkcje — brak obsługi narzędzi.
  • Procesy wymagające gwarantowanego JSON-a — parsuj defensywnie albo wybierz model z wymuszonym JSON-em.
  • Zadania, gdzie błędna odpowiedź jest kosztowna bez kontroli człowieka — żaden model w katalogu tego nie znosi.

Praktyczne wskazówki dla odnogi

  1. 01Przypnij id modelu do wersji zarządzanego promptu — zmiana modelu jest wtedy zmianą wersji, którą można porównać i wycofać, a nie edycją w kodzie aplikacji.
  2. 02Porównaj go z 2–8 innymi modelami na tych samych zamrożonych przypadkach testowych w laboratorium ewaluacji, zanim ustawisz go jako domyślny w produkcji.
  3. 03Przy powtarzalnych, deterministycznych wywołaniach odnoga zwraca zapisaną odpowiedź i nie nalicza tokenów vendora — wyłącz to dla treści kreatywnych.
  4. 04Ustaw model zapasowy na trasie, by awaria vendora obniżała jakość zamiast zwracać błąd, oraz budżet na tenanta, by jeden klient nie wydał całego miesiąca.

GPT Realtime Whisper w porównaniu

ModelKontekstWejście / 1MWyjście / 1MMożliwości
GPT Realtime WhisperStreaming
ChatGPT (chat-latest)400K$5$30Vision, Tools, JSON mode, Streaming
GPT Image 1 mini$2$8Vision

Pytania

Ile kosztuje GPT Realtime Whisper za 1M tokenów?
OpenAI podaje — / — za 1M tokenów wejścia / wyjścia w katalogu odnoga. Przez odnoga płacisz cenę vendora plus marżę planu, a każdy request zapisuje obie wartości.
Do czego najlepiej nadaje się GPT Realtime Whisper?
Wywołania masowe i wrażliwe na opóźnienie: klasyfikacja, ekstrakcja, routing, krótkie przeredagowania i streszczenia. Czaty dla użytkownika, gdzie odpowiedź ma pojawiać się w trakcie pisania.
Czy mogę przełączyć się na GPT Realtime Whisper bez zmiany kodu?
Tak. odnoga udostępnia jeden endpoint zgodny z OpenAI — przełączenie to wysłanie "gpt-realtime-whisper" jako id modelu lub zmiana w wersji zarządzanego promptu, bez wdrożenia aplikacji.

Wszystkie modele · Cennik · Dokumentacja · Porównaj modele w laboratorium ewaluacji

Gdzie mieści się ten model

Jedna bramka, każdy model.