ChatGPT (chat-latest)

ChatGPT (chat-latest) od OpenAI: $5 wejście i $30 wyjście za 1M tokenów, kontekst 400K. Wywołuj przez bramkę LLM odnogi.

VisionToolsJSON modeStreaming

ChatGPT (chat-latest) jest dostarczany przez OpenAI i wywoływany przez odnogę tym samym formatem zgodnym z OpenAI, co każdy inny model w katalogu. Przyjmuje obrazy obok tekstu. Obsługuje wywoływanie narzędzi i funkcji. Można wymusić zwracanie ustrukturyzowanego JSON-a. Okno kontekstu 400K tokenów wyznacza, ile wejścia zmieścisz w jednym wywołaniu. Pamięć podręczna wejścia kosztuje $0.5 za 1M tokenów, więc powtarzane prefiksy są tańsze.

Specyfikacja i cena

DostawcaOpenAI
ID modeluchat-latest
Okno kontekstu400K tokenów
Maks. wyjście128K tokenów
MożliwościVision, Tools, JSON mode, Streaming
Twój plan
Za 1M tokenówKoszt dostawcyTwoja cena na planie Free+7%
Wejście$5$5.38
Wyjście$30$32.26
Pamięć podręczna wejścia$0.5$0.538

Koszt dostawcy to cena katalogowa za milion tokenów zapisana w katalogu odnoga; Twoja cena stosuje marżę planu tym samym wzorem, który rozlicza każdy request — zobacz cennik. Cennik

Wywołaj przez odnogę

const res = await fetch("https://api.odnoga.com/v1/chat/completions", {
  method: "POST",
  headers: {
    Authorization: `Bearer ${process.env.ODNOGA_API_KEY}`,
    "Content-Type": "application/json",
  },
  body: JSON.stringify({
    model: "chat-latest",
    messages: [{ role: "user", content: "Hello" }],
  }),
});

Ten sam format wywołania dla każdego dostawcy — zmieniasz identyfikator modelu, a odnoga zajmuje się kluczami, routingiem, limitami i rozliczeniem kosztów.

Jak używać ChatGPT (chat-latest)

Opracowano na podstawie danych tego modelu w katalogu odnogi.

Najlepszy do

  • Wywołania masowe i wrażliwe na opóźnienie: klasyfikacja, ekstrakcja, routing, krótkie przeredagowania i streszczenia.
  • Zadania łączące obraz z tekstem — zrzuty ekranu, skany dokumentów, wykresy, zdjęcia produktów.
  • Agenci i workflow wywołujące Twoje funkcje — model obsługuje wywoływanie narzędzi.
  • Wyjście nadające się do zapisu w bazie — wymuszony JSON.
  • Długie wejścia: okno 400K tokenów mieści całe umowy, repozytoria lub transkrypcje w jednym requeście.
  • Czaty dla użytkownika, gdzie odpowiedź ma pojawiać się w trakcie pisania.

Nie wybieraj go, gdy

  • Zadania, gdzie błędna odpowiedź jest kosztowna bez kontroli człowieka — żaden model w katalogu tego nie znosi.

Praktyczne wskazówki dla odnogi

  1. 01Przypnij id modelu do wersji zarządzanego promptu — zmiana modelu jest wtedy zmianą wersji, którą można porównać i wycofać, a nie edycją w kodzie aplikacji.
  2. 02Porównaj go z 2–8 innymi modelami na tych samych zamrożonych przypadkach testowych w laboratorium ewaluacji, zanim ustawisz go jako domyślny w produkcji.
  3. 03Trzymaj stałą część promptu na początku: cache wejścia kosztuje $0.5 za 1M tokenów zamiast $5.
  4. 04Przy powtarzalnych, deterministycznych wywołaniach odnoga zwraca zapisaną odpowiedź i nie nalicza tokenów vendora — wyłącz to dla treści kreatywnych.
  5. 05Proś o JSON przez format odpowiedzi, a nie w treści promptu — schemat jest wtedy wymuszony, a nie sugerowany.
  6. 06Ustaw model zapasowy na trasie, by awaria vendora obniżała jakość zamiast zwracać błąd, oraz budżet na tenanta, by jeden klient nie wydał całego miesiąca.

Ile kosztuje miesiąc

1 000 wywołań miesięcznie, po 10 000 tokenów wejścia i 2 000 tokenów wyjścia, w Twojej cenie na planie Free (koszt dostawcy +7%):

Wejście (10M tokenów)$53.76
Wyjście (2M tokenów)$64.52
Twój koszt miesięcznie na planie Free$118

Koszt katalogowy dostawcy $110 + marża odnogi $8.28 (+7%). Pamięć podręczna wejścia lub ponowne użycie odpowiedzi ją obniża; odnoga zapisuje obie wartości dla każdego requestu.

ChatGPT (chat-latest) w porównaniu

ModelKontekstWejście / 1MWyjście / 1MMożliwości
ChatGPT (chat-latest)400K$5$30Vision, Tools, JSON mode, Streaming
GPT Image 1 mini$2$8Vision
GPT Image 1.5$5$10Vision

Pytania

Ile kosztuje ChatGPT (chat-latest) za 1M tokenów?
OpenAI podaje $5 / $30 za 1M tokenów wejścia / wyjścia w katalogu odnoga. Przez odnoga płacisz cenę vendora plus marżę planu, a każdy request zapisuje obie wartości.
Do czego najlepiej nadaje się ChatGPT (chat-latest)?
Wywołania masowe i wrażliwe na opóźnienie: klasyfikacja, ekstrakcja, routing, krótkie przeredagowania i streszczenia. Zadania łączące obraz z tekstem — zrzuty ekranu, skany dokumentów, wykresy, zdjęcia produktów. Agenci i workflow wywołujące Twoje funkcje — model obsługuje wywoływanie narzędzi.
Czy mogę przełączyć się na ChatGPT (chat-latest) bez zmiany kodu?
Tak. odnoga udostępnia jeden endpoint zgodny z OpenAI — przełączenie to wysłanie "chat-latest" jako id modelu lub zmiana w wersji zarządzanego promptu, bez wdrożenia aplikacji.
Jak duże jest okno kontekstu ChatGPT (chat-latest)?
400K tokenów wejścia, do 128K tokenów wyjścia na odpowiedź.

Wszystkie modele · Cennik · Dokumentacja · Porównaj modele w laboratorium ewaluacji

Jedna bramka, każdy model.