grok-4.20-0309-non-reasoning
grok-4.20-0309-non-reasoning od xAI: $1.25 wejście i $2.50 wyjście za 1M tokenów, kontekst 1M. Wywołuj przez bramkę LLM odnogi.
grok-4.20-0309-non-reasoning jest dostarczany przez xAI i wywoływany przez odnogę tym samym formatem zgodnym z OpenAI, co każdy inny model w katalogu. Przyjmuje obrazy obok tekstu. Obsługuje wywoływanie narzędzi i funkcji. Okno kontekstu 1M tokenów wyznacza, ile wejścia zmieścisz w jednym wywołaniu. Pamięć podręczna wejścia kosztuje $0.2 za 1M tokenów, więc powtarzane prefiksy są tańsze.
Specyfikacja i cena
| Dostawca | xAI |
|---|---|
| ID modelu | grok-4.20-0309-non-reasoning |
| Okno kontekstu | 1M tokenów |
| Maks. wyjście | — |
| Możliwości | Vision, Tools, Streaming |
| Za 1M tokenów | Koszt dostawcy | Twoja cena na planie Free+7% |
|---|---|---|
| Wejście | $1.25 | $1.34 |
| Wyjście | $2.50 | $2.69 |
| Pamięć podręczna wejścia | $0.2 | $0.215 |
Koszt dostawcy to cena katalogowa za milion tokenów zapisana w katalogu odnoga; Twoja cena stosuje marżę planu tym samym wzorem, który rozlicza każdy request — zobacz cennik. Cennik
Wywołaj przez odnogę
const res = await fetch("https://api.odnoga.com/v1/chat/completions", {
method: "POST",
headers: {
Authorization: `Bearer ${process.env.ODNOGA_API_KEY}`,
"Content-Type": "application/json",
},
body: JSON.stringify({
model: "grok-4.20-0309-non-reasoning",
messages: [{ role: "user", content: "Hello" }],
}),
});
Ten sam format wywołania dla każdego dostawcy — zmieniasz identyfikator modelu, a odnoga zajmuje się kluczami, routingiem, limitami i rozliczeniem kosztów.
Jak używać grok-4.20-0309-non-reasoning
Opracowano na podstawie danych tego modelu w katalogu odnogi.
Najlepszy do
- Wywołania masowe i wrażliwe na opóźnienie: klasyfikacja, ekstrakcja, routing, krótkie przeredagowania i streszczenia.
- Zadania łączące obraz z tekstem — zrzuty ekranu, skany dokumentów, wykresy, zdjęcia produktów.
- Agenci i workflow wywołujące Twoje funkcje — model obsługuje wywoływanie narzędzi.
- Długie wejścia: okno 1M tokenów mieści całe umowy, repozytoria lub transkrypcje w jednym requeście.
- Czaty dla użytkownika, gdzie odpowiedź ma pojawiać się w trakcie pisania.
Nie wybieraj go, gdy
- Procesy wymagające gwarantowanego JSON-a — parsuj defensywnie albo wybierz model z wymuszonym JSON-em.
- Zadania, gdzie błędna odpowiedź jest kosztowna bez kontroli człowieka — żaden model w katalogu tego nie znosi.
Praktyczne wskazówki dla odnogi
- 01Przypnij id modelu do wersji zarządzanego promptu — zmiana modelu jest wtedy zmianą wersji, którą można porównać i wycofać, a nie edycją w kodzie aplikacji.
- 02Porównaj go z 2–8 innymi modelami na tych samych zamrożonych przypadkach testowych w laboratorium ewaluacji, zanim ustawisz go jako domyślny w produkcji.
- 03Trzymaj stałą część promptu na początku: cache wejścia kosztuje $0.2 za 1M tokenów zamiast $1.25.
- 04Przy powtarzalnych, deterministycznych wywołaniach odnoga zwraca zapisaną odpowiedź i nie nalicza tokenów vendora — wyłącz to dla treści kreatywnych.
- 05Ustaw model zapasowy na trasie, by awaria vendora obniżała jakość zamiast zwracać błąd, oraz budżet na tenanta, by jeden klient nie wydał całego miesiąca.
Ile kosztuje miesiąc
1 000 wywołań miesięcznie, po 10 000 tokenów wejścia i 2 000 tokenów wyjścia, w Twojej cenie na planie Free (koszt dostawcy +7%):
| Wejście (10M tokenów) | $13.44 |
|---|---|
| Wyjście (2M tokenów) | $5.38 |
| Twój koszt miesięcznie na planie Free | $18.82 |
Koszt katalogowy dostawcy $17.50 + marża odnogi $1.32 (+7%). Pamięć podręczna wejścia lub ponowne użycie odpowiedzi ją obniża; odnoga zapisuje obie wartości dla każdego requestu.
grok-4.20-0309-non-reasoning w porównaniu
| Model | Kontekst | Wejście / 1M | Wyjście / 1M | Możliwości |
|---|---|---|---|---|
| grok-4.20-0309-non-reasoning | 1M | $1.25 | $2.50 | Vision, Tools, Streaming |
| Grok 3 | 131K | $3 | $15 | Vision, Tools, JSON mode, Streaming |
| Grok 3 Mini | 131K | $0.3 | $0.5 | Reasoning, Tools, JSON mode, Streaming |
Pytania
- Ile kosztuje grok-4.20-0309-non-reasoning za 1M tokenów?
- xAI podaje $1.25 / $2.50 za 1M tokenów wejścia / wyjścia w katalogu odnoga. Przez odnoga płacisz cenę vendora plus marżę planu, a każdy request zapisuje obie wartości.
- Do czego najlepiej nadaje się grok-4.20-0309-non-reasoning?
- Wywołania masowe i wrażliwe na opóźnienie: klasyfikacja, ekstrakcja, routing, krótkie przeredagowania i streszczenia. Zadania łączące obraz z tekstem — zrzuty ekranu, skany dokumentów, wykresy, zdjęcia produktów. Agenci i workflow wywołujące Twoje funkcje — model obsługuje wywoływanie narzędzi.
- Czy mogę przełączyć się na grok-4.20-0309-non-reasoning bez zmiany kodu?
- Tak. odnoga udostępnia jeden endpoint zgodny z OpenAI — przełączenie to wysłanie "grok-4.20-0309-non-reasoning" jako id modelu lub zmiana w wersji zarządzanego promptu, bez wdrożenia aplikacji.
- Jak duże jest okno kontekstu grok-4.20-0309-non-reasoning?
- 1M tokenów wejścia.
Wszystkie modele · Cennik · Dokumentacja · Porównaj modele w laboratorium ewaluacji