Modele z długim kontekstem
Modele przyjmujące w jednym żądaniu 200 000 tokenów lub więcej — mniej więcej obszerna książka, cała baza kodu albo rok zgłoszeń z supportu. Na tyle dużo, że dzielenie na fragmenty przestaje być koniecznością, a architektura produktu może się zmienić.
Duże okno to duża faktura
Okno to sufit, a nie limit w abonamencie. Zapełnienie kontekstu milionem tokenów kosztuje milion tokenów wejścia według stawki danego modelu — przy każdym wywołaniu. Pytanie nigdy nie brzmi „czy się zmieści”, tylko „ile kosztuje za każdym razem, pomnożone przez Twój ruch”. Policz to, zanim zbudujesz na tym architekturę.
Dopiero cache czyni to opłacalnym
Jeśli duża część promptu jest między wywołaniami taka sama — instrukcja, schemat, umowa — model ze stawką za wejście z cache po pierwszym żądaniu policzy tę część za ułamek ceny. Ten jeden szczegół decyduje, czy projekt oparty na długim kontekście da się utrzymać przy dużym ruchu, i dlatego najniższa cena katalogowa często nie oznacza najtańszego modelu.
Długi kontekst kontra retrieval
Retrieval nadal jest tańszy w przeliczeniu na wywołanie i nadal wygrywa przy bardzo dużych zbiorach. Długi kontekst wygrywa prostotą, pytaniami wymagającymi całego dokumentu naraz i wszędzie tam, gdzie nietrafiony retrieval daje pewną siebie, ale błędną odpowiedź. Większość systemów produkcyjnych kończy na obu naraz — retrieval zawęża, a długie okno pozwala rozumować nad tym, co wróciło.
Koszt dostawcy to cena katalogowa. Twoja cena to ta kwota powiększona o marżę planu — dokładnie te liczby zobaczysz na fakturze.
Wszystkie modele, od najtańszego
| Model | Dostawca | Kontekst | Wejście / 1 mln | Wyjście / 1 mln | Wejście z cache | Twoja cena wej. | |
|---|---|---|---|---|---|---|---|
| GPT-5 nano gpt-5-nano | OpenAI | 400K | $0.05 | $0.4 | $0.005 | $0.054 | Szczegóły |
| GPT-4.1 nano gpt-4.1-nano | OpenAI | 1M | $0.1 | $0.4 | $0.025 | $0.108 | Szczegóły |
| Ministral 8B ministral-8b-latest | Mistral AI | 262K | $0.15 | $0.15 | — | $0.161 | Szczegóły |
| Mistral Small 3 mistral-small-latest | Mistral AI | 262K | $0.15 | $0.6 | — | $0.161 | Szczegóły |
| GPT-5.4 nano gpt-5.4-nano | OpenAI | 400K | $0.2 | $1.25 | $0.02 | $0.215 | Szczegóły |
| GPT-5.6 Luna gpt-5.6-luna | OpenAI | 400K | $0.2 | $1.20 | $0.02 | $0.215 | Szczegóły |
| Gemini 3.1 Flash-Lite gemini-3.1-flash-lite | Google AI | 1.0M | $0.25 | $1.50 | $0.025 | $0.269 | Szczegóły |
| GPT-5 mini gpt-5-mini | OpenAI | 400K | $0.25 | $2 | $0.025 | $0.269 | Szczegóły |
| Codestral codestral-latest | Mistral AI | 256K | $0.3 | $0.9 | — | $0.323 | Szczegóły |
| Gemini 3.5 Flash-Lite gemini-3.5-flash-lite | Google AI | 1.0M | $0.3 | $2.50 | $0.03 | $0.323 | Szczegóły |
| GPT-4.1 mini gpt-4.1-mini | OpenAI | 1M | $0.4 | $1.60 | $0.1 | $0.43 | Szczegóły |
| Gemini 3 Flash Preview gemini-3-flash-preview | Google AI | 1.0M | $0.5 | $3 | $0.05 | $0.538 | Szczegóły |
| Gemini 3.6 Flash gemini-3.6-flash | Google AI | 1.0M | $0.75 | $3.75 | $0.075 | $0.806 | Szczegóły |
| Gemini 3.7 Flash gemini-3.7-flash | Google AI | 1.0M | $0.75 | $3.75 | $0.075 | $0.806 | Szczegóły |
| GPT-5.4 mini gpt-5.4-mini | OpenAI | 400K | $0.75 | $4.50 | $0.075 | $0.806 | Szczegóły |
| Claude Haiku 4.5 claude-haiku-4-5 | Anthropic | 200K | $1 | $5 | $0.1 | $1.08 | Szczegóły |
| grok-build-0.1 grok-build-0.1 | xAI | 256K | $1 | $2 | $0.2 | $1.08 | Szczegóły |
| o3-mini o3-mini | OpenAI | 200K | $1.10 | $4.40 | $0.55 | $1.18 | Szczegóły |
| o4-mini o4-mini | OpenAI | 200K | $1.10 | $4.40 | $0.275 | $1.18 | Szczegóły |
| Gemini 2.5 Pro gemini-2.5-pro | Google AI | 1.0M | $1.25 | $10 | $0.125 | $1.34 | Szczegóły |
| GPT-5 gpt-5 | OpenAI | 400K | $1.25 | $10 | $0.125 | $1.34 | Szczegóły |
| gpt-5.1 gpt-5.1 | OpenAI | 400K | $1.25 | $10 | $0.125 | $1.34 | Szczegóły |
| grok-4.20-0309-non-reasoning grok-4.20-0309-non-reasoning | xAI | 1M | $1.25 | $2.50 | $0.2 | $1.34 | Szczegóły |
| grok-4.20-0309-reasoning grok-4.20-0309-reasoning | xAI | 1M | $1.25 | $2.50 | $0.2 | $1.34 | Szczegóły |
| grok-4.20-multi-agent-0309 grok-4.20-multi-agent-0309 | xAI | 1M | $1.25 | $2.50 | $0.2 | $1.34 | Szczegóły |
| grok-4.3 grok-4.3 | xAI | 1M | $1.25 | $2.50 | $0.2 | $1.34 | Szczegóły |
| Gemini 3.5 Flash gemini-3.5-flash | Google AI | 1.0M | $1.50 | $9 | $0.15 | $1.61 | Szczegóły |
| gpt-5.2 gpt-5.2 | OpenAI | 400K | $1.75 | $14 | $0.175 | $1.88 | Szczegóły |
| GPT-5.3 Codex gpt-5.3-codex | OpenAI | 400K | $1.75 | $14 | $0.175 | $1.88 | Szczegóły |
| Claude Sonnet 5 claude-sonnet-5 | Anthropic | 1M | $2 | $10 | $0.2 | $2.15 | Szczegóły |
| Gemini 3.1 Pro Preview gemini-3.1-pro-preview | Google AI | 1.0M | $2 | $12 | $0.2 | $2.15 | Szczegóły |
| GPT-4.1 gpt-4.1 | OpenAI | 1M | $2 | $8 | $0.5 | $2.15 | Szczegóły |
| GPT-5.6 Terra gpt-5.6-terra | OpenAI | 400K | $2 | $12 | $0.2 | $2.15 | Szczegóły |
| grok-4.5 grok-4.5 | xAI | 500K | $2 | $6 | $0.3 | $2.15 | Szczegóły |
| grok-4.6 grok-4.6 | xAI | 500K | $2 | $6 | $0.5 | $2.15 | Szczegóły |
| o3 o3 | OpenAI | 200K | $2 | $8 | $0.5 | $2.15 | Szczegóły |
| GPT-5.4 gpt-5.4 | OpenAI | 400K | $2.50 | $15 | $0.25 | $2.69 | Szczegóły |
| Claude Sonnet 4.5 claude-sonnet-4-5 | Anthropic | 200K | $3 | $15 | $0.3 | $3.23 | Szczegóły |
| Claude Sonnet 4.6 claude-sonnet-4-6 | Anthropic | 1M | $3 | $15 | $0.3 | $3.23 | Szczegóły |
| Grok 4 grok-4 | xAI | 256K | $3 | $15 | $0.75 | $3.23 | Szczegóły |
| Sonar Pro sonar-pro | Perplexity | 200K | $3 | $15 | — | $3.23 | Szczegóły |
| GPT-5.6 Sol gpt-5.6-sol | OpenAI | 400K | $4 | $20 | $0.4 | $4.30 | Szczegóły |
| ChatGPT (chat-latest) chat-latest | OpenAI | 400K | $5 | $30 | $0.5 | $5.38 | Szczegóły |
| Claude Opus 4.5 claude-opus-4-5-20251101 | Anthropic | 200K | $5 | $25 | $0.5 | $5.38 | Szczegóły |
| Claude Opus 4.6 claude-opus-4-6 | Anthropic | 1M | $5 | $25 | $0.5 | $5.38 | Szczegóły |
| Claude Opus 4.7 claude-opus-4-7 | Anthropic | 1M | $5 | $25 | $0.5 | $5.38 | Szczegóły |
| Claude Opus 4.8 claude-opus-4-8 | Anthropic | 1M | $5 | $25 | $0.5 | $5.38 | Szczegóły |
| Claude Opus 5 claude-opus-5 | Anthropic | 1M | $5 | $25 | $0.5 | $5.38 | Szczegóły |
| GPT-5.5 gpt-5.5 | OpenAI | 400K | $5 | $30 | $0.5 | $5.38 | Szczegóły |
| Claude Fable 5 claude-fable-5 | Anthropic | 1M | $10 | $50 | $1 | $10.75 | Szczegóły |
| Claude Fable 5.1 claude-fable-5-1 | Anthropic | 1M | $10 | $50 | $0.25 | $10.75 | Szczegóły |
| gpt-5-pro gpt-5-pro | OpenAI | 400K | $15 | $120 | — | $16.13 | Szczegóły |
| gpt-5.2-pro gpt-5.2-pro | OpenAI | 400K | $21 | $168 | — | $22.58 | Szczegóły |
| GPT-5.4 Pro gpt-5.4-pro | OpenAI | 400K | $30 | $180 | — | $32.26 | Szczegóły |
| GPT-5.5 Pro gpt-5.5-pro | OpenAI | 400K | $30 | $180 | — | $32.26 | Szczegóły |
| Lyria 3 Clip (30s) lyria-3-clip-preview | Google AI | 1.0M | Rozliczany za jednostkę mediów — zobacz szczegóły | Szczegóły | |||
| Lyria 3 Pro (full song) lyria-3-pro-preview | Google AI | 1.0M | Rozliczany za jednostkę mediów — zobacz szczegóły | Szczegóły | |||
Kolumna z Twoją ceną to koszt dostawcy +7%.
Zawęź inaczej
Najlepsza cena za token kontekstu w całej bramce.
Najbardziej spójna rodzina w bramce: każdy model Claude czyta obrazy, wywołuje narzędzia i ma stawkę za wejście z cache.
Modele, które zanim odpowiedzą, zużywają tokeny na myślenie.
Albo przeczytaj, jak bramka wybiera między nimi: routing i przełączanie awaryjne, i ile to kosztuje: plany i marże.