Claude Sonnet 5
Claude Sonnet 5 od Anthropic: $2 wejście i $10 wyjście za 1M tokenów, kontekst 1M. Wywołuj przez bramkę LLM odnogi.
Claude Sonnet 5 jest dostarczany przez Anthropic i wywoływany przez odnogę tym samym formatem zgodnym z OpenAI, co każdy inny model w katalogu. Przyjmuje obrazy obok tekstu. Obsługuje wywoływanie narzędzi i funkcji. Okno kontekstu 1M tokenów wyznacza, ile wejścia zmieścisz w jednym wywołaniu. Pamięć podręczna wejścia kosztuje $0.2 za 1M tokenów, więc powtarzane prefiksy są tańsze.
Specyfikacja i cena
| Dostawca | Anthropic |
|---|---|
| ID modelu | claude-sonnet-5 |
| Okno kontekstu | 1M tokenów |
| Maks. wyjście | 128K tokenów |
| Możliwości | Vision, Tools, Streaming |
| Za 1M tokenów | Koszt dostawcy | Twoja cena na planie Free+7% |
|---|---|---|
| Wejście | $2 | $2.15 |
| Wyjście | $10 | $10.75 |
| Pamięć podręczna wejścia | $0.2 | $0.215 |
Koszt dostawcy to cena katalogowa za milion tokenów zapisana w katalogu odnoga; Twoja cena stosuje marżę planu tym samym wzorem, który rozlicza każdy request — zobacz cennik. Cennik
Wywołaj przez odnogę
const res = await fetch("https://api.odnoga.com/v1/chat/completions", {
method: "POST",
headers: {
Authorization: `Bearer ${process.env.ODNOGA_API_KEY}`,
"Content-Type": "application/json",
},
body: JSON.stringify({
model: "claude-sonnet-5",
messages: [{ role: "user", content: "Hello" }],
}),
});
Ten sam format wywołania dla każdego dostawcy — zmieniasz identyfikator modelu, a odnoga zajmuje się kluczami, routingiem, limitami i rozliczeniem kosztów.
Jak używać Claude Sonnet 5
Zweryfikowano 2026-09-14
Najlepszy do
- Domyślny model produkcyjny dla produktów agentowych: Anthropic opisuje go jako najlepsze połączenie szybkości i inteligencji, zdolny planować, korzystać z przeglądarki i terminala oraz działać samodzielnie.
- Asystenci dla klientów, którzy dodatkowo wywołują narzędzia.
- Długie dokumenty i duże bazy kodu — kontekst 1M tokenów, do 128K wyjścia.
- Zespoły przechodzące z Sonnet 4.6, które chcą zachować ten sam kształt integracji.
Nie wybieraj go, gdy
- Prosta masowa klasyfikacja — modele klasy Haiku są do tego tańsze.
- Kod ustawiający temperature, top_p lub top_k: w Sonnet 5 niedomyślne parametry próbkowania zwracają błąd.
- Najtrudniejsze rozumowanie długodystansowe, gdzie Opus 5 lub model klasy Fable może uzasadnić swoją cenę.
Praktyczne wskazówki dla odnogi
- 01Przed przełączeniem usuń z requestu temperature i top_p: Anthropic zwraca dla tego modelu błąd 400 przy niedomyślnych wartościach próbkowania, a ręczne rozszerzone myślenie nie jest już przyjmowane.
- 02Adaptacyjne myślenie jest domyślnie włączone — traktuj jego tokeny jako część budżetu wyjścia.
- 03Umieść stały kontekst systemowy na początku, by cache promptu objął powtarzalną część.
- 04Zostaw poprzedni model w katalogu i zrób test A/B obu wersji w odnoga zamiast przełączać w ciemno; rejestr pokazuje różnice kosztu przy tej samej jakości, per tenant.
Ile kosztuje miesiąc
1 000 wywołań miesięcznie, po 10 000 tokenów wejścia i 2 000 tokenów wyjścia, w Twojej cenie na planie Free (koszt dostawcy +7%):
| Wejście (10M tokenów) | $21.51 |
|---|---|
| Wyjście (2M tokenów) | $21.51 |
| Twój koszt miesięcznie na planie Free | $43.01 |
Koszt katalogowy dostawcy $40.00 + marża odnogi $3.01 (+7%). Pamięć podręczna wejścia lub ponowne użycie odpowiedzi ją obniża; odnoga zapisuje obie wartości dla każdego requestu.
Claude Sonnet 5 w porównaniu
| Model | Kontekst | Wejście / 1M | Wyjście / 1M | Możliwości |
|---|---|---|---|---|
| Claude Sonnet 5 | 1M | $2 | $10 | Vision, Tools, Streaming |
| Claude Fable 5 | 1M | $10 | $50 | Vision, Tools, Streaming |
| Claude Fable 5.1 | 1M | $10 | $50 | Vision, Tools, Streaming |
Pytania
- Czy Claude Sonnet 5 to bezpośrednia zamiana za Sonnet 4.6?
- Anthropic nazywa go zamianą drop-in z trzema zmianami zachowania: adaptacyjne myślenie domyślnie włączone, ręczne rozszerzone myślenie zwraca błąd, a niedomyślne temperature, top_p lub top_k zwracają błąd.
- Sonnet 5 czy Opus 5?
- Zacznij od Sonnet 5 dla większości ruchu produkcyjnego i eskaluj tylko te prompty, dla których ewaluacja wskaże Opus 5. W odnoga to decyzja na poziomie promptu, nie przepisywanie aplikacji.
- Czy kontekst 1M znaczy, że warto wysyłać wszystko?
- Nie — płacisz za każdy token wejścia. Wyślij to, czego wymaga zadanie, trzymaj powtarzalny prefiks na początku dla cache, a rejestr per request pokaże, ile ten kontekst naprawdę kosztuje.
Wszystkie modele · Cennik · Dokumentacja · Porównaj modele w laboratorium ewaluacji
Źródła: Anthropic — Claude Sonnet 5 overview, Anthropic — introducing Claude Sonnet 5