Modele otwarte
Wkrótce

Otwarte modele, ten sam endpoint.

Llama, Qwen, DeepSeek i Mixtral czekają w katalogu — pójdą przez ten sam endpoint zgodny z OpenAI, te same reguły routingu i to samo rozliczanie per klient co reszta. Nie są jeszcze dostępne i nie podajemy daty.

Na tej stronie nie ma cen, bo nie zostały jeszcze ustalone. W odnodze modelu bez ceny nie da się wywołać — i właśnie ta zasada pilnuje, żeby żadna kwota nie pojawiła się tu przed czasem.

Co czeka w kolejce

Llama 3.3 70B

Wkrótce
Kontekst
131K
Licencja
Llama

Przygotowany u: Cerebras, DeepInfra, Fireworks AI

Llama 3.3 70B Turbo

Wkrótce
Kontekst
131K
Licencja
Llama

Przygotowany u: Together AI

Llama 4 Maverick 17B

Wkrótce
Kontekst
131K
Licencja
Llama

Przygotowany u: Cerebras

Llama 4 Scout 17B

Wkrótce
Kontekst
131K
Licencja
Llama

Przygotowany u: Cerebras

Qwen 2.5 72B

Wkrótce
Kontekst
131K
Licencja
Apache-2.0

Przygotowany u: DeepInfra, Fireworks AI

Qwen 2.5 72B Turbo

Wkrótce
Kontekst
131K
Licencja
Apache-2.0

Przygotowany u: Together AI

Qwen 3 32B

Wkrótce
Kontekst
131K
Licencja
Apache-2.0

Przygotowany u: Cerebras

DeepSeek V3

Wkrótce
Kontekst
66K
Licencja
DeepSeek

Przygotowany u: DeepInfra, Fireworks AI, Together AI

Mixtral 8x22B

Wkrótce
Kontekst
66K
Licencja
Apache-2.0

Przygotowany u: Fireworks AI, Together AI

Mixtral 8x7B

Wkrótce
Kontekst
33K
Licencja
Apache-2.0

Przygotowany u: DeepInfra

Te same otwarte wagi potrafi obsłużyć kilku dostawców — i o to chodzi: routing wybiera jednego, a przełączenie awaryjne przeniesie ruch do innego bez zmian w Twoim kodzie. Podane okno kontekstu to największe, jakie oferuje któryś z nich.

Z czego możesz korzystać już teraz

Katalog jest dostępny, wyceniony i gotowy do wywołań — każdy model w nim ma opublikowaną cenę, bo bez tego w ogóle go nie udostępniamy.

Buduj na endpoincie teraz, wagi zmienisz później.

Model zmieniasz regułą routingu, a nie wdrożeniem — więc to, co pojawi się później, będzie ustawieniem, nie migracją.