Otwarte modele, ten sam endpoint.
Llama, Qwen, DeepSeek i Mixtral czekają w katalogu — pójdą przez ten sam endpoint zgodny z OpenAI, te same reguły routingu i to samo rozliczanie per klient co reszta. Nie są jeszcze dostępne i nie podajemy daty.
Na tej stronie nie ma cen, bo nie zostały jeszcze ustalone. W odnodze modelu bez ceny nie da się wywołać — i właśnie ta zasada pilnuje, żeby żadna kwota nie pojawiła się tu przed czasem.
Co czeka w kolejce
Llama 3.3 70B
Wkrótce- Kontekst
- 131K
- Licencja
- Llama
Przygotowany u: Cerebras, DeepInfra, Fireworks AI
Llama 3.3 70B Turbo
Wkrótce- Kontekst
- 131K
- Licencja
- Llama
Przygotowany u: Together AI
Llama 4 Maverick 17B
Wkrótce- Kontekst
- 131K
- Licencja
- Llama
Przygotowany u: Cerebras
Llama 4 Scout 17B
Wkrótce- Kontekst
- 131K
- Licencja
- Llama
Przygotowany u: Cerebras
Qwen 2.5 72B
Wkrótce- Kontekst
- 131K
- Licencja
- Apache-2.0
Przygotowany u: DeepInfra, Fireworks AI
Qwen 2.5 72B Turbo
Wkrótce- Kontekst
- 131K
- Licencja
- Apache-2.0
Przygotowany u: Together AI
Qwen 3 32B
Wkrótce- Kontekst
- 131K
- Licencja
- Apache-2.0
Przygotowany u: Cerebras
DeepSeek V3
Wkrótce- Kontekst
- 66K
- Licencja
- DeepSeek
Przygotowany u: DeepInfra, Fireworks AI, Together AI
Mixtral 8x22B
Wkrótce- Kontekst
- 66K
- Licencja
- Apache-2.0
Przygotowany u: Fireworks AI, Together AI
Mixtral 8x7B
Wkrótce- Kontekst
- 33K
- Licencja
- Apache-2.0
Przygotowany u: DeepInfra
Te same otwarte wagi potrafi obsłużyć kilku dostawców — i o to chodzi: routing wybiera jednego, a przełączenie awaryjne przeniesie ruch do innego bez zmian w Twoim kodzie. Podane okno kontekstu to największe, jakie oferuje któryś z nich.