Gemini Omni 1.1 Flash
Gemini Omni 1.1 Flash od Google AI: $1.50 wejście i $9 wyjście za 1M tokenów, kontekst 131K. Wywołuj przez bramkę LLM odnogi.
Gemini Omni 1.1 Flash jest dostarczany przez Google AI i wywoływany przez odnogę na /v1/chat/completions, w tym samym formacie zgodnym z OpenAI co pozostałe modele na tym endpoincie. To model rozumujący — zużywa dodatkowe tokeny wyjściowe na rozumowanie, więc przy trudnych zadaniach licz się z wyższym kosztem wyjścia. Przyjmuje obrazy obok tekstu. Obsługuje wywoływanie narzędzi i funkcji. Można wymusić zwracanie ustrukturyzowanego JSON-a. Okno kontekstu 131K tokenów wyznacza, ile wejścia zmieścisz w jednym wywołaniu.
Specyfikacja i cena
| Dostawca | Google AI |
|---|---|
| ID modelu | gemini-omni-1.1-flash |
| Okno kontekstu | 131K tokenów |
| Maks. wyjście | 66K tokenów |
| Wywołanie przez | /v1/chat/completions |
| Możliwości | Rozumowanie, Czyta obrazy, Wywoływanie narzędzi, Schemat JSON, Streaming, Wyszukiwanie w sieci |
| Za 1M tokenów | Koszt dostawcy | Twoja cena na planie Free+7% |
|---|---|---|
| Wejście | $1.50 | $1.61 |
| Wyjście | $9 | $9.68 |
| Pamięć podręczna wejścia | — | — |
Koszt dostawcy to cena katalogowa za milion tokenów zapisana w katalogu odnoga; Twoja cena stosuje marżę planu tym samym wzorem, który rozlicza każdy request — zobacz cennik. Cennik
Wywołaj przez odnogę
const res = await fetch("https://api.odnoga.com/v1/chat/completions", {
method: "POST",
headers: {
Authorization: `Bearer ${process.env.ODNOGA_API_KEY}`,
"Content-Type": "application/json",
},
body: JSON.stringify({
model: "gemini-omni-1.1-flash",
messages: [{ role: "user", content: "Hello" }],
}),
});
Jeden endpoint, jeden klucz, jeden rachunek — /v1/chat/completions ma ten sam format niezależnie od dostawcy. Zmieniasz identyfikator modelu, a odnoga zajmuje się kluczami, routingiem, limitami i rozliczeniem kosztów.
Co potrafi Gemini Omni 1.1 Flash
Wszystko poniżej to funkcje, które obsługuje sam model. Jeśli poprosisz o coś, czego nie potrafi, odnoga powie Ci o tym, zanim wywołanie trafi do dostawcy — zamiast zwrócić gorszą odpowiedź.
Rozkłada problem na kroki, zanim odpowie — zużywa więcej tokenów, ale lepiej radzi sobie z trudnymi zadaniami.
Wyślij zrzut ekranu, zdjęcie albo skan w tej samej wiadomości co tekst.
Model wywołuje funkcje, które sam zdefiniujesz, i korzysta z tego, co zwrócą.
Odpowiada poprawnym JSON-em, zamiast tekstem, który trzeba dopiero parsować.
Odpowiada dokładnie w takiej strukturze, jaką podasz — odpowiedź pasuje do Twoich typów bez ścieżki awaryjnej.
Tokeny przychodzą na bieżąco, więc Twój interfejs zaczyna odpowiadać od razu.
Potrafi sprawdzić coś w sieci, zamiast odpowiadać wyłącznie z danych treningowych. Rozliczane za wyszukiwanie.
Poza tekstem
Przyjmuje nagraną mowę jako wejście.
Przyjmuje wideo na wejściu i odpowiada na pytania o to, co się w nim dzieje.
Dokładniejsza kontrola
- Wyjście strukturalne · Dostawca gwarantuje zgodność ze schematem, a nie tylko do niej dąży.
Jak używać Gemini Omni 1.1 Flash
Opracowano na podstawie danych tego modelu w katalogu odnogi.
Najlepszy do
- Problemy wieloetapowe, które trzeba rozpisać: planowanie, debugowanie, uzgadnianie danych, analiza z krokami pośrednimi.
- Zadania łączące obraz z tekstem — zrzuty ekranu, skany dokumentów, wykresy, zdjęcia produktów.
- Agenci i workflow wywołujące Twoje funkcje — model obsługuje wywoływanie narzędzi.
- Wyjście nadające się do zapisu w bazie — wymuszony JSON.
- Czaty dla użytkownika, gdzie odpowiedź ma pojawiać się w trakcie pisania.
Nie wybieraj go, gdy
- Proste, częste wywołania — rozumowanie zużywa dodatkowe tokeny wyjściowe, więc model bez rozumowania z tego samego katalogu bywa tańszy i szybszy.
- Zadania, gdzie błędna odpowiedź jest kosztowna bez kontroli człowieka — żaden model w katalogu tego nie znosi.
Praktyczne wskazówki dla odnogi
- 01Przypnij id modelu do wersji zarządzanego promptu — zmiana modelu jest wtedy zmianą wersji, którą można porównać i wycofać, a nie edycją w kodzie aplikacji.
- 02Porównaj go z 2–8 innymi modelami na tych samych zamrożonych przypadkach testowych w laboratorium ewaluacji, zanim ustawisz go jako domyślny w produkcji.
- 03Przy powtarzalnych, deterministycznych wywołaniach odnoga zwraca zapisaną odpowiedź i nie nalicza tokenów vendora — wyłącz to dla treści kreatywnych.
- 04Proś o JSON przez format odpowiedzi, a nie w treści promptu — schemat jest wtedy wymuszony, a nie sugerowany.
- 05Zaplanuj budżet tokenów wyjściowych: rozumowanie liczy się po stronie wyjścia, więc krótka odpowiedź nadal bywa drogim wywołaniem.
- 06Ustaw model zapasowy na trasie, by awaria vendora obniżała jakość zamiast zwracać błąd, oraz budżet na tenanta, by jeden klient nie wydał całego miesiąca.
Ile kosztuje miesiąc
1 000 wywołań miesięcznie, po 10 000 tokenów wejścia i 2 000 tokenów wyjścia, w Twojej cenie na planie Free (koszt dostawcy +7%):
| Wejście (10M tokenów) | $16.13 |
|---|---|
| Wyjście (2M tokenów) | $19.35 |
| Twój koszt miesięcznie na planie Free | $35.48 |
Koszt katalogowy dostawcy $33.00 + marża odnogi $2.48 (+7%). Pamięć podręczna wejścia lub ponowne użycie odpowiedzi ją obniża; odnoga zapisuje obie wartości dla każdego requestu.
Jeśli Gemini Omni 1.1 Flash to nie to
Modele, które przyjmują ten sam rodzaj danych, są rozliczane tak samo i robią najbardziej zbliżone rzeczy. To nie ranking jakości — odnoga nie testuje modeli porównawczo.
| Model | Kontekst | Wejście / 1M | Wyjście / 1M | Możliwości |
|---|---|---|---|---|
| Gemini Omni 1.1 Flash | 131K | $1.50 | $9 | Rozumowanie, Czyta obrazy, Wywoływanie narzędzi, Schemat JSON, Streaming, Wyszukiwanie w sieci |
| Gemini Omni Flash Preview | 131K | $1.50 | $9 | Rozumowanie, Czyta obrazy, Wywoływanie narzędzi, Schemat JSON, Streaming, Wyszukiwanie w sieci |
| Gemini 3.5 Flash | 1.0M | $1.50 | $9 | Rozumowanie, Czyta obrazy, Wywoływanie narzędzi, Schemat JSON, Streaming, Wyszukiwanie w sieci, Cache promptu, Batch |
| Gemini Robotics ER 2 | 131K | $1 | $5 | Rozumowanie, Czyta obrazy, Wywoływanie narzędzi, Schemat JSON, Streaming, Cache promptu, Batch |
Pytania
- Ile kosztuje Gemini Omni 1.1 Flash za 1M tokenów?
- Google AI podaje $1.50 / $9 za 1M tokenów wejścia / wyjścia w katalogu odnoga. Przez odnoga płacisz cenę vendora plus marżę planu, a każdy request zapisuje obie wartości.
- Do czego najlepiej nadaje się Gemini Omni 1.1 Flash?
- Problemy wieloetapowe, które trzeba rozpisać: planowanie, debugowanie, uzgadnianie danych, analiza z krokami pośrednimi. Zadania łączące obraz z tekstem — zrzuty ekranu, skany dokumentów, wykresy, zdjęcia produktów. Agenci i workflow wywołujące Twoje funkcje — model obsługuje wywoływanie narzędzi.
- Czy mogę przełączyć się na Gemini Omni 1.1 Flash bez zmiany kodu?
- Tak. odnoga udostępnia jeden endpoint zgodny z OpenAI — przełączenie to wysłanie "gemini-omni-1.1-flash" jako id modelu lub zmiana w wersji zarządzanego promptu, bez wdrożenia aplikacji.
- Jak duże jest okno kontekstu Gemini Omni 1.1 Flash?
- 131K tokenów wejścia, do 66K tokenów wyjścia na odpowiedź.
Wszystkie modele · Cennik · Dokumentacja · Porównaj modele w laboratorium ewaluacji
Gdzie mieści się ten model
Inne modele Google AI
Gemini 2.5 Computer Use
$1 / $5 za 1M
Gemini 2.5 Flash Image (Nano Banana)
$0.3 / $2.50 za 1M
Gemini 2.5 Flash Native Audio (Live)
$0.5 / $2 za 1M
Gemini 2.5 Flash TTS
$0.5 / $10 za 1M
Gemini 2.5 Pro
$1.25 / $10 za 1M
Gemini 2.5 Pro TTS
$1 / $20 za 1M
Gemini 3 Flash Preview
$0.5 / $3 za 1M
Gemini 3 Pro Image (Nano Banana Pro)
$2 / $12 za 1M