Veo 3.1 Fast

Veo 3.1 Fast od Google AI: rozliczany za jednostkę mediów (sekundę, obraz lub minutę audio), kontekst 480. Wywołuj przez bramkę LLM odnogi; stawkę znajdziesz na stronie cennika.

Veo 3.1 Fast jest dostarczany przez Google AI i wywoływany przez odnogę tym samym formatem zgodnym z OpenAI, co każdy inny model w katalogu. Okno kontekstu 480 tokenów wyznacza, ile wejścia zmieścisz w jednym wywołaniu.

Specyfikacja i cena

DostawcaGoogle AI
ID modeluveo-3.1-fast-generate-preview
Okno kontekstu480 tokenów
Maks. wyjście8K tokenów
CennikZa jednostkę mediów (sekunda / obraz / minuta) — zobacz cennik
Możliwości

Koszt dostawcy to cena katalogowa za milion tokenów zapisana w katalogu odnoga; Twoja cena stosuje marżę planu tym samym wzorem, który rozlicza każdy request — zobacz cennik. Cennik

Wywołaj przez odnogę

const res = await fetch("https://api.odnoga.com/v1/chat/completions", {
  method: "POST",
  headers: {
    Authorization: `Bearer ${process.env.ODNOGA_API_KEY}`,
    "Content-Type": "application/json",
  },
  body: JSON.stringify({
    model: "veo-3.1-fast-generate-preview",
    messages: [{ role: "user", content: "Hello" }],
  }),
});

Ten sam format wywołania dla każdego dostawcy — zmieniasz identyfikator modelu, a odnoga zajmuje się kluczami, routingiem, limitami i rozliczeniem kosztów.

Jak używać Veo 3.1 Fast

Opracowano na podstawie danych tego modelu w katalogu odnogi.

Najlepszy do

  • Wywołania masowe i wrażliwe na opóźnienie: klasyfikacja, ekstrakcja, routing, krótkie przeredagowania i streszczenia.

Nie wybieraj go, gdy

  • Zadania wymagające odczytu obrazu — ten model przyjmuje tylko tekst.
  • Pętle agentowe wywołujące Twoje funkcje — brak obsługi narzędzi.
  • Procesy wymagające gwarantowanego JSON-a — parsuj defensywnie albo wybierz model z wymuszonym JSON-em.
  • Duże dokumenty w jednym requeście — okno to 480 tokenów, potrzebne będzie dzielenie na części.
  • Zadania, gdzie błędna odpowiedź jest kosztowna bez kontroli człowieka — żaden model w katalogu tego nie znosi.

Praktyczne wskazówki dla odnogi

  1. 01Przypnij id modelu do wersji zarządzanego promptu — zmiana modelu jest wtedy zmianą wersji, którą można porównać i wycofać, a nie edycją w kodzie aplikacji.
  2. 02Porównaj go z 2–8 innymi modelami na tych samych zamrożonych przypadkach testowych w laboratorium ewaluacji, zanim ustawisz go jako domyślny w produkcji.
  3. 03Przy powtarzalnych, deterministycznych wywołaniach odnoga zwraca zapisaną odpowiedź i nie nalicza tokenów vendora — wyłącz to dla treści kreatywnych.
  4. 04Ustaw model zapasowy na trasie, by awaria vendora obniżała jakość zamiast zwracać błąd, oraz budżet na tenanta, by jeden klient nie wydał całego miesiąca.

Veo 3.1 Fast w porównaniu

ModelKontekstWejście / 1MWyjście / 1MMożliwości
Veo 3.1 Fast480
Gemini 2.5 Computer Use131K$1$5Vision, Tools, JSON mode, Streaming
Gemini 2.5 Flash Image (Nano Banana)33K$0.3$2.50Vision

Pytania

Ile kosztuje Veo 3.1 Fast za 1M tokenów?
Google AI podaje — / — za 1M tokenów wejścia / wyjścia w katalogu odnoga. Przez odnoga płacisz cenę vendora plus marżę planu, a każdy request zapisuje obie wartości.
Do czego najlepiej nadaje się Veo 3.1 Fast?
Wywołania masowe i wrażliwe na opóźnienie: klasyfikacja, ekstrakcja, routing, krótkie przeredagowania i streszczenia.
Czy mogę przełączyć się na Veo 3.1 Fast bez zmiany kodu?
Tak. odnoga udostępnia jeden endpoint zgodny z OpenAI — przełączenie to wysłanie "veo-3.1-fast-generate-preview" jako id modelu lub zmiana w wersji zarządzanego promptu, bez wdrożenia aplikacji.
Jak duże jest okno kontekstu Veo 3.1 Fast?
480 tokenów wejścia, do 8K tokenów wyjścia na odpowiedź.

Wszystkie modele · Cennik · Dokumentacja · Porównaj modele w laboratorium ewaluacji

Gdzie mieści się ten model

Jedna bramka, każdy model.