Rachunek za AI, rozpisany na tych, którzy go wygenerowali.
Jedna faktura od dostawcy dla całej firmy podaje sumę i nic poza tym. odnoga stoi przed każdym wywołaniem i zapisuje, która aplikacja je wykonała, które zadanie w niej i ile kosztowało — a potem pozwala ustawić limit, zanim kwota kogokolwiek zaskoczy.
Rozliczanie klientów nie jest potrzebne. To opcja, która jest wyłączona, dopóki jej nie włączysz.
Trzy nagłówki i rachunek tłumaczy się sam
Wysyłaj je przy każdym wywołaniu. Od tej chwili każdy wpis, wykres i budżet możesz po nich filtrować.
await fetch("https://api.odnoga.com/v1/chat/completions", {
method: "POST",
headers: {
"Content-Type": "application/json",
Authorization: `Bearer ${process.env.ODNOGA_API_KEY}`,
"X-Odnoga-App": "crm", // which system
"X-Odnoga-Function": "lead-enrich", // which job in it
"X-Odnoga-Env": "production", // which environment
},
body: JSON.stringify({
model: "gpt-5.1",
messages: [{ role: "user", content: "Summarise this account" }],
}),
});Dodaj też x-odnoga-end-user, jeśli chcesz rozbicie kosztu na pracowników, a nie tylko na narzędzia.
Co z tego masz
Koszt per aplikacja, funkcja i środowisko
Trzy nagłówki mówią, który system wywołał, które zadanie w nim i czy było to środowisko produkcyjne. Każde wywołanie zapisuje je w rejestrze, więc na pytanie „za co jest ten rachunek za AI” jest odpowiedź, a nie runda pytań po zespołach.
Budżety, które zatrzymują wydatek, a nie go opisują
Miękki limit ostrzega. Twardy odrzuca wywołanie, zanim trafi do dostawcy, więc eksperyment, który wpadł w pętlę, nie wyda budżetu kwartału. Ustawiane dla obszaru roboczego, zespołu i modelu.
Integracja, która zamilkła, wygląda jak spokojny tydzień
Kondycja ruchu uczy się, co jest normą dla każdego wywołującego, i sygnalizuje, gdy któryś przestaje albo gwałtownie rośnie. Narzędzie, którego awarii nikt nie zauważył, to najdroższa z awarii.
Zmieniaj prompt świadomie
Wersje i etykiety oraz porównanie na prawdziwych przypadkach, zanim zmiana do kogokolwiek trafi. Przełączenie wersji produkcyjnej to zmiana etykiety, nie wdrożenie — a wersja, która odpowiedziała, jest przy każdym wywołaniu.
Przestań płacić dwa razy za to samo pytanie
Cache w dwóch warstwach, z zapisanym — a nie zakładanym — efektem oszczędności. Narzędzia wewnętrzne powtarzają te same pytania znacznie częściej, niż ktokolwiek zakłada.
Kiedy nie jest Ci to potrzebne
- Jeden zespół, jedna aplikacja, jeden dostawca. Panel dostawcy powie Ci wystarczająco dużo.
- Wolisz utrzymywać bramkę samodzielnie. LiteLLM jest open source i robi dużą część tego.
- Twoje wydatki są na tyle małe, że pytanie jeszcze nie padło. Wróć, kiedy padnie.