Śledzenie wydatków na AI

Posortuj agentów po tym, ile kosztują. Potem po tym, do czego sięgają.

Zużycie AI jest mierzone na trzy różne sposoby: interakcje w dzienniku audytu, kredyty Copilota w raportach centrum administracyjnego, tokeny i dolary po stronie Azure. Żadna konsola ich nie łączy i żadna nie wie, do czego wydający agent naprawdę sięga. 1Security trzyma wszystkie trzy waluty w jednym rejestrze per agent - startując na licencjach, które już masz - i stawia kolumnę wydatków obok kolumny zasięgu. Tego połączenia nie zrobi ani narzędzie FinOps, ani raport rozliczeniowy.

  • 3
    waluty uzgadniane per agent - interakcje, kredyty, tokeny i dolary
  • Dzień 1
    wolumen interakcji per agent z dziennika audytu, na zwykłym E1
  • 125%
    przedpłaconej puli kredytów wyłącza agentów automatycznie - alert przychodzi, póki to jeszcze pytanie budżetowe

Problem

Trzy liczniki, trzy konsole i żadnej kolumny na ryzyko.

Każda powierzchnia AI rozlicza się inaczej. Interakcje Copilota to darmowe zdarzenia w dzienniku audytu; Copilot Studio pali kredyty za odpowiedź i akcję agenta; wdrożenia Azure AI mierzą tokeny promptów i odpowiedzi i rozliczają się w dolarach. Właściciele budżetów widzą fragmenty: tu raport kredytów, tam analiza kosztów, a liczby interakcji nigdzie obok żadnego z nich.

Fragmenty też wygasają. Raport kredytów trzyma trzydzieści dni; metryki Azure starzeją się własnym rytmem. Zanim przegląd kwartalny zapyta „ile ten agent kosztował nas od wiosny", pierwotne źródła już zapomniały.

I żadna powierzchnia rozliczeń nie wie, do czego wydający sięga. Agent palący kredyty przy witrynie pełnej danych płatniczych i agent streszczający publiczne FAQ wyglądają na fakturze identycznie. Wydatki bez zasięgu to ćwiczenie FinOps; wydatki obok zasięgu to sygnał bezpieczeństwa - połączenie, dla którego istnieje ten ekran.

Co dostajesz

Jeden rejestr per agent, pochodzenie przy każdym wierszu.

Zmierzone i szacowane nigdy nie mieszają się po cichu: każda liczba niesie swoje źródło - dziennik audytu, zaimportowany raport albo licznik Azure.

  • Interakcje na licencjach, które masz

    Wolumen interakcji per agent i per użytkownik z dziennika audytu - dzienna aktywność, kolumny 7 i 30 dni, sortowalne po całej flocie agentów. Za darmo na E1, płynie od dnia podłączenia.

  • Kredyty Copilota, zaimportowane i zachowane

    Raport kredytów wgrywa się jako cykliczny eksport tym samym przepływem, co rejestr agentów - autorytatywne kredyty per agent i per użytkownik, z historią dłuższą niż 30-dniowe okno samego raportu.

  • Tokeny i dolary z Azure

    Nadaj rolę odczytu, a tokeny promptów i odpowiedzi lądują per wdrożenie i model, dolary per licznik, zużycie per przebieg dla agentów Foundry - pobierane ciągle, więc 1Security staje się magazynem długoterminowym.

  • Budżety i wypalanie puli

    Twoje budżety Azure są czytane dla kontekstu, a przedpłacone pule kredytów pilnowane względem przydziału - z alertem, póki wypalanie to jeszcze rozmowa o budżecie, zanim próg automatycznego wyłączenia zamieni je w awarię.

  • Anomalie zużycia

    Wydatki są punktowane jak każda inna metryka: względem własnej historii agenta. Skok tokenów na wdrożeniu bez pasującej aktywności użytkowników albo koszt-na-interakcję rosnący przy płaskim wolumenie otwiera epizod w minuty.

  • Wydatki obok zasięgu

    Kolumna zużycia siedzi w tym samym wierszu, co pliki, witryny i dane wrażliwe w zasięgu. „Nasz najdroższy agent czyta witrynę finansów" to jedno sortowanie - i zdanie, które zmienia spotkanie.

Jak głęboko to sięga

Przegląd kwartalny w trzech sortowaniach.

Jak wygląda rozmowa o pozycji AI, gdy rejestr już istnieje.

Posortuj po interakcjach malejąco: agenci, którzy naprawdę się liczą, niezależnie od kosztu. Ogon zer pod nimi to osobne ustalenie - zbudowani raz, zapomniani, wciąż z zasięgiem. Wycofanie bezczynnego ogona to najtańsza dostępna redukcja ryzyka.

Posortuj po wydatkach: zaimportowane kredyty i zmierzone dolary, z historią za każdą liczbą zamiast trzydziestodniowej migawki. Koszt-na-interakcję obnaża cichą historię - agent, któremu przełączono model na wyższy poziom, pokazuje się tutaj, choć jego wolumen wygląda zupełnie normalnie.

Potem skrzyżuj z zasięgiem: przefiltruj do agentów z danymi wrażliwymi w zasięgu i odczytaj ich wydatki. Ćwiartka drodzy-i-niebezpieczni to zwykle dwóch-trzech agentów - krótka lista na rozmowę z właścicielem, nie program naprawczy. To skrzyżowanie jest sednem: raport rozliczeniowy wycenia flotę, ten ekran ją priorytetyzuje.

W praktyce

Od darmowych kolumn do pełnego rejestru.

Każdy krok jest opcjonalny i dodaje walutę - żaden nie blokuje poprzedniego.

  1. 01

    Zacznij od tego, co już płynie

    Wolumen interakcji per agent jest na ekranie Agenci od pierwszego dnia, z dziennika audytu, na licencjach, które już masz. Sortowanie i alerty skoków działają przed jakimkolwiek importem czy nadaniem roli.

  2. 02

    Zaimportuj raport kredytów

    Wgrywaj eksport kredytów cyklicznie - ten sam wzorzec importu, co rejestr agentów. Kredyty per agent i per użytkownik odkładają się jako historia, a alert wypalania puli uzbraja się względem przydziału.

  3. 03

    Nadaj role odczytu w Azure

    Monitoring Reader przynosi tokeny per wdrożenie i model; Cost Management Reader - dolary per licznik; płaszczyzna danych Foundry dodaje zużycie per przebieg. Wszystko tylko do odczytu, odwoływalne w Azure w każdej chwili.

  4. 04

    Pozwól detektorom pilnować krzywych

    Metryki zużycia dołączają do silnika anomalii: linie bazowe per agent, epizody skoków, dryf kosztu-na-interakcję. Alerty jadą tymi samymi kanałami natychmiastowymi i digestowymi, co wszystko inne.

Różnica

Co złączenie dodaje ponad eksport rozliczeń

Liczby istnieją w powierzchniach Microsoftu. Złączenia poniżej - nie.

  • Trzy waluty zużycia w jednym rejestrze per agent, każdy wiersz z oznaczonym źródłem
  • Historia kredytów dłuższa niż 30-dniowe okno raportu - import staje się systemem zapisu
  • Ciągły pobór metryk Azure, trzymany dłużej niż retencja samych metryk
  • Koszt-na-interakcję jako sygnał pochodny - eskalacja modelu widoczna przy płaskim wolumenie
  • Alert wypalania puli, zanim próg automatycznego wyłączenia zamieni wydatki w awarię
  • Anomalie wydatków punktowane per agent względem własnej historii, na tej samej skali co każdy inny detektor
  • Kolumna wydatków obok zasięgu, właścicieli i danych wrażliwych - priorytetyzacja, której nie policzy żadna faktura
  • Bezczynni agenci ze stałym zasięgiem jako najtańsza dostępna redukcja ryzyka

Licencje i dostęp

Startuje za darmo, rośnie o jedną rolę na raz.

Śledzenie interakcji działa na standardowym połączeniu tylko do odczytu i zwykłym E1 - bez licencji premium. Kredyty przychodzą przez import raportów, które już umiesz wyeksportować. Metryki Azure potrzebują tylko ról odczytu - Monitoring Reader i Cost Management Reader - nadawanych i odwoływanych po Twojej stronie. Każda liczba zachowuje pochodzenie, a wartości szacowane zawsze mają odznakę „szacowane".

  • 0
    dodatkowych licencji dla kolumn interakcji i alertów skoków
  • 2 role
    Monitoring Reader + Cost Management Reader dla zmierzonych tokenów i dolarów
  • 100%
    wierszy niesie swoje źródło - zmierzone i szacowane nie mieszają się po cichu

Powiązane

Gdzie to pasuje

Wydatki to jedna kolumna floty agentów. Strony poniżej trzymają kolumny, z którymi jest łączona.

  • Inwentarz agentów AI

    Populacja, którą mierzy rejestr: każdy agent z zasięgiem, właścicielem i szablonem.

    Zobacz agentów
  • Optymalizacja licencji

    Strona miejsc tego samego rachunku: kupione vs przypisane vs używane, z automatyzacją odzysku.

    Zobacz licencje
  • Wykrywanie anomalii

    Silnik punktujący krzywe zużycia - linie bazowe, epizody, jedno pokrętło czułości.

    Zobacz anomalie

FAQ

Pytania, które zespoły zadają najpierw

Czy potrzebujemy E5 albo licencji Copilota, żeby cokolwiek zobaczyć?

Nie. Wolumen interakcji per agent pochodzi z dziennika audytu na zwykłym E1, przez standardowe połączenie tylko do odczytu. Kredyty i metryki Azure to warstwy dodatkowe: import, który planujesz, i role odczytu, które nadajesz - każda opcjonalna.

Skąd biorą się liczby kredytów?

Z raportu kredytów Copilota, który Twoje centrum administracyjne już produkuje. 1Security importuje eksport cyklicznie - tym samym przepływem, co import rejestru agentów - i trzyma kredyty per agent i per użytkownik jako historię dłuższą niż 30-dniowe okno raportu. Tam, gdzie istnieją tylko kształty interakcji, kredyty szacowane są liczone z opublikowanych stawek i zawsze oznaczone jako szacunek.

Czego wymaga strona Azure?

Tylko ról odczytu: Monitoring Reader dla metryk tokenów per wdrożenie i model, Cost Management Reader dla dolarów per licznik i roli projektu Foundry dla zużycia per przebieg. Bez dostępu do zapisu, bez zmian w SDK, odwoływalne w Azure w każdej chwili.

Po co wydatki na platformie bezpieczeństwa?

Bo złączenia są sygnałami bezpieczeństwa. Skok tokenów bez pasującej aktywności użytkowników wygląda jak skradziony klucz albo nadużyta tożsamość obciążeniowa. Rosnący koszt-na-interakcję przy płaskim wolumenie znaczy, że zmienił się model. A drogi agent z zasięgiem do danych zastrzeżonych to priorytet, którego nie policzy żadna faktura - wydatki na jednostkę ryzyka to kolumna, którą ta platforma trzyma jako jedyna.

Czym dokładnie jest alert wypalania puli?

Przedpłacone pule kredytów są pilnowane względem przydziału, a alert odpala się na ustawionym przez Ciebie progu - przed poziomem pojemności, na którym agenci są automatycznie wyłączani. Tryb awarii, któremu to zapobiega, to wydatki, które po cichu stają się przestojem przez weekend.

Postaw kolumnę wydatków obok kolumny zasięgu.

Podłącz tylko do odczytu, a kolumny interakcji wypełnią się tego samego dnia. Import kredytów i role Azure to jedno popołudnie - a przegląd kwartalny przestaje zaczynać się od trzydziestodniowej migawki.

Albo znowu odtwarzaj zeszły kwartał z trzech konsol.