Rekommendationer

Konfigurationsändringar med förväntad besparing, kvalitetspåverkan och risk

Demodata. Ingen AI-leverantör eller gateway är ansluten ännu – samtliga siffror på skärmen är exempeldata, inte verklig telemetri.

Beräknad månatlig besparing

5 765 US$

Uppskattning, inte uppmätt besparing

Godkända eller tillämpade

0 US$

0 / 6

Fynd

6

Clear AI Spend ändrar inte din produktionskonfiguration. Godkänn och Markera som tillämpad registrerar bara ditt beslut här; gör ändringen i dina egna system.

Switch SupportClassifier to a lower-cost model

Dyr modell för enkel uppgift · SupportClassifier

Säkerhet 94 %
Risk: LågFöreslagen

Ticket routing is a short classification task running on a premium reasoning model.

Nuvarande konfiguration

claude-opus-class · temperature 0.2 · full ticket body

0,040 US$ / task · nuvarande lyckandefrekvens 98,7 %

Rekommenderad konfiguration

claude-haiku-class · temperature 0 · trimmed ticket body + label schema

0,0060 US$ / task · beräknad lyckandefrekvens 98,4 %

Beräknad besparing: 1 480 US$/månad

Enable prompt caching on ReplyDrafter preamble

Saknad cachning · ReplyDrafter

Säkerhet 97 %
Risk: LågFöreslagen

A 6.1k-token static preamble is re-billed on every one of ~41k monthly calls.

Nuvarande konfiguration

No prompt caching · full preamble per call

0,052 US$ / task · nuvarande lyckandefrekvens 97,2 %

Rekommenderad konfiguration

Provider prompt caching enabled · 5 min TTL

0,031 US$ / task · beräknad lyckandefrekvens 97,2 %

Beräknad besparing: 1 240 US$/månad

Add structured output + retry ceiling on LeadEnricher

Överdrivna omförsök · LeadEnricher

Säkerhet 89 %
Risk: LågFöreslagen

Schema validation failures trigger up to 4 retries on a premium model.

Nuvarande konfiguration

Free-form JSON parsing · max 4 retries · same model on retry

0,118 US$ / task · nuvarande lyckandefrekvens 91,3 %

Rekommenderad konfiguration

Native structured outputs · max 1 retry · efficient model on retry

0,061 US$ / task · beräknad lyckandefrekvens 94,4 %

Beräknad besparing: 1 105 US$/månad

Replace full-log context with top-k retrieval

För stor kontext · IncidentSummarizer

Säkerhet 82 %
Risk: MedelFöreslagen

Average 11.2k input tokens per summary where 1.6k retrieved chunks match quality.

Nuvarande konfiguration

Entire incident log inlined

0,074 US$ / task · nuvarande lyckandefrekvens 95,8 %

Rekommenderad konfiguration

Vector retrieval, top 8 chunks, 1.6k token budget

0,027 US$ / task · beräknad lyckandefrekvens 95,1 %

Beräknad besparing: 840 US$/månad

Add a loop breaker to PipelineTriager

Slingor av verktygsanrop · PipelineTriager

Säkerhet 78 %
Risk: MedelFöreslagen

12% of runs exceed 8 tool calls without converging, then fail.

Nuvarande konfiguration

Unbounded tool loop · premium model each hop

0,163 US$ / task · nuvarande lyckandefrekvens 88,1 %

Rekommenderad konfiguration

Max 4 tool hops · escalate to human after budget breach

0,098 US$ / task · beräknad lyckandefrekvens 89,7 %

Beräknad besparing: 690 US$/månad

Fingerprint-dedupe SQLCopilot requests

Dubblerade anrop · SQLCopilot

Säkerhet 93 %
Risk: LågFöreslagen

Identical query requests within 60s are billed twice.

Nuvarande konfiguration

No deduplication layer

0,021 US$ / task · nuvarande lyckandefrekvens 96,5 %

Rekommenderad konfiguration

Request fingerprint cache · 120s window

0,017 US$ / task · beräknad lyckandefrekvens 96,5 %

Beräknad besparing: 410 US$/månad