APIGuard met tes réponses en cache et route les requêtes simples vers des modèles 30× moins chers. Puis il t'affiche un seul chiffre : ce que tu as économisé.
npm i apiguard-sdk · gratuit jusqu'à 10 000 requêtes/mois
Comment ça marche
Rien à héberger, rien à maintenir. Tu remplaces ton client IA par le nôtre, le reste est automatique.
Tu la paies une fois. Une réponse déjà connue ressort du cache (mémoire ou Redis) en 1 ms, sans rappeler l'API.
« Traduis ce mot » n'a pas besoin de Claude Opus. Des règles simples envoient les requêtes triviales vers un modèle bien moins cher.
Les autres te montrent ce que tu dépenses. APIGuard te montre ce que tu économises — par jour, par modèle, par feature.
La preuve, pas le pitch
Une vraie conversation de plusieurs centaines de messages — ~150 000 tokens de contexte — envoyée à un modèle premium. C'est là que ta facture se joue, pas sur des fractions de centime.
Tu décides quand une réponse peut partir sur un modèle capable moins cher (−70%), et une question déjà posée ressort du cache (−100%). Sur du volume, ces euros s'empilent vite.
Exemple sur du volume premium. La baisse réelle (60 à 90%) dépend de ta part de requêtes routables et répétées. Tu paies toujours quelque chose — juste beaucoup moins. Ton chiffre exact s'affiche dans le dashboard.
Pourquoi pas un autre
| APIGuard | Portkey | Helicone | Cloudflare AI | LiteLLM | |
|---|---|---|---|---|---|
| Montre ce que tu économises | Oui | Non | Non | Non | Non |
| Pas un proxy — tes clés restent chez toi | Oui | Non | Non | Non | Oui |
| 3 lignes · zéro infra | Oui | ~ | Oui | Oui | Non |
| Prix public et simple | Oui | Non | ~ | Oui | Oui |
| Supporte Mammouth.ai | Oui | Non | Non | Non | Non |
Prix
Si ton chiffre vert dépasse 9 €, le Pro est déjà rentabilisé. Sinon, reste sur Free — c'est le principe.
Questions directes