Asteria Docs

Utilisation et coûts

Ce qui a été dépensé, par qui, pour quoi, et pourquoi le chiffre est une estimation.

Utilisation dans la console. Une plage de dates (d'aujourd'hui à 90 jours) et quatre chiffres en tête : total des requêtes, total des tokens, coût estimé, taux d'erreur.

Les chiffres de coût sont des estimations, calculées à partir de la tarification que vous avez configurée sur chaque modèle. Pour les montants réellement facturés, regardez le tableau de bord de votre fournisseur. Si votre organisation tourne sur les crédits, rien de tout cela ne s'applique : ce qui vous est facturé est ce que le modèle a réellement coûté, et c'est reporté sur la page Crédits.

Ce qui veut dire que l'estimation ne vaut que ce que vaut la tarification que vous avez saisie. Un modèle sans prix contribue des requêtes et des tokens mais rien au coût, si bien que le total se lit trop bas et que rien ne le signale en tête de page. C'est le mode de défaillance à surveiller : un mois étonnamment peu cher est plus souvent un prix manquant qu'un mois calme.

Les répartitions

Utilisation quotidienne sur la plage, pour la silhouette plutôt que pour la précision.

Par modèle montre où se trouve le volume. Basculez entre les noms d'affichage et les identifiants bruts quand vous devez faire correspondre quelque chose avec le reporting de votre fournisseur.

Par utilisateur est la plus franche. Elle montre qui se sert vraiment de l'outil, ce dont vous avez besoin au renouvellement et ce qui vous dit si un déploiement a pris ou s'est éteint.

Par projet attribue le trafic API. Les projets supprimés sont regroupés plutôt qu'écartés, de sorte que les totaux historiques tombent toujours juste.

Coût par modèle reprend les mêmes données rangées pour la question « qu'est-ce qui coûte cher ? ».

Erreurs et replis

Mérite plus d'attention qu'on ne lui en accorde d'habitude, parce que c'est là qu'apparaît une tendance qu'aucun utilisateur seul ne peut voir.

Échecs francs par catégorie : limite de débit, contexte trop long, authentification, erreurs serveur, délais dépassés, fonctions non prises en charge, quota dépassé, et « tous les modèles ont échoué ».

Déclenchements de repli par catégorie est la moitié intéressante. Ce sont des requêtes qui ont réussi, sur un autre modèle que prévu, parce que le modèle principal a échoué. L'utilisateur a été prévenu sur le moment, par une bannière nommant les deux modèles, mais une bannière isolée pousse rarement quiconque à signaler quoi que ce soit. C'est ici, et dans l'alerte du Tableau de bord, que le taux devient visible.

Lisez les catégories comme des consignes :

CatégorieVeut dire en général
Limite de débitVotre palier fournisseur est trop petit pour la charge
Contexte trop longUne fenêtre de contexte est mal réglée, ou les conversations sont très longues
AuthentificationUne clé a expiré ou a été révoquée. À corriger tout de suite
Quota dépasséPlafond de dépense atteint chez le fournisseur
Tous les modèles ont échouéVotre chaîne de repli est épuisée ou absente

Erreurs récentes liste les erreurs une à une avec le modèle, le message et l'heure, ce qu'il vous faut quand quelqu'un signale quelque chose d'étrange à un moment précis.

Le détail par projet

Chaque projet porte son propre onglet d'utilisation et un budget mensuel optionnel. Cette page est la vue à l'échelle de l'organisation ; l'onglet du projet est l'endroit où trouver les réponses par surface.

On this page