- Suivi automatique des coûts : pour les intégrations prises en charge, Weave capture l’utilisation des jetons à partir de la réponse de l’API et applique la tarification intégrée du modèle, sans code supplémentaire.
- Suivi personnalisé des coûts : pour les modèles affinés, les modèles auto-hébergés ou les modèles auxquels Weave ne s’intègre pas automatiquement, configurez Weave pour suivre des coûts personnalisés à l’aide des méthodes d’API disponibles.
Le SDK TypeScript de Weave ne prend pas en charge le suivi des coûts.
Utiliser le suivi automatique des coûts
Lorsque vous appelezweave.init() et utilisez une intégration LLM prise en charge comme OpenAI, Anthropic, Cohere ou Mistral, Weave enregistre automatiquement la consommation de jetons et calcule le coût de chaque appel. Les coûts apparaissent dans l’arborescence de trace et dans le tableau des appels de l’interface Weave. Ils sont également disponibles par code dans call.summary["weave"]["costs"] lorsque vous exécutez une requête sur les appels avec le paramètre include_costs défini sur true.
Le suivi automatique des coûts nécessite deux conditions :
- Le fournisseur LLM doit être une intégration prise en charge.
- La réponse de l’API doit inclure l’utilisation des jetons (la plupart des fournisseurs la renvoient par défaut).
Ajout d’un coût personnalisé
Utilisez le suivi personnalisé des coûts lorsque le suivi automatique des coûts n’est pas disponible, par exemple avec des modèles fine-tunés, des modèles auto-hébergés ou des fournisseurs auxquels Weave ne s’intègre pas. Les sections suivantes expliquent comment ajouter, interroger, purger et agréger des coûts personnalisés. Ajoutez un coût personnalisé à l’aide de la méthodeadd_cost.
Les trois champs requis sont llm_id, prompt_token_cost et completion_token_cost.
llm_id est le nom du LLM (par ex. gpt-4o). prompt_token_cost et completion_token_cost correspondent au coût par jeton du LLM. Si le prix du LLM est indiqué par million de jetons, convertissez la valeur.
Vous pouvez également définir effective_date sur une valeur datetime afin que le coût prenne effet à une date précise. Par défaut, la date du jour est utilisée.
Interroger les coûts personnalisés
Après avoir ajouté des coûts personnalisés, vous pouvez les récupérer pour vérifier leurs valeurs ou pour rechercher l’ID de coût nécessaire à d’autres opérations, comme la suppression. Vous pouvez interroger les coûts à l’aide de la méthodequery_costs.
Il existe plusieurs façons d’interroger les coûts : vous pouvez fournir un ID de coût unique ou une liste de noms de modèles LLM.
Purger un coût personnalisé
Purgez un coût personnalisé avec la méthodepurge_costs. Transmettez une liste d’ID de coût, et Weave purge les coûts correspondant à ces ID.
Calcul des coûts personnalisés d’un projet
Pour comprendre la dépense totale d’un projet, agrégez les coûts par appel renvoyés par Weave. Calculez les coûts d’un projet à l’aide deget_calls() avec include_costs=True.