SPEND PROOF / AI-AGENCIES
Le coût réel des agents que vous livrez à vos clients.
Un appel moins cher peut rendre une mission plus coûteuse.
Pour une agence IA, les reprises, les appels d’outils et les résultats inutilisables pèsent sur le coût d’une livraison. Spend Proof compare deux variantes sur les mêmes tâches et additionne les essais nécessaires pour obtenir un résultat réussi. Vous disposez d’un point de départ chiffré pour revoir une configuration ou préparer un essai client.
Évaluer le coût d’une livraison documentaire
Comparez deux chaînes d’extraction sur le même jeu de documents anonymisés. Une tâche n’est réussie que si elle respecte vos critères de champs corrects ; les reprises payantes restent dans le coût. L’audit ne reçoit pas les documents.
Comparer deux versions avant une livraison
Conservez les mêmes identifiants de tâches pour votre version de référence et votre nouvelle configuration. Un meilleur prix ne suffit pas : le diagnostic vérifie aussi les seuils de réussite et, si renseignée, la durée des essais.
Préparer une estimation de coût défendable
Projetez le coût au volume mensuel envisagé, pour un même nombre attendu de résultats réussis. Ajoutez séparément votre temps, l’intégration et les coûts métier : Spend Proof ne calcule pas votre marge commerciale.
Ce que vous recevez
- Coût total des essais et coût par tâche réussie pour chaque variante.
- Reprises, taux de réussite et contrôles qui empêchent une recommandation prématurée.
- Projection mensuelle conditionnelle lorsque les données comparables et les seuils le permettent.
Préparez un export avec des identifiants opaques, le workflow, la variante, le coût, le succès et éventuellement la durée. Aucun prompt, document client, nom de personne ni secret API n’est nécessaire. Dédupliquez votre télémétrie et incluez tous les coûts avant l’analyse.
Peut-on conclure que la nouvelle version améliorera notre marge ?
Non. L’audit compare les coûts enregistrés et les résultats que vous avez étiquetés. Il ne connaît ni vos prix de vente, ni le temps humain, ni les conséquences d’une erreur. Une différence favorable justifie un essai contrôlé ; elle ne prouve pas un bénéfice réalisé.
Nous n’avons pas encore de traces comparables. Que faire ?
Essayez la démonstration, explicitement fictive, puis exécutez les deux variantes sur le même jeu de tâches. Le seuil par défaut est de 30 tâches distinctes par variante. Répéter une seule tâche 30 fois ne remplace pas cet échantillon.
Le suivi de tous nos clients est-il déjà automatique ?
Non. Le produit disponible analyse un export choisi par vous. Une offre de suivi géré à 99 USD par mois est une hypothèse à tester ; elle n’est ni construite ni ouverte à l’achat. Le portail actuel donne accès aux essais de l’API en mode sandbox.