Détail des tarifs d'utilisation
Cette page détaille exactement comment Neotask calcule les frais basés sur l'utilisation. La plupart des utilisateurs du plan Individual ne verront jamais ces frais. Ce détail est destiné aux utilisateurs enterprise qui font tourner des agents à grande échelle.
Pour un aperçu des plans et du fonctionnement de la facturation, voir Facturation et plans.
Comment l'utilisation est calculée
Chaque fois que votre agent traite un message, il consomme des jetons IA (entrée et sortie). Le coût de ces jetons dépend du modèle IA utilisé par votre agent. Le système suit quatre types de jetons séparément, chacun avec son propre tarif :
- Jetons d'entrée : l'invite et le contexte envoyés au modèle
- Jetons de sortie : la réponse que le modèle génère
- Jetons de lecture de cache : jetons servis depuis le cache des invites (moins chers que l'entrée)
- Jetons d'écriture de cache : jetons écrits dans le cache des invites pour une réutilisation future
Formule de calcul des coûts
Coût = (jetons d'entrée / 1 000 000) x tarif d'entrée
+ (jetons de sortie / 1 000 000) x tarif de sortie
+ (jetons de lecture de cache / 1 000 000) x tarif de lecture de cache
+ (jetons d'écriture de cache / 1 000 000) x tarif d'écriture de cache
Source : server/src/config/modelPricing.ts
Tarifs des jetons des modèles IA
Voici les tarifs par jeton pour chaque modèle IA pris en charge. Tous les tarifs sont en USD par million de jetons.
Anthropic Claude
| Modèle | Entrée | Sortie | Lecture cache | Écriture cache |
|---|---|---|---|---|
| Claude Opus 4.6 | 15,00 $ | 75,00 $ | 1,50 $ | 18,75 $ |
| Claude Sonnet 4.5 | 3,00 $ | 15,00 $ | 0,30 $ | 3,75 $ |
| Claude Haiku 4.5 | 0,80 $ | 4,00 $ | 0,08 $ | 1,00 $ |
| Claude 3.5 Sonnet | 3,00 $ | 15,00 $ | 0,30 $ | 3,75 $ |
| Claude 3.5 Haiku | 0,80 $ | 4,00 $ | 0,08 $ | 1,00 $ |
| Claude 3 Opus | 15,00 $ | 75,00 $ | 1,50 $ | 18,75 $ |
| Claude 3 Sonnet | 3,00 $ | 15,00 $ | 0,30 $ | 3,75 $ |
| Claude 3 Haiku | 0,25 $ | 1,25 $ | 0,03 $ | 0,30 $ |
OpenAI
| Modèle | Entrée | Sortie | Lecture cache | Écriture cache |
|---|---|---|---|---|
| GPT-4o | 2,50 $ | 10,00 $ | 1,25 $ | 2,50 $ |
| GPT-4o Mini | 0,15 $ | 0,60 $ | 0,075 $ | 0,15 $ |
| GPT-4 Turbo | 10,00 $ | 30,00 $ | 5,00 $ | 10,00 $ |
| GPT-4 | 30,00 $ | 60,00 $ | 15,00 $ | 30,00 $ |
| o1 | 15,00 $ | 60,00 $ | 7,50 $ | 15,00 $ |
| o1-mini | 3,00 $ | 12,00 $ | 1,50 $ | 3,00 $ |
| o3-mini | 1,10 $ | 4,40 $ | 0,55 $ | 1,10 $ |
Google Gemini
| Modèle | Entrée | Sortie | Lecture cache | Écriture cache |
|---|---|---|---|---|
| Gemini 2.0 Flash | 0,10 $ | 0,40 $ | 0,025 $ | 0,10 $ |
| Gemini 1.5 Pro | 1,25 $ | 5,00 $ | 0,3125 $ | 1,25 $ |
| Gemini 1.5 Flash | 0,075 $ | 0,30 $ | 0,01875 $ | 0,075 $ |
Source : server/src/config/modelPricing.ts lignes 8-42
Frais de plateforme et majorations
Plusieurs frais distincts peuvent s'appliquer selon la façon dont votre agent est utilisé. Ce ne sont pas des tarifs forfaitaires uniques ; chacun s'applique dans des situations différentes.
1. Majoration en mode crédits (Clé Système) : 20 %
Lorsque vous utilisez les clés API gérées d'Neotask (mode Clé Système), une majoration de 20 % est appliquée en plus du coût brut des jetons. Cela couvre la gestion des clés API, le basculement automatique entre fournisseurs, le routage des modèles et l'infrastructure.
Si vous utilisez le mode BYOK (Apportez vos propres clés), les coûts des jetons vont directement à votre fournisseur IA, mais des frais de plateforme de 20% sont déduits de vos crédits.
Source : server/src/config/modelPricing.ts ligne 53, CREDIT_MODE_MARKUP_PCT = 0.20
2. Frais de dépassement de plateforme (variable)
Lorsque votre utilisation dépasse votre pool de crédits inclus, le coût restant devient un dépassement. Des frais de plateforme sont appliqués en plus du montant de dépassement. Le taux dépend de votre niveau de plan :
| Niveau | Frais de dépassement |
|---|---|
| Individuel | 25 % |
| Business | 15 % |
| Enterprise | 10 % |
Les frais de dépassement sont uniquement facturés sur le montant qui dépasse votre pool de crédits. L'utilisation dans votre pool n'entraîne pas de frais supplémentaires.
Le dépassement est automatiquement facturé sur votre carte lorsque le montant non réglé atteint 10 $ (montant minimum de charge Stripe : 0,50 $).
Source : server/src/config/planConfig.ts, overageFeePct et overageChargeThreshold
3. Majoration d'automatisation : progressif de 50 % à 33 %
Lorsque vos agents exécutent des tâches automatisées (tâches planifiées, cron jobs, automatisations récurrentes), une majoration d'automatisation supplémentaire est appliquée en plus du coût des jetons. C'est parce que les agents automatisés remplacent le travail manuel. Ils s'exécutent sans surveillance, selon un calendrier, gérant des tâches qui nécessiteraient autrement des employés.
La majoration d'automatisation utilise des tranches progressives (comme l'impôt sur le revenu). Vous payez un taux plus élevé sur vos premiers dollars de dépenses automatisées et un taux plus bas à mesure que vos dépenses automatisées augmentent. Il n'y a pas d'effets de seuil ; chaque dollar est facturé uniquement au taux de sa tranche.
| Dépenses automatisées cumulées (par cycle de facturation) | Taux de majoration marginal |
|---|---|
| 0 $ - 10 $ | 50 % |
| 10,01 $ - 25 $ | 45 % |
| 25,01 $ - 50 $ | 40 % |
| 50,01 $ - 100 $ | 37 % |
| 100,01 $+ | 33 % |
Source : server/src/config/automationMarkup.ts lignes 38-44, DEFAULT_AUTOMATION_BRACKETS
4. Majoration pour tâches de codage : forfait 50 %
Les tâches automatisées impliquant des outils de codage (lectures de fichiers, écritures, exécution de code, commandes bash) sont facturées à une majoration forfaitaire de 50 %. La réduction progressive ne s'applique pas aux tâches de codage ; elle est toujours de 50 % quelle que soit la dépense cumulée.
Outils de codage : exec, read, write, bash, code
Source : server/src/config/automationMarkup.ts ligne 49, CODING_TASK_MARKUP_RATE = 0.50
Comment les coûts s'accumulent
Ces frais peuvent s'accumuler selon la situation :
Chat interactif (mode Clé Système) :
- Coût brut des jetons + majoration de 20 % en mode crédits
- Pas de majoration d'automatisation (non automatisé)
Chat interactif (mode BYOK) :
- Coût brut des jetons + 20% frais de plateforme sur crédits
Cron job automatisé (mode Clé Système) :
- Coût brut des jetons + majoration de 20 % en mode crédits + majoration d'automatisation (50 %-33 %)
Tâche de codage automatisée (mode Clé Système) :
- Coût brut des jetons + majoration de 20 % en mode crédits + majoration de 50 % pour tâche de codage
Exemple de facturation d'automatisation
Un cron job planifié s'exécute quotidiennement. L'agent IA prend environ 2 à 3 heures pour terminer son travail. Le job consomme 10 $ en jetons bruts (le coût réel pour le fournisseur IA).
Décomposition :
- Coût des jetons : 10 $ (transmis au fournisseur IA ; c'est ce que coûte le calcul)
- Majoration d'automatisation : 10 $ x 50 % = 5 $ (frais de plateforme pour exécuter le job sans surveillance)
- Charge totale : 15 $
Les 10 $ couvrent le calcul IA réel que votre agent a consommé. Les 5 $ sont les frais d'automatisation. La plateforme a exécuté le job selon le calendrier, surveillé l'exécution, géré les réessais et livré les résultats, le tout sans que personne n'ait besoin d'être devant un ordinateur.
Pourquoi l'automatisation coûte-t-elle plus cher : Les agents automatisés remplacent le travail humain. Un cron job qui vérifie vos analyses chaque matin, rédige des rapports, surveille les stocks ou traite les commandes entrantes effectue un travail qui nécessiterait autrement le temps d'une personne. La majoration d'automatisation reflète la valeur de cette exécution sans surveillance, et elle diminue plus vous automatisez, récompensant l'échelle. Un tenant dépensant plus de 100 $/cycle en jobs automatisés ne paie que 33 % de majoration au lieu de 50 %.
Crédits rechargeables
Vous pouvez acheter des crédits supplémentaires à tout moment pour prépayer l'utilisation :
- Rechargement minimum : 5 $
- Rechargement maximum : 10 000 $
- Les crédits n'expirent jamais. Ils restent sur votre compte jusqu'à utilisation.
- Rechargement automatique : Configurez optionnellement des rechargements automatiques lorsque votre solde tombe en dessous d'un seuil (par défaut : un solde de 2 $ déclenche un rechargement de 10 $)
Les crédits rechargeables sont consommés après épuisement de votre pool de crédits et avant l'accumulation de dépassements. Cela signifie que les rechargements servent de tampon entre vos crédits inclus et les frais de dépassement.
Source : server/src/services/overageCharger.ts, server/src/services/balanceService.ts
Ordre de déduction des crédits
Lorsque votre agent termine une tâche, le coût est déduit dans cet ordre :
- Crédits d'inscription ($10 uniques à l'inscription, ne se réinitialisent pas)
- Solde rechargeable (crédits achetés, n'expirent jamais)
- Dépassement (facturé sur votre carte avec frais de plateforme appliqués)
Cela signifie que vos crédits inclus sont toujours utilisés en premier, puis les rechargements achetés, et la facturation de dépassement ne commence qu'une fois les deux épuisés.
Source : server/src/services/balanceService.ts lignes 240-286
Contrôles budgétaires
Les utilisateurs Enterprise disposent d'une application budgétaire intégrée :
- Budget journalier global : Par défaut 500 $/jour (configurable). En cas de dépassement, la passerelle des agents s'arrête automatiquement pour éviter des coûts incontrôlés.
- Limites de dépenses par agent : Définissez un plafond journalier pour chaque agent individuel. Lorsqu'un agent atteint sa limite, ses sessions sont automatiquement mises en pause.
- Arrêt automatique : Configurable. Activez ou désactivez l'arrêt automatique de la passerelle en cas de dépassement du budget.
- Application en temps réel : Le budget est vérifié toutes les 30 secondes.
Source : Neotask-Electron/src/main/budgetEnforcer.ts, Neotask-Electron/src/main/agentSpendLimitStore.ts
Consulter votre utilisation
Suivez tout cela en temps réel depuis la page Utilisation dans l'application de bureau :
- Détail au niveau des jetons par modèle, fournisseur, agent, canal et date
- Détail des coûts : coûts d'entrée, de sortie, de lecture de cache et d'écriture de cache affichés séparément
- Granularité temporelle : aujourd'hui, dernières 24h, 7 jours, 30 jours, 365 jours ou plage personnalisée
- Attribution par agent : voir exactement quel agent consomme quoi
- Attribution par canal : détail des coûts par canal de messagerie
- Attribution par fournisseur : coût par fournisseur IA (Anthropic, OpenAI, Google)
- Export CSV/JSON pour analyse externe
Voir Facturation et plans pour plus d'informations sur la gestion de votre abonnement.