> ## Documentation Index
> Fetch the complete documentation index at: https://help.notis.ai/llms.txt
> Use this file to discover all available pages before exploring further.

# Consommation et tarifs des modèles

> Comment ton budget de consommation mensuel est suivi, ce que coûte chaque modèle et ce qui se passe quand tu atteins le plafond.

<h3 id="how-do-limits-work">
  Comment fonctionnent les limites ?
</h3>

Chaque forfait inclut un budget mensuel de consommation des agents, exprimé en dollars. Chaque message Notis est déduit de ce budget selon les tarifs des modèles Notis, qui incluent une marge de service de 20 % sur le prix public de l’API du fournisseur pour les modèles OpenAI. Tu peux voir ton cycle de facturation, ta consommation incluse, ta consommation On-Demand et le détail des requêtes sur la [page Consommation](https://app.notis.ai/usage) de ton portail. Dans une conversation du Manager, l’indicateur de consommation affiche aussi le coût déjà terminé de la conversation et la part de contexte utilisée par la dernière exécution.

Chaque forfait payant a son propre plafond : 20 \$/mois sur Pro, 59 \$ sur Pro+ et 149 \$ sur Ultra. Si tu utilises Notis en équipe, tout le monde partage une seule réserve de consommation mensuelle. Par exemple, une équipe Ultra de 10 personnes, à 149 \$ de consommation mensuelle incluse par siège, dispose d’une réserve commune de 1 490 \$ pour le mois. N’importe quel membre peut l’utiliser, et toute l’activité de l’équipe compte dans le même total. La page Consommation affiche la consommation partagée de l’équipe pour le cycle en cours, et c’est le propriétaire de l’équipe qui gère les paramètres de facturation.

Notis choisit automatiquement le modèle adapté à chaque tâche. Les prix ci-dessous sont indiqués pour 1 million de tokens et correspondent aux tarifs Notis actuels, marge incluse.

<Note>
  Le travail que tu envoies vers ton propre **abonnement Claude ou ChatGPT** ne puise pas dans ce budget. Quand le [routage des agents](/fr/agent-routing/overview) envoie un échange à Codex ou Claude Code, sur ton propre ordinateur ou dans ton [Cloud computer](/fr/tools/cloud-computer), le coût du modèle est facturé sur l’abonnement que tu paies déjà, et les tarifs ci-dessous ne s’appliquent pas. Les exécutions dans le cloud consomment quand même le temps de Cloud computer mensuel de ton forfait.
</Note>

<h3 id="auto-mode">
  Mode Auto
</h3>

Par défaut, Notis fonctionne en mode **Auto** (recommandé). Au lieu d’un modèle fixe, le routeur intelligent de Notis lit chaque échange et choisit le niveau d’intelligence (le modèle et son effort de réflexion) adapté à la tâche : un travail léger et peu coûteux pour une réponse rapide, un modèle plus puissant pour une tâche difficile en plusieurs étapes. Comme le choix se fait à chaque échange, une même conversation peut monter ou descendre de niveau selon le travail, et tu ne paies que ce dont chaque étape a réellement besoin.

<h3 id="intelligence-levels">
  Niveaux d’intelligence
</h3>

Tu peux **fixer** un niveau d’intelligence au lieu de laisser Auto choisir : par conversation dans [l’app Desktop et Web](/fr/channels/manager#intelligence-and-priority), comme valeur par défaut d’un canal dans [Canaux](/fr/channels/channels-compared#default-intelligence-priority), ou par automatisation dans [l’éditeur d’automatisations](/fr/get-started/automate#intelligence). Chaque niveau règle à la fois le modèle et son effort de réflexion :

| Niveau | Modèle      | Effort de réflexion | Prix par rapport à Moyen |
| ------ | ----------- | ------------------- | -----------------------: |
| Élevé  | gpt-6-astra | Élevé               |                       ×5 |
| Moyen  | gpt-6-sol   | Faible              |                       ×1 |
| Faible | gpt-6-luna  | Très élevé          |                      ÷20 |

Le multiplicateur compare les tarifs normaux par token de chaque modèle à ceux de Moyen. Élevé coûte 5 fois plus cher que Moyen par token ; Faible coûte vingt fois moins. La réflexion peut changer le nombre de tokens utilisés par un message, donc la facturation se base toujours sur le nombre réel de tokens et sur les tarifs ci-dessous.

<h3 id="processing-tiers-priority">
  Niveaux de traitement (priorité)
</h3>

Notis choisit automatiquement le niveau de traitement, mais sur un forfait avec accès prioritaire tu peux en fixer un par conversation ou par canal, en plus du niveau d’intelligence (il apparaît sous la forme **Standard / Rapide / Économique** dans le sélecteur) :

| Niveau (libellé du sélecteur) | Prix par rapport à Standard | Quand il est utilisé automatiquement                                               |
| ----------------------------- | --------------------------: | ---------------------------------------------------------------------------------- |
| Rapide (Fast)                 |    ×2 pour GPT-5.6 et GPT-6 | Échanges vocaux, quand le modèle le permet                                         |
| Standard (Normal)             |                          ×1 | Par défaut pour les messages classiques et le travail que tu lances toi-même       |
| Économique (Flex)             |                          ÷2 | Travail en arrière-plan ou lancé par une automatisation, quand le modèle le permet |

Si un modèle ne prend pas en charge Économique ou Rapide, Notis applique son tarif Standard. Les tableaux Flex et Fast ci-dessous donnent les tarifs par token qui en résultent.

<Note>
  Les préférences d’intelligence et de vitesse, y compris les [paramètres d’automatisation](/fr/get-started/automate#intelligence), s’appliquent aux agents qui font ton travail. Le coordinateur qui organise chaque conversation utilise toujours l’intelligence **Faible** et la vitesse **Rapide** ; ces préférences ne le modifient pas.
</Note>

<Tabs>
  <Tab title="Normal">
    | Modèle        |   Entrée | Entrée en cache |   Sortie |
    | ------------- | -------: | --------------: | -------: |
    | gpt-6-astra   | 12,00 \$ |         1,20 \$ | 60,00 \$ |
    | gpt-6-sol     |  2,40 \$ |         0,24 \$ | 12,00 \$ |
    | gpt-6-luna    |  0,12 \$ |        0,012 \$ |  0,60 \$ |
    | gpt-5.6-sol   |  6,00 \$ |         0,60 \$ | 36,00 \$ |
    | gpt-5.6-terra |  2,40 \$ |         0,24 \$ | 14,40 \$ |
    | gpt-5.6-luna  |  0,24 \$ |        0,024 \$ |  1,44 \$ |
  </Tab>

  <Tab title="Flex">
    | Modèle        |  Entrée | Entrée en cache |   Sortie |
    | ------------- | ------: | --------------: | -------: |
    | gpt-6-astra   | 6,00 \$ |         0,60 \$ | 30,00 \$ |
    | gpt-6-sol     | 1,20 \$ |         0,12 \$ |  6,00 \$ |
    | gpt-6-luna    | 0,06 \$ |        0,006 \$ |  0,30 \$ |
    | gpt-5.6-sol   | 3,00 \$ |         0,30 \$ | 18,00 \$ |
    | gpt-5.6-terra | 1,20 \$ |         0,12 \$ |  7,20 \$ |
    | gpt-5.6-luna  | 0,12 \$ |        0,012 \$ |  0,72 \$ |
  </Tab>

  <Tab title="Fast">
    | Modèle        |   Entrée | Entrée en cache |    Sortie |
    | ------------- | -------: | --------------: | --------: |
    | gpt-6-astra   | 24,00 \$ |         2,40 \$ | 120,00 \$ |
    | gpt-6-sol     |  4,80 \$ |         0,48 \$ |  24,00 \$ |
    | gpt-6-luna    |  0,24 \$ |        0,024 \$ |   1,20 \$ |
    | gpt-5.6-sol   | 12,00 \$ |         1,20 \$ |  72,00 \$ |
    | gpt-5.6-terra |  4,80 \$ |         0,48 \$ |  28,80 \$ |
    | gpt-5.6-luna  |  0,48 \$ |        0,048 \$ |   2,88 \$ |
  </Tab>
</Tabs>

Pour les requêtes GPT-5.6 ou GPT-6 exceptionnellement grandes, avec plus de 272 000 tokens d’entrée au total
(entrée en cache comprise), toute la requête passe aux tarifs « long contexte » : l’entrée et l’entrée
en cache sont facturées 2 fois le tarif du tableau, et la sortie 1,5 fois. Une requête avec exactement
272 000 tokens d’entrée reste aux tarifs normaux ci-dessus.

Les outils spécialisés ont leurs propres tarifs :

La Deep research utilise **gpt-5.6-terra** avec la recherche sur le web public. Son coût dépend
des tokens d’entrée et de sortie comptés pour la recherche terminée, aux tarifs Terra
des tableaux ci-dessus ; il n’y a pas de prix fixe par rapport.

| Modèle de l’outil                              | Base de tarification                                            |                                                                    Tarif Notis |
| ---------------------------------------------- | --------------------------------------------------------------- | -----------------------------------------------------------------------------: |
| Nano Banana Pro (`gemini-3-pro-image-preview`) | Texte en entrée / image en entrée / réflexion / texte en sortie |               2,40 \$ / 2,40 \$ / 14,40 \$ / 14,40 \$ pour 1 million de tokens |
| Nano Banana Pro (`gemini-3-pro-image-preview`) | Image en sortie                                                 |                                             144,00 \$ pour 1 million de tokens |
| Flare (`gpt-image-2.5-flare`)                  | Texte en entrée / texte en entrée en cache                      |                                     6,00 \$ / 1,50 \$ pour 1 million de tokens |
| Flare (`gpt-image-2.5-flare`)                  | Image en entrée / image en entrée en cache / image en sortie    |                          9,60 \$ / 2,40 \$ / 36,00 \$ pour 1 million de tokens |
| Sunburst (`gpt-image-2.5-sunburst`)            | Texte en entrée / texte en entrée en cache                      |                                     6,00 \$ / 1,50 \$ pour 1 million de tokens |
| Sunburst (`gpt-image-2.5-sunburst`)            | Image en entrée / image en entrée en cache / image en sortie    |                          9,60 \$ / 2,40 \$ / 36,00 \$ pour 1 million de tokens |
| gpt-transcribe                                 | Transcription                                                   |                                                           0,0054 \$ par minute |
| gpt-4o-mini-tts                                | Texte en entrée / audio en sortie                               |                                    0,72 \$ / 14,40 \$ pour 1 million de tokens |
| eleven\_v3                                     | Texte lu à voix haute                                           | 237,60 \$ pour 1 million de caractères (environ 0,24 \$ pour 1 000 caractères) |
| Firecrawl                                      | Page web lue                                                    |                                                             0,0038 \$ par page |
| sora-2-pro                                     | Vidéo en 720p                                                   |                                                            0,36 \$ par seconde |

Flare et Sunburst ont les mêmes tarifs, marge de service Notis de 20 % incluse. Leur coût total par image peut varier : la qualité, les dimensions, les images de référence et le modèle choisi influent sur le nombre de tokens utilisés. Aucun de ces deux modèles d’image ne facture le texte en sortie.

La lecture de texte à voix haute et la lecture d’une page web comptent dans ta consommation comme tout le reste. Les deux étaient gratuites auparavant : si tu les utilises beaucoup, tu les verras désormais apparaître dans le détail de ta consommation.

Les [outils payants à l’usage](/fr/tools/included-tools) sont comptés de la même façon. Chacun a son propre prix par utilisation, indiqué sur sa page, et il est déduit de la même consommation mensuelle.

<h3 id="what-happens-when-i-reach-my-limit">
  Que se passe-t-il quand j’atteins ma limite ?
</h3>

Une fois ta consommation mensuelle épuisée, Notis te prévient et te propose de passer à un forfait supérieur, d’activer la **Consommation On-Demand** ou d’attendre le renouvellement de ton cycle de facturation. En équipe, cela veut dire que la réserve commune de l’équipe est épuisée.

On-Demand est facultatif. Si tu le laisses désactivé, Notis met en pause le travail payant une fois le plafond de ton forfait atteint. Si tu l’actives, Notis peut continuer au-delà de tes crédits inclus et facturer la consommation supplémentaire à part. Tu peux choisir une limite On-Demand mensuelle fixe ou le mode Illimité.

Le guide complet est ici : [Consommation On-Demand](/fr/account-and-settings/billing/on-demand-usage).
