Skip to main content

Comment fonctionnent les limites ?

Chaque forfait inclut un budget mensuel de consommation des agents, exprimé en dollars. Chaque message Notis est déduit de ce budget selon les tarifs des modèles Notis, qui incluent une marge de service de 20 % sur le prix public de l’API du fournisseur pour les modèles OpenAI. Tu peux voir ton cycle de facturation, ta consommation incluse, ta consommation On-Demand et le détail des requêtes sur la page Consommation de ton portail. Dans une conversation du Manager, l’indicateur de consommation affiche aussi le coût déjà terminé de la conversation et la part de contexte utilisée par la dernière exécution. Chaque forfait payant a son propre plafond : 20 $/mois sur Pro, 59 $ sur Pro+ et 149 $ sur Ultra. Si tu utilises Notis en équipe, tout le monde partage une seule réserve de consommation mensuelle. Par exemple, une équipe Ultra de 10 personnes, à 149 $ de consommation mensuelle incluse par siège, dispose d’une réserve commune de 1 490 $ pour le mois. N’importe quel membre peut l’utiliser, et toute l’activité de l’équipe compte dans le même total. La page Consommation affiche la consommation partagée de l’équipe pour le cycle en cours, et c’est le propriétaire de l’équipe qui gère les paramètres de facturation. Notis choisit automatiquement le modèle adapté à chaque tâche. Les prix ci-dessous sont indiqués pour 1 million de tokens et correspondent aux tarifs Notis actuels, marge incluse.
Le travail que tu envoies vers ton propre abonnement Claude ou ChatGPT ne puise pas dans ce budget. Quand le routage des agents envoie un échange à Codex ou Claude Code, sur ton propre ordinateur ou dans ton Cloud computer, le coût du modèle est facturé sur l’abonnement que tu paies déjà, et les tarifs ci-dessous ne s’appliquent pas. Les exécutions dans le cloud consomment quand même le temps de Cloud computer mensuel de ton forfait.

Mode Auto

Par défaut, Notis fonctionne en mode Auto (recommandé). Au lieu d’un modèle fixe, le routeur intelligent de Notis lit chaque échange et choisit le niveau d’intelligence (le modèle et son effort de réflexion) adapté à la tâche : un travail léger et peu coûteux pour une réponse rapide, un modèle plus puissant pour une tâche difficile en plusieurs étapes. Comme le choix se fait à chaque échange, une même conversation peut monter ou descendre de niveau selon le travail, et tu ne paies que ce dont chaque étape a réellement besoin.

Niveaux d’intelligence

Tu peux fixer un niveau d’intelligence au lieu de laisser Auto choisir : par conversation dans l’app Desktop et Web, comme valeur par défaut d’un canal dans Canaux, ou par automatisation dans l’éditeur d’automatisations. Chaque niveau règle à la fois le modèle et son effort de réflexion : Le multiplicateur compare les tarifs normaux par token de chaque modèle à ceux de Moyen. Élevé coûte 5 fois plus cher que Moyen par token ; Faible coûte vingt fois moins. La réflexion peut changer le nombre de tokens utilisés par un message, donc la facturation se base toujours sur le nombre réel de tokens et sur les tarifs ci-dessous.

Niveaux de traitement (priorité)

Notis choisit automatiquement le niveau de traitement, mais sur un forfait avec accès prioritaire tu peux en fixer un par conversation ou par canal, en plus du niveau d’intelligence (il apparaît sous la forme Standard / Rapide / Économique dans le sélecteur) : Si un modèle ne prend pas en charge Économique ou Rapide, Notis applique son tarif Standard. Les tableaux Flex et Fast ci-dessous donnent les tarifs par token qui en résultent.
Les préférences d’intelligence et de vitesse, y compris les paramètres d’automatisation, s’appliquent aux agents qui font ton travail. Le coordinateur qui organise chaque conversation utilise toujours l’intelligence Faible et la vitesse Rapide ; ces préférences ne le modifient pas.
Pour les requêtes GPT-5.6 ou GPT-6 exceptionnellement grandes, avec plus de 272 000 tokens d’entrée au total (entrée en cache comprise), toute la requête passe aux tarifs « long contexte » : l’entrée et l’entrée en cache sont facturées 2 fois le tarif du tableau, et la sortie 1,5 fois. Une requête avec exactement 272 000 tokens d’entrée reste aux tarifs normaux ci-dessus. Les outils spécialisés ont leurs propres tarifs : La Deep research utilise gpt-5.6-terra avec la recherche sur le web public. Son coût dépend des tokens d’entrée et de sortie comptés pour la recherche terminée, aux tarifs Terra des tableaux ci-dessus ; il n’y a pas de prix fixe par rapport. Flare et Sunburst ont les mêmes tarifs, marge de service Notis de 20 % incluse. Leur coût total par image peut varier : la qualité, les dimensions, les images de référence et le modèle choisi influent sur le nombre de tokens utilisés. Aucun de ces deux modèles d’image ne facture le texte en sortie. La lecture de texte à voix haute et la lecture d’une page web comptent dans ta consommation comme tout le reste. Les deux étaient gratuites auparavant : si tu les utilises beaucoup, tu les verras désormais apparaître dans le détail de ta consommation. Les outils payants à l’usage sont comptés de la même façon. Chacun a son propre prix par utilisation, indiqué sur sa page, et il est déduit de la même consommation mensuelle.

Que se passe-t-il quand j’atteins ma limite ?

Une fois ta consommation mensuelle épuisée, Notis te prévient et te propose de passer à un forfait supérieur, d’activer la Consommation On-Demand ou d’attendre le renouvellement de ton cycle de facturation. En équipe, cela veut dire que la réserve commune de l’équipe est épuisée. On-Demand est facultatif. Si tu le laisses désactivé, Notis met en pause le travail payant une fois le plafond de ton forfait atteint. Si tu l’actives, Notis peut continuer au-delà de tes crédits inclus et facturer la consommation supplémentaire à part. Tu peux choisir une limite On-Demand mensuelle fixe ou le mode Illimité. Le guide complet est ici : Consommation On-Demand.