8. Astuces pour réduire les coûts
Appliquez des stratégies pratiques — sélection automatique de modèle, briefs clairs, bases de connaissances plutôt que du copier-coller, et discussions temporaires — pour minimiser la consommation de crédits.
Chaque action sur OUPI — un message de chat, une génération d'image, une mission d'agent — coûte des crédits en fonction des ressources qu'elle consomme réellement. Le coût du texte dépend du nombre de tokens échangés multiplié par le poids du modèle utilisé : les modèles de pointe (haut de gamme) coûtent bien plus par token que les modèles rapides (légers). Les médias sont tarifés par génération selon le moteur et la taille ou la durée du résultat. Les missions d'agent additionnent tous les appels de modèle et les utilisations d'outils sur l'ensemble de leurs cycles de travail. La bonne nouvelle : vous n'êtes jamais facturé pour une opération qui échoue, et les coûts sont toujours affichés afin que vous puissiez apprendre ce qui est coûteux.
Laissez la sélection automatique de modèle faire le travail. Lorsque vous ne choisissez pas manuellement un modèle, OUPI privilégie les modèles plus légers et moins chers pour les tâches de routine, et ne bascule vers des modèles plus lourds que lorsque la complexité l'exige. Pour la plupart des questions du quotidien, cela permet d'économiser des crédits sans perte de qualité notable.
Rédigez un brief clair et précis pour chaque mission. Des objectifs flous obligent l'agent à effectuer des cycles supplémentaires de raisonnement et d'utilisation d'outils, chacun ayant un coût en crédits. Un résultat bien défini signifie moins de cycles et une facture moins élevée. Comme le dit la plateforme elle-même : un brief clair est l'optimisation la moins chère.
Stockez les documents longs ou réutilisables dans une base de connaissances plutôt que de les coller dans le chat. Le texte collé gonfle le nombre de tokens de chaque message de la conversation, tandis qu'une base de connaissances permet au modèle de ne récupérer que les parties pertinentes — réduisant considérablement l'utilisation de tokens.
Utilisez des chats temporaires pour les questions ponctuelles. Une conversation persistante accumule du contexte (et donc des tokens) au fil du temps. Si vous n'avez besoin que d'une réponse rapide, un chat temporaire maintient le nombre de tokens au minimum et évite d'alourdir les futurs messages.
Ouvrez la page Missions et regardez le coût affiché sur l'une de vos missions récentes. Comparez une mission où vous avez donné un brief détaillé avec une autre où l'objectif était vague. Remarquez la différence dans le nombre de cycles et le total de crédits consommés — cela développe votre intuition de ce qui est coûteux.
Quatre habitudes permettent de limiter vos dépenses en crédits : (1) laisser la sélection automatique choisir le modèle le plus léger adapté à la tâche, (2) rédiger des briefs clairs et précis pour que les missions se terminent en moins de cycles, (3) utiliser des bases de connaissances plutôt que de coller de longs documents, et (4) recourir aux chats temporaires lorsque vous n'avez pas besoin d'une conversation durable. Vérifiez régulièrement les coûts des missions pour affiner votre sens de ce qui consomme le plus — et rappelez-vous, vous n'êtes jamais facturé pour une opération échouée.