Cost-Aware LLM Pipeline
Gardez vos dépenses d'API LLM sous contrôle : routage de modèles, suivi de coûts immuable, retries ciblés et cache de prompts.
- Quoi
- Gardez vos dépenses d'API LLM sous contrôle : routage de modèles, suivi de coûts immuable, retries ciblés et cache de prompts.
- Coût
- Gratuit
- Prérequis
- Utilisez « Pipeline LLM économe » avec votre Muse.
- Installation
- Copiez le prompt d’installation ci-dessous dans votre Muse — votre agent fait le reste.
Sélectionné par Skill Harbor : des motifs composables pour maîtriser les coûts d'API LLM sans sacrifier la qualité. Quatre techniques : routage de modèles selon la complexité (modèles bon marché pour le simple, palier supérieur pour le complexe, avec exemples de seuils), suivi de coûts immuable (dataclasses gelées, dépense cumulée, limite budgétaire qui échoue vite), logique de retry ciblée (ne réessayer que les erreurs transitoires comme les rate limits et les 5xx, échouer immédiatement sur auth ou bad request), et cache de prompts pour les longs prompts système. Une section de composition montre les quatre techniques câblées dans une seule fonction de pipeline, plus un tableau de tarifs 2026 par palier de modèle, des bonnes pratiques (commencer pas cher, journaliser les décisions de routage, fixer des budgets explicites) et des anti-motifs (le modèle le plus cher pour tout, réessayer les erreurs permanentes, muter l'état des coûts, ignorer le cache). Par @affaan-m, listé ici avec crédit à son créateur. Tiré du dépôt affaan-m/ECC (MIT). Bémols honnêtes : motifs Python orientés développeurs, à adapter à votre stack ; le tableau de tarifs est un instantané 2026, vérifiez toujours les tarifs actuels des fournisseurs avant de budgéter. Skill Harbor ne vérifie jamais le code, examinez-le vous-même avant usage.
Version :
Installation
Copiez le dossier d’installation ci-dessous, puis collez-le dans MuseCréation de la communauté. Skill Harbor ne vérifie pas le code — examinez la source avant de l'installer.
Utilisez « Pipeline LLM économe » avec votre Muse. Prérequis : l'app Muse (mobile ou web), et une application ou un script qui appelle des API LLM (Claude, GPT ou similaire). Aucune installation, aucune clé API pour le skill lui-même. 1. Ouvrez le skill : https://github.com/affaan-m/ECC/blob/main/skills/cost-aware-llm-pipeline/SKILL.md et copiez le texte complet du SKILL.md. 2. Collez-le dans un chat avec Muse et ajoutez : « Applique les motifs du pipeline économe à [décrivez votre app ou batch : modèles utilisés, volumes]. Commence par les seuils de routage de modèles. » 3. Demandez à Muse de rédiger le CostTracker avec votre limite budgétaire, la politique de retry pour vos types d'erreurs, et quels prompts sont éligibles au cache. Astuce : fixez la limite budgétaire avant de traiter le moindre batch. Échouer tôt sur le budget vaut mieux que découvrir le dépassement après. Sécurité : un skill est du texte d'instructions ; il n'exécute rien tout seul. Ne collez jamais de clés API dans un chat, et relisez tout ce que Muse propose avant qu'il n'agisse.
Enregistré dans vos installs récentes. Retrouvez-le à tout moment sur /connect.
Questions
Comment installer une création ?
Chaque fiche produit contient un prompt d’installation à copier-coller. Collez-le dans votre Muse et il installe la création pour vous — sans configuration manuelle.
Où va mon argent ?
Directement au vendeur. Skill Harbor ne traite jamais les paiements : le paiement se fait sur la page du vendeur, généralement via Stripe.
Que signifie le ✓ à côté du nom d’un créateur ?
Il signifie que nous avons confirmé l’identité de la personne derrière la fiche. Il ne dit rien sur le code lui-même — vérifiez toujours une création avant de l’installer.