Fable Mode en Model Routing
Laatst bijgewerkt: 17-07-2026
TL;DR: Het model is niet de slotgracht — het proces wél; extraheer Fable's werkwijze in een herbruikbare "Fable mode"-skill en combineer die met een expliciete model-routing-tabel zodat goedkopere modellen het werk doen dat ze aankunnen.
De kernstelling: je kunt de intelligentie van een topmodel als Fable 5 niet vasthouden (het gaat terug achter een subscription), maar je kunt wél zijn proces vastleggen. Een beginner met Fable 5 verliest van een expert met een zwakker model, omdat de instructies, systemen en loops rond het model belangrijker zijn dan het model zelf. Behandel een sterk model daarom als een leraar (of senior engineer die z'n kennis overdraagt aan junioren), niet als een workhorse.
Het model is niet de slotgracht
Nate Herk testte dynamic workflows waarin Fable de orchestrator was met sub-agents op respectievelijk Fable, Opus en Sonnet. De resultaten waren ongeveer gelijk, terwijl de Fable-workers exponentieel duurder waren. Conclusie: laat een sterk model het denkwerk (planning, adversarieel nadenken) doen en delegeer de uitvoering naar goedkopere modellen. Vergelijk Dynamic Workflows.
De Fable Mode-skill (5 gates)
Extraheer Fable's werkdiscipline in een installeerbaar skill-bestand dat elk model kan draaien (Opus, Sonnet, zelfs GPT of open-source). De skill werkt via vijf gates:
- Scoping — plannen én devil's advocate spelen: wat kan er misgaan, welke onbekenden zitten er in het plan (niet alleen stappen aflopen).
- Evidence — bewijs vóór redenering.
- Attacking — adversarieel redeneren.
- Verifying — verifiëren vóór "klaar" verklaren.
- Reporting — calibreren en terugrapporteren.
Praktische extractiemethode: pak een deliverable van Fable die je goed vond maar niet kon verwoorden, en laat Fable/Opus die (en de sessie) analyseren — "wat deed je om hier te komen, hoe bewees je dat het werkte?" — en giet dat in een skill. Startprompt: "Write a complete installable skill file that makes Opus 4.8 operate with your judgment, planning, verification, and reasoning habits, and activate it on 'Fable mode'." Opus 4.8 mét Fable mode "voelt geëleveerd". Verwant aan de leaked-systeemprompt-inzichten (zie hieronder) en aan Skills en Plugins.
Inzichten uit de leaked Fable-systeemprompt
- Herkenning uit training ≠ actuele kennis → verifieer wat in het geheugen zit.
- Een prompt die impliceert dat een bestand bestaat, betekent niet dat het er is → check dat dingen echt bestaan.
- Beantwoord zelfs een ambigue query eerst, vraag pas daarna om verheldering (max één vraag).
- Bij fouten: erken wat misging, blijf bij het probleem, behoud zelfrespect.
Effort levels
Naast modelkeuze is er de vraag welk effort level bij de taak past. Uit de release-grafiek (score vs. kosten voor Fable 5, Opus 4.8, GPT 5.5): Fable 5 op low presteert vergelijkbaar met Opus 4.8 op high. Hoger effort is niet altijd beter — op "extra high/max" gaan modellen overdenken, second-guessen en langer/duurder produceren met een slechter resultaat. Richtlijn uit de systeemprompt: één voor losse feiten, drie tot vijf voor middelgrote taken, vijf tot tien voor diepere research/vergelijking. Vergelijk GPT vs Claude Modelvergelijking.
Model-routing-tabel
Geef Claude een tabel van de modellen in je toolkit met, per model, scores op assen zoals:
- Kosten (hoger cijfer = goedkoper)
- Intelligentie (begrip, code-review, redeneren)
- Taste (creativiteit, out-of-the-box, UI/UX-design)
- Optioneel eigen assen die bij je workflow passen; ook "delegate to Codex" of open-source modellen.
Een sterk model routeert dan naar kleinere waar dat kan. In een test met een Opus-orchestrator die naar Haiku-scouts delegeerde was het resultaat identiek maar ~3x goedkoper. Dit wordt cruciaal zodra teams/individuen met een AI-budget op unit-economics gaan sturen. Verwant aan Alternatieve Modellen in Claude Code.
Fable 5 als API-gefactureerd model: kosten per taak, niet per token
Sinds Fable 5 uit het vaste Claude-abonnement is gehaald en op API-tarief factureert ($10/miljoen input, $50/miljoen output), is de juiste vergelijkingseenheid kosten per afgeronde taak, niet kosten per token — want modellen verbruiken wildly verschillende hoeveelheden tokens voor hetzelfde resultaat. Gepubliceerde benchmarks over drie taaktypes:
| Taak | Sonnet(-klasse) | Fable 5 | Winnaar op kosten-per-uitkomst |
|---|---|---|---|
| Code review (200-regel PR) | ~$0,013 | ~$0,10 (8x) | Sonnet — Fable's diepere redenering was hier overkill |
| Next.js pricing-pagina (bouwen) | $0,25, maar 2 uur mensenwerk om te repareren | $4,18, direct shippable | Fable — tijd is duurder dan tokens |
| Multi-uur multi-agent CRUD-app | Opus 4.8: $5,40, ruwe randjes | Fable 5: $23,70 (450k output-tokens), met tests + docs, merge-ready | Fable — Sonnet verliest hier coherentie over lange sessies |
Vuistregel: gebruik Fable waar output niet token-zwaar is maar wel veel leverage geeft (planning, review), niet voor implementatie of web-scraping waar output-tokens torenhoog oplopen.
Drie gebruikspatronen voor Fable 5
- Plan op Fable, bouw op Sonnet — eigen
/model Fable→ plan schrijven → resultaat inplan.md→ terugschakelen naar Sonnet →execute the plan.md. (Claude Code heeft al een ingebouwdeOpus Plan-alias die dit automatiseert tussen Opus en Sonnet; voor Fable moet dit nog handmatig.) - Fable als reviewer — een eenvoudige sub-agent (
.claude/agents/code-reviewer.md) die specifiek Fable aanroept voor code-reviews, met instructie "return findings, don't write code" om dure output-tokens te vermijden. - Fable met een
/goalen verificatiecriteria — geef Fable een doel plus expliciete succes- én verificatiecriteria (bijv. boekhoudreconciliatie: "elke banktransactie gematcht of in unmatch.md met reden; totalen moeten kloppen") in plaats van een uitgeschreven stappenplan. Fable's zelfcheckende loop lost dan de ambiguïteiten zelf op — dat is precies waar het sterke redeneervermogen loont. Vermijd los kletsen/chatten met Fable (30 min heen-en-weer kost $2-3 vs. ~15 cent bij Sonnet).
Context- en kosteninstellingen die vóór elke Fable-sessie moeten staan
Eén enkel bericht ("Hi") kan al 30.000-40.000 tokens kosten door alles wat automatisch laadt (systeemprompt, CLAUDE.md, MCP-toolschema's, subagents, skills, geheugenbestanden) — met Fable-tarieven is dat 30-40 cent vóór er ook maar iets gebeurd is. Zeven instellingen die dit structureel indammen:
- Default-model op Sonnet i.p.v. Fable/Opus (teams die dit deden, halveerden hun kosten zonder kwaliteitsverlies op dagelijkse taken).
CLAUDE_CODE_SUBAGENT_MODELinsettings.json→envexpliciet op een goedkoop model (bijv. Haiku) zetten — anders erven sub-agents het dure parent-model (Fable), ook als ze alleen uitvoerend werk doen.- CLAUDE.md inkorten tot alleen wat Claude niet uit de codebase kan afleiden — één test toonde 92% contextreductie (3.847 → 312 tokens) zonder kwaliteitsverlies. HTML-comments (
<!-- -->) tellen niet mee als tokens en zijn bruikbaar voor teamnotities. .claudeignore+ deny-permissions insettings.jsontegen junk-reads (node_modules, dist, build, lockfiles) — gemeten 85,5% contextreductie alleen al door het ignore-bestand.- MCP-servers opschonen: elke verbonden server laadt zijn volledige toolschema bij sessiestart (10-20k tokens per server, ongeacht gebruik). Ontkoppel wat je twee weken niet hebt gebruikt;
enableToolSearch: truelaadt tool-definities pas on-demand. - Automemory uit (
/memory) als je al een eigen geheugensysteem draait — anders betaal je dubbel: een aparte achtergrondcall forkt de volledige context om memories te extraheren. - Maandelijks spend-limit instellen in de Claude.ai-usage-instellingen als harde ceiling tegen weglopende facturen.
Open vragen
- Hoe stabiel blijft de Fable Mode-skill als de onderliggende modellen (en hun default-efforts) veranderen?
- Bestaat er een objectieve manier om "taste" te scoren, of blijft die as per gebruiker subjectief?
- Komt er een officiële
Fable Plan-alias (vergelijkbaar metOpus Plan) nu Fable structureel duurder is dan Opus?
Verwante concepten
- Dynamic Workflows
- Alternatieve Modellen in Claude Code
- GPT vs Claude Modelvergelijking
- Claude Fable 5
- Skills en Plugins
- Subagents
Verwante concepten (aanvullend)
- Claude Code Pro-Tips — overlappende instellingen (auto mode, permissies) vanuit een andere invalshoek
Bronnen
- How I Make Opus Think Like Fable (5 easy steps) — Nate Herk | AI Automation, 07-07-2026
- Stop Using Fable 5 in Claude Code (It's Holding You Back) — Simon Scrapes, 12-07-2026