Marktmannen wiki Claude Cowork en Kenniswerk

Fable Mode en Model Routing

Laatst bijgewerkt: 17-07-2026

TL;DR: Het model is niet de slotgracht — het proces wél; extraheer Fable's werkwijze in een herbruikbare "Fable mode"-skill en combineer die met een expliciete model-routing-tabel zodat goedkopere modellen het werk doen dat ze aankunnen.

De kernstelling: je kunt de intelligentie van een topmodel als Fable 5 niet vasthouden (het gaat terug achter een subscription), maar je kunt wél zijn proces vastleggen. Een beginner met Fable 5 verliest van een expert met een zwakker model, omdat de instructies, systemen en loops rond het model belangrijker zijn dan het model zelf. Behandel een sterk model daarom als een leraar (of senior engineer die z'n kennis overdraagt aan junioren), niet als een workhorse.

Het model is niet de slotgracht

Nate Herk testte dynamic workflows waarin Fable de orchestrator was met sub-agents op respectievelijk Fable, Opus en Sonnet. De resultaten waren ongeveer gelijk, terwijl de Fable-workers exponentieel duurder waren. Conclusie: laat een sterk model het denkwerk (planning, adversarieel nadenken) doen en delegeer de uitvoering naar goedkopere modellen. Vergelijk Dynamic Workflows.

De Fable Mode-skill (5 gates)

Extraheer Fable's werkdiscipline in een installeerbaar skill-bestand dat elk model kan draaien (Opus, Sonnet, zelfs GPT of open-source). De skill werkt via vijf gates:

  1. Scoping — plannen én devil's advocate spelen: wat kan er misgaan, welke onbekenden zitten er in het plan (niet alleen stappen aflopen).
  2. Evidence — bewijs vóór redenering.
  3. Attacking — adversarieel redeneren.
  4. Verifying — verifiëren vóór "klaar" verklaren.
  5. Reporting — calibreren en terugrapporteren.

Praktische extractiemethode: pak een deliverable van Fable die je goed vond maar niet kon verwoorden, en laat Fable/Opus die (en de sessie) analyseren — "wat deed je om hier te komen, hoe bewees je dat het werkte?" — en giet dat in een skill. Startprompt: "Write a complete installable skill file that makes Opus 4.8 operate with your judgment, planning, verification, and reasoning habits, and activate it on 'Fable mode'." Opus 4.8 mét Fable mode "voelt geëleveerd". Verwant aan de leaked-systeemprompt-inzichten (zie hieronder) en aan Skills en Plugins.

Inzichten uit de leaked Fable-systeemprompt

  • Herkenning uit training ≠ actuele kennis → verifieer wat in het geheugen zit.
  • Een prompt die impliceert dat een bestand bestaat, betekent niet dat het er is → check dat dingen echt bestaan.
  • Beantwoord zelfs een ambigue query eerst, vraag pas daarna om verheldering (max één vraag).
  • Bij fouten: erken wat misging, blijf bij het probleem, behoud zelfrespect.

Effort levels

Naast modelkeuze is er de vraag welk effort level bij de taak past. Uit de release-grafiek (score vs. kosten voor Fable 5, Opus 4.8, GPT 5.5): Fable 5 op low presteert vergelijkbaar met Opus 4.8 op high. Hoger effort is niet altijd beter — op "extra high/max" gaan modellen overdenken, second-guessen en langer/duurder produceren met een slechter resultaat. Richtlijn uit de systeemprompt: één voor losse feiten, drie tot vijf voor middelgrote taken, vijf tot tien voor diepere research/vergelijking. Vergelijk GPT vs Claude Modelvergelijking.

Model-routing-tabel

Geef Claude een tabel van de modellen in je toolkit met, per model, scores op assen zoals:

  • Kosten (hoger cijfer = goedkoper)
  • Intelligentie (begrip, code-review, redeneren)
  • Taste (creativiteit, out-of-the-box, UI/UX-design)
  • Optioneel eigen assen die bij je workflow passen; ook "delegate to Codex" of open-source modellen.

Een sterk model routeert dan naar kleinere waar dat kan. In een test met een Opus-orchestrator die naar Haiku-scouts delegeerde was het resultaat identiek maar ~3x goedkoper. Dit wordt cruciaal zodra teams/individuen met een AI-budget op unit-economics gaan sturen. Verwant aan Alternatieve Modellen in Claude Code.

Fable 5 als API-gefactureerd model: kosten per taak, niet per token

Sinds Fable 5 uit het vaste Claude-abonnement is gehaald en op API-tarief factureert ($10/miljoen input, $50/miljoen output), is de juiste vergelijkingseenheid kosten per afgeronde taak, niet kosten per token — want modellen verbruiken wildly verschillende hoeveelheden tokens voor hetzelfde resultaat. Gepubliceerde benchmarks over drie taaktypes:

Taak Sonnet(-klasse) Fable 5 Winnaar op kosten-per-uitkomst
Code review (200-regel PR) ~$0,013 ~$0,10 (8x) Sonnet — Fable's diepere redenering was hier overkill
Next.js pricing-pagina (bouwen) $0,25, maar 2 uur mensenwerk om te repareren $4,18, direct shippable Fable — tijd is duurder dan tokens
Multi-uur multi-agent CRUD-app Opus 4.8: $5,40, ruwe randjes Fable 5: $23,70 (450k output-tokens), met tests + docs, merge-ready Fable — Sonnet verliest hier coherentie over lange sessies

Vuistregel: gebruik Fable waar output niet token-zwaar is maar wel veel leverage geeft (planning, review), niet voor implementatie of web-scraping waar output-tokens torenhoog oplopen.

Drie gebruikspatronen voor Fable 5

  1. Plan op Fable, bouw op Sonnet — eigen /model Fable → plan schrijven → resultaat in plan.md → terugschakelen naar Sonnet → execute the plan.md. (Claude Code heeft al een ingebouwde Opus Plan-alias die dit automatiseert tussen Opus en Sonnet; voor Fable moet dit nog handmatig.)
  2. Fable als reviewer — een eenvoudige sub-agent (.claude/agents/code-reviewer.md) die specifiek Fable aanroept voor code-reviews, met instructie "return findings, don't write code" om dure output-tokens te vermijden.
  3. Fable met een /goal en verificatiecriteria — geef Fable een doel plus expliciete succes- én verificatiecriteria (bijv. boekhoudreconciliatie: "elke banktransactie gematcht of in unmatch.md met reden; totalen moeten kloppen") in plaats van een uitgeschreven stappenplan. Fable's zelfcheckende loop lost dan de ambiguïteiten zelf op — dat is precies waar het sterke redeneervermogen loont. Vermijd los kletsen/chatten met Fable (30 min heen-en-weer kost $2-3 vs. ~15 cent bij Sonnet).

Context- en kosteninstellingen die vóór elke Fable-sessie moeten staan

Eén enkel bericht ("Hi") kan al 30.000-40.000 tokens kosten door alles wat automatisch laadt (systeemprompt, CLAUDE.md, MCP-toolschema's, subagents, skills, geheugenbestanden) — met Fable-tarieven is dat 30-40 cent vóór er ook maar iets gebeurd is. Zeven instellingen die dit structureel indammen:

  • Default-model op Sonnet i.p.v. Fable/Opus (teams die dit deden, halveerden hun kosten zonder kwaliteitsverlies op dagelijkse taken).
  • CLAUDE_CODE_SUBAGENT_MODEL in settings.jsonenv expliciet op een goedkoop model (bijv. Haiku) zetten — anders erven sub-agents het dure parent-model (Fable), ook als ze alleen uitvoerend werk doen.
  • CLAUDE.md inkorten tot alleen wat Claude niet uit de codebase kan afleiden — één test toonde 92% contextreductie (3.847 → 312 tokens) zonder kwaliteitsverlies. HTML-comments (<!-- -->) tellen niet mee als tokens en zijn bruikbaar voor teamnotities.
  • .claudeignore + deny-permissions in settings.json tegen junk-reads (node_modules, dist, build, lockfiles) — gemeten 85,5% contextreductie alleen al door het ignore-bestand.
  • MCP-servers opschonen: elke verbonden server laadt zijn volledige toolschema bij sessiestart (10-20k tokens per server, ongeacht gebruik). Ontkoppel wat je twee weken niet hebt gebruikt; enableToolSearch: true laadt tool-definities pas on-demand.
  • Automemory uit (/memory) als je al een eigen geheugensysteem draait — anders betaal je dubbel: een aparte achtergrondcall forkt de volledige context om memories te extraheren.
  • Maandelijks spend-limit instellen in de Claude.ai-usage-instellingen als harde ceiling tegen weglopende facturen.

Open vragen

  • Hoe stabiel blijft de Fable Mode-skill als de onderliggende modellen (en hun default-efforts) veranderen?
  • Bestaat er een objectieve manier om "taste" te scoren, of blijft die as per gebruiker subjectief?
  • Komt er een officiële Fable Plan-alias (vergelijkbaar met Opus Plan) nu Fable structureel duurder is dan Opus?

Verwante concepten

Verwante concepten (aanvullend)

  • Claude Code Pro-Tips — overlappende instellingen (auto mode, permissies) vanuit een andere invalshoek

Bronnen