Effort: de knop die bepaalt hoe hard Claude nadenkt
AI / GenAI·4 min·2 juli 2026

Effort: de knop die bepaalt hoe hard Claude nadenkt

Laatst liet ik een stel subagents door een berg screenshots lopen om er simpelweg “bevat dit een foutmelding, ja of nee” uit te trekken. Elke keer kreeg ik een net antwoord terug, met redenering, nuance en een korte samenvatting erbij. Aardig bedoeld, maar voor een ja-of-nee-vraag betaal je dan voor denkwerk dat niemand vroeg.

Anthropic gaf de Claude API daar nu een directe knop voor: effort. Geen apart model, geen aparte prompt-truc. Eén parameter die bepaalt hoe eager Claude is om tokens te besteden aan een antwoord.

Wat het doet

Effort stuurt hoe grondig het model nadenkt, los van welke vraag je stelt. Dezelfde prompt naar hetzelfde model levert bij een lage instelling een kort, direct antwoord op, en bij een hoge instelling een uitgebreidere, grondiger doordachte reactie. Je wisselt dus tussen snelheid en kosten enerzijds en diepgang anderzijds, zonder van model te wisselen.

De parameter werkt op alle huidige Claude-modellen, zonder beta-header. Bij Opus 4.6 en Sonnet 4.6 vervangt hij het oude budget_tokens-mechanisme als aanbevolen manier om de denkdiepte te sturen.

Belangrijk detail: effort is een gedragssignaal, geen harde tokenlimiet. Ook op het laagste niveau denkt het model gewoon door als een probleem dat vereist. Het denkt alleen minder ver door dan het op een hoger niveau zou doen bij datzelfde probleem.

De niveaus

Er zijn vijf standen, van zuinig naar onbeperkt:

NiveauVoorEffect
lowSimpele classificatie, snelle lookups, subagentsMeest zuinig, kortere antwoorden
mediumTaken die balans vragen tussen snelheid en kwaliteitGematigde besparing
highComplex redeneren, lastige code, de meeste agentische takenStandaard, gelijk aan geen parameter meezenden
xhighZware coderklussen, lang zoekwerk, taken die tientallen minuten lopenDuidelijk hoger tokenverbruik dan high
maxGrens verleggen op een écht moeilijk probleemGeen enkele beperking op tokengebruik

Claude Sonnet 5 staat standaard op high. Voor de meeste dagelijkse taken is dat prima. Voor de zwaarste coderklussen is xhigh het vertrekpunt, niet max: dat laatste is bedoeld voor echt grensverleggende problemen en levert op de meeste taken weinig extra kwaliteit voor een fors hogere rekening.

Hoe je het instuurt

In de API-call zet je effort simpelweg als extra veld:

{
  "model": "claude-sonnet-5",
  "effort": "low",
  "messages": [...]
}

Geen aparte configuratie, geen ander model laden. Dezelfde aanroep, ander gedrag.

Waarom dit voor mij uitmaakt

Dit is precies het knopje dat ontbrak in mijn eigen opzet. Subagents die classificatiewerk doen zet ik nu op low, de hoofdsessie blijft op high staan voor het echte denkwerk. Claude Code’s ultracode-modus gebruikt overigens xhigh in combinatie met toestemming om meerdere agents tegelijk te draaien, geen apart niveau daarboven.

Het scheelt niet in wat het model kán. Het scheelt in wat je betaalt voor werk dat die diepgang niet nodig had. En dat is precies het soort verbetering dat je niet in een demo ziet, maar wel terug op je rekening.

Wil je weten hoe ik dit soort knoppen inzet in mijn eigen werk? Lees mee op sparkone.nl of mail me op jeroen@sparkone.nl.