Zelfde prompt, een take, live gedeployed. Het rubricsysteem moet voorkomen dat een mooi plaatje wint van werkbare output.
De kostenkant is het scherpste resultaat. Fable slokt meer tokens en tijd; Codex is goedkoper ondanks minder output-tokens. Grok zit in hetzelfde veld, met een terzijde over xAI dat maandelijks miljarden verbrandt.