Language Models as Reflexively Autocatalytic Constraint Systems
Why can models with similar validation loss display very different capabilities? This paper introduces behavioural and mechanistic closure measures, a training objective for internal constraint states, and a reproducible experimental programme for testing robust capability emergence.
Closure-sensitive measures should predict robust capability onset beyond scale, compute, loss, and unperturbed accuracy.