Mobius Separates Knowledge From Reasoning for Faster Inference
A shared feed-forward memory and iterative attention reasoners retain comparable downstream scores while reducing continual-pretrained 35B-model inference time by nearly 4×.
Aug 25, 20264 min2608.14290