Test-Time Scaling in Reasoning LLMs: Inference Regimes, Evaluation, and ReproducibilityPublished in arXiv preprint, 2026Share on Bluesky Facebook LinkedIn X (formerly Twitter) Previous Next