Sample-Efficient Self-Supervised Chain-of-Thought Learning for Enhancing LLM Reasoning at Test-Time

F. Moradi Kalarde*, A. Toroghi*, and S. Sanner. "Sample-Efficient Self-Supervised Chain-of-Thought Learning for Enhancing LLM Reasoning at Test-Time." Under review, 2026.