NEST: Nascent Encoded Steganographic Thoughts
By Artem Karpov
Systematically evaluates steganographic chain-of-thought capabilities across 28 LLMs, testing whether models can hide secret reasoning within innocuous text. Finds current models cannot yet sustain hidden reasoning reliably, providing important baselines for AI safety monitoring.