TY - RPRT TI - Large language models can learn and generalize steganographic chain-of-thought under process supervision AU - Joey Skaf AU - Luis Ibanez-Lissen AU - Robert McCarthy AU - Connor Watts AU - Vasil Georgiv AU - Hannes Whittingham AU - Lorena Gonzalez-Manzano AU - David Lindner AU - Cameron Tice AU - Edward James Young AU - Puria Radmard PY - 2025 UR - https://arxiv.org/abs/2506.01926 ID - 2506.01926 ER -