Back to papers
October 7, 2026cs.AIcs.CL
Reasoning-Token Spikes Under Prompted Untruthful Responding in Large Language Models
Maverick Morales, Tomáš Dominik, Vermut Gao, Katrina Shirey, Paulius Rimkevičius, Aaron Schurger, Uri Maoz
Categories
cs.AI, cs.CL