Explore
Stack
Learn
Search the catalog
⌘K
$
/
₹
Sign up free
Login
Back to papers
September 3, 2026
cs.CL
cs.AI
Representational alignment yields generalizable safety in language models
Lingyu Li
,
Yan Teng
,
Yingchun Wang
,
Xia Hu
Original Abstract
Read on arXiv
Download PDF
Categories
cs.CL, cs.AI
Representational alignment yields | One9Founders