A Global Workspace in Language Models
Anthropic · 2026
Anthropic finds an internal 'J-space' inside Claude that behaves like a global workspace, and argues it's a promising surface for monitoring deliberate reasoning.
mech-interpinterpretabilitymonitoringcognition