Writing
Essays on AI safety, timelines and verification.
- 21 September 2026 The Late Dealignment
Perfectly aligning our current models is insufficient for future alignment. Far future models, by slow drift or emergence, could end up not caring about humans.