AI Dynamics

Global AI News Aggregator

About

Sparse Autoencoders Scale Training Improves GPT-4 Interpretability

Improved methods for training sparse autoencoders at scale. Shows promise towards interpreting GPT-4's neural activity:

→ View original post on X — @gdb