Hierarchical summarization complements our recent work on anti-jailbreak classifiers, as well as Clio, our privacy-preserving system for exploring AI use. Together, these help us identify and mitigate novel forms of misuse so we can safely research more capable models.
Hierarchical Summarization Enhances AI Safety Research Capabilities
By
–