These attacks scale with frontier model capabilities. Across both OpenAI and Anthropic model families, training on data from newer frontier models produces more capable—and more dangerous—open-source models.
Frontier Model Training Enables More Capable Dangerous Open-Source AI
By
–
