AI Dynamics

Global AI News Aggregator

About

Pretraining Datasets and Evaluation Metrics for Multilingual Models

Yes, definitely, my last tweet few seconds ago is also on this point. And many pretraining datasets also care about e.g. multilignual, code, math, etc., so it's not clear how those evals would be affected.

→ View original post on X — @karpathy