Nous n’avons en réalité pas beaucoup progressé dans l’explication du grand mystère des LLM : Comment un modèle qui utilise simplement des multiplications de matrices pour prédire le mot suivant parvient-il à simuler la pensée humaine au point de reproduire autant de
The Unsolved Mystery of How LLMs Simulate Human Thought
By
–