Textbooks Are All You Need paper page: https://
huggingface.co/papers/2306.11
644
… introduce phi-1, a new large language model for code, with significantly smaller size than competing models: phi-1 is a Transformer-based model with 1.3B parameters, trained for 4 days on 8 A100s, using a selection
Phi-1: Efficient 1.3B Parameter Language Model for Code
By
–
