Reading List
updated
Reinforcement Pre-Training
Paper
• 2506.08007
• Published • 265
A Survey on Latent Reasoning
Paper
• 2507.06203
• Published • 95
Language Models are Few-Shot Learners
Paper
• 2005.14165
• Published • 20
Exploring the Limits of Transfer Learning with a Unified Text-to-Text
Transformer
Paper
• 1910.10683
• Published • 20
Training language models to follow instructions with human feedback
Paper
• 2203.02155
• Published • 25
LLaMA: Open and Efficient Foundation Language Models
Paper
• 2302.13971
• Published • 25
Paper
• 2310.06825
• Published • 61
Gemma 2: Improving Open Language Models at a Practical Size
Paper
• 2408.00118
• Published • 80
SmolLM2: When Smol Goes Big -- Data-Centric Training of a Small Language Model
Paper
• 2502.02737
• Published • 261
Paper
• 2504.07491
• Published • 143
Hierarchical Reasoning Model
Paper
• 2506.21734
• Published • 54
DeepSeek-V3 Technical Report
Paper
• 2412.19437
• Published • 88