peng
superpeng
·
AI & ML interests
None yet
Organizations
None yet
LLM Pretrain
-
How to Train Data-Efficient LLMs
Paper • 2402.09668 • Published • 42 -
Adapting Large Language Models via Reading Comprehension
Paper • 2309.09530 • Published • 82 -
GaLore: Memory-Efficient LLM Training by Gradient Low-Rank Projection
Paper • 2403.03507 • Published • 192 -
MathScale: Scaling Instruction Tuning for Mathematical Reasoning
Paper • 2403.02884 • Published • 16
reward
LLM Pretrain
-
How to Train Data-Efficient LLMs
Paper • 2402.09668 • Published • 42 -
Adapting Large Language Models via Reading Comprehension
Paper • 2309.09530 • Published • 82 -
GaLore: Memory-Efficient LLM Training by Gradient Low-Rank Projection
Paper • 2403.03507 • Published • 192 -
MathScale: Scaling Instruction Tuning for Mathematical Reasoning
Paper • 2403.02884 • Published • 16
models 0
None public yet
datasets 0
None public yet