Pretrained checkpoints for OLMo 20M-150M models used in experiments for our paper "Sharpness-Aware Pretraining Mitigates Catastrophic Forgetting"
Ishaan Watts
WattsIshaan
AI & ML interests
Machine Learning, NLP
Recent Activity
updated a collection 3 days ago
OLMo Pretrained 20M-150M updated a collection 3 days ago
OLMo Pretrained 20M-150M updated a collection 3 days ago
OLMo Pretrained 20M-150MOrganizations
None yet