OLMo-2-1B Midtrained Collection Sharpness-Aware Pretraining Mitigates Catastrophic Forgetting Ishaan Watts*, Catherine Li*, Sachin Goyal, Jacob Mitchell Springer, Aditi Raghunathan • 3 items • Updated 8 days ago
OLMo-2-1B Midtrained Collection Sharpness-Aware Pretraining Mitigates Catastrophic Forgetting Ishaan Watts*, Catherine Li*, Sachin Goyal, Jacob Mitchell Springer, Aditi Raghunathan • 3 items • Updated 8 days ago
OLMo-2-1B Midtrained Collection Sharpness-Aware Pretraining Mitigates Catastrophic Forgetting Ishaan Watts*, Catherine Li*, Sachin Goyal, Jacob Mitchell Springer, Aditi Raghunathan • 3 items • Updated 8 days ago
MEGAVERSE: Benchmarking Large Language Models Across Languages, Modalities, Models and Tasks Paper • 2311.07463 • Published Nov 13, 2023 • 14