Salesforce/LLaMA-3-8B-SFR-Iterative-DPO-R
Text Generation • 8B • Updated • 100 • • 78
None defined yet.
Just-in-Time Memory: Learning to Curate Task-Adaptive Memory for LLM Agents
Flattening Every Memory Peak in Long-Context Mixture-of-Experts Training