Hugging Face's logo Hugging Face
  • Models
  • Datasets
  • Spaces
  • Buckets new
  • Docs
  • Enterprise
  • Pricing
    • Website
      • Tasks
      • HuggingChat
      • Collections
      • Languages
      • Organizations
    • Community
      • Blog
      • Posts
      • Daily Papers
      • Hardware
      • Learn
      • Discord
      • Forum
      • GitHub
    • Solutions
      • Team & Enterprise
      • Hugging Face PRO
      • Enterprise Support
      • Inference Providers
      • Inference Endpoints
      • Storage Buckets

  • Log In
  • Sign Up

RL-Forgetting-Experiments-3
/
code-q25_3b-nobuf

Reinforcement Learning
Safetensors
grpo
code-generation
mbpp
catastrophic-forgetting
Model card Files Files and versions
xet
Community
code-q25_3b-nobuf
68.1 GB
Ctrl+K
Ctrl+K
  • 2 contributors
History: 13 commits
smilani's picture
smilani
Add MBPP+ training-set eval pass@k summaries (10 checkpoints)
5421df2 verified 2 days ago
  • global_step_120
    Add MBPP+ training-set eval pass@k summaries (10 checkpoints) 2 days ago
  • global_step_150
    Add MBPP+ training-set eval pass@k summaries (10 checkpoints) 2 days ago
  • global_step_180
    Add MBPP+ training-set eval pass@k summaries (10 checkpoints) 2 days ago
  • global_step_210
    Add MBPP+ training-set eval pass@k summaries (10 checkpoints) 2 days ago
  • global_step_240
    Add MBPP+ training-set eval pass@k summaries (10 checkpoints) 2 days ago
  • global_step_270
    Add MBPP+ training-set eval pass@k summaries (10 checkpoints) 2 days ago
  • global_step_30
    Add MBPP+ training-set eval pass@k summaries (10 checkpoints) 2 days ago
  • global_step_300
    Add MBPP+ training-set eval pass@k summaries (10 checkpoints) 2 days ago
  • global_step_60
    Add MBPP+ training-set eval pass@k summaries (10 checkpoints) 2 days ago
  • global_step_90
    Add MBPP+ training-set eval pass@k summaries (10 checkpoints) 2 days ago
  • .gitattributes
    2.19 kB
    qwen3b_mbpp_nobuf global_step_300 6 days ago
  • README.md
    1.54 kB
    model card 6 days ago