AnonymousSubmissionUnderDouble-BlindRevi/seta-env-rl Reinforcement Learning • 8B • Updated May 7 • 14
AnonymousSubmissionUnderDouble-BlindRevi/seta-sft-kimi-qwen3 Text Generation • 8B • Updated May 7 • 12
LLM-OS-Models/gemma-4-26B-A4B-it-Terminal-SFT-Native-Liquid-1Epoch Text Generation • 6B • Updated May 10 • 11
LLM-OS-Models/gemma-4-26B-A4B-Terminal-SFT-Native-Liquid-1Epoch Text Generation • 6B • Updated May 10 • 3
LLM-OS-Models/KoHRM-Text-1.4B-FullSFT-Top2-Terminal-Tool-Merge-Epoch1 Text Generation • 1B • Updated Jun 5 • 17
LLM-OS-Models/KoHRM-Text-1.4B-FullSFT-LFM25-Terminal-ToolBench-Epoch2 Text Generation • 1B • Updated Jun 6 • 5 • 1
LLM-OS-Models/KoHRM-Text-1.4B-FullSFT-LFM25-Terminal-ToolBench-Epoch3 Text Generation • 1B • Updated Jun 6 • 10
lew96123/qwen3.5-0.8b-terminal-agent-grpo-rl-checkpoint-100 Text Generation • Updated Jun 14 • 13 • 1