Final scaled models from "Reasoning Through Chess: How Reasoning Evolves from Data Through Fine-Tuning and Reinforcement Learning".
Lucas Dionisopoulos
lucasdino
AI & ML interests
None yet
Organizations
None yet
models 8
lucasdino/Qwen2.5-7B-Chess-FactualBoardAnswering-SmallTrain-SFT
8B • Updated • 3
lucasdino/Qwen2.5-7B-Chess-FactualBoardAnswering-SmallTrain-RL
8B • Updated • 7
lucasdino/Qwen2.5-7B-Chess-BestMoveBestLine-RL
8B • Updated • 5 • 1
lucasdino/Qwen2.5-7B-Chess-BestMove-RL
8B • Updated • 69 • 1
lucasdino/Qwen2.5-7B-Chess-BestLine-RL
8B • Updated • 13 • 1
lucasdino/Qwen2.5-7B-Chess-BestMoveBestLine-SFT
8B • Updated • 7 • 1
lucasdino/Qwen2.5-7B-Chess-BestMove-SFT
8B • Updated • 5 • 1
lucasdino/Qwen2.5-7B-Chess-BestLine-SFT
8B • Updated • 85 • 1