AutoGraph-R1 Collection Directly Optimizing Knowledge Graph Construction for RAG using Reinforcement Learning • 15 items • Updated about 4 hours ago • 2
gzone0111/AutoGraphR1-musique_hotpotqa_train-qwen2.5-7b-graph-retriever-grpo-judge-3b 8B • Updated about 10 hours ago • 7
gzone0111/AutoGraphR1-musique_hotpotqa_train-qwen2.5-7b-graph-retriever-grpo-judge-1.5b 8B • Updated about 13 hours ago • 5
gzone0111/AutoGraphR1-musique_hotpotqa_train-llama3.2-3b-text-retriever-grpo-repetition-penalty 4B • Updated 1 day ago • 11
gzone0111/AutoGraphR1-musique_hotpotqa_train-llama3.2-3b-graph-retriever-grpo-repetition-penalty 4B • Updated 1 day ago • 12
gzone0111/AutoGraphR1-musique_hotpotqa_train-llama3.2-1b-text-retriever-grpo-repetition-penalty 1B • Updated 1 day ago • 14
gzone0111/AutoGraphR1-musique_hotpotqa_train-llama3.2-1b-graph-retriever-grpo-repetition-penalty 1B • Updated 1 day ago • 15
gzone0111/AutoGraphR1-musique_hotpotqa_train-qwen2.5-7b-text-retriever-grpo 8B • Updated 1 day ago • 12
gzone0111/AutoGraphR1-musique_hotpotqa_train-qwen2.5-7b-graph-retriever-grpo 8B • Updated 1 day ago • 14
gzone0111/AutoGraphR1-musique_hotpotqa_train-qwen2.5-3b-text-retriever-grpo 3B • Updated 1 day ago • 16
gzone0111/AutoGraphR1-musique_hotpotqa_train-qwen2.5-3b-graph-retriever-grpo 3B • Updated 1 day ago • 13