SLED Generating Benchmarks for Factuality Evaluation of Language Models Paper • 2307.06908 • Published Jul 13, 2023 • 8
Generating Benchmarks for Factuality Evaluation of Language Models Paper • 2307.06908 • Published Jul 13, 2023 • 8
text generation microsoft/biogpt Text Generation • Updated Feb 3, 2023 • 108k • 307 microsoft/MediPhi Text Generation • 4B • Updated Dec 15, 2025 • 1.01k • 24 google/medgemma-4b-it Image-Text-to-Text • 4B • Updated Oct 28, 2025 • 311k • 1.03k mistralai/Mistral-7B-v0.3 7B • Updated Jul 24, 2025 • 175k • 587
SLED Generating Benchmarks for Factuality Evaluation of Language Models Paper • 2307.06908 • Published Jul 13, 2023 • 8
Generating Benchmarks for Factuality Evaluation of Language Models Paper • 2307.06908 • Published Jul 13, 2023 • 8
text generation microsoft/biogpt Text Generation • Updated Feb 3, 2023 • 108k • 307 microsoft/MediPhi Text Generation • 4B • Updated Dec 15, 2025 • 1.01k • 24 google/medgemma-4b-it Image-Text-to-Text • 4B • Updated Oct 28, 2025 • 311k • 1.03k mistralai/Mistral-7B-v0.3 7B • Updated Jul 24, 2025 • 175k • 587