datasets_for_fine_tuning_llm iamtarun/python_code_instructions_18k_alpaca Viewer • Updated Jul 27, 2023 • 18.6k • 17.1k • 347 HuggingFaceTB/smollm-corpus Viewer • Updated Sep 6, 2024 • 237M • 50.8k • 477 databricks/databricks-dolly-15k Viewer • Updated Jun 30, 2023 • 15k • 43.1k • 1.01k ise-uiuc/Magicoder-Evol-Instruct-110K Viewer • Updated Dec 28, 2023 • 111k • 15.2k • 185
inference_provided_llm_only medicalai/ClinicalBERT Fill-Mask • Updated Apr 14, 2025 • 10.6k • • 377 google/embeddinggemma-300m Sentence Similarity • 0.3B • Updated Sep 25, 2025 • 1.71M • • 1.81k BAAI/bge-small-en-v1.5 Feature Extraction • 33.4M • Updated Feb 22, 2024 • 68.1M • • 518 redis/langcache-embed-v1 Sentence Similarity • 0.1B • Updated Dec 8, 2025 • 96.6k • • 15
datasets_for_fine_tuning_llm iamtarun/python_code_instructions_18k_alpaca Viewer • Updated Jul 27, 2023 • 18.6k • 17.1k • 347 HuggingFaceTB/smollm-corpus Viewer • Updated Sep 6, 2024 • 237M • 50.8k • 477 databricks/databricks-dolly-15k Viewer • Updated Jun 30, 2023 • 15k • 43.1k • 1.01k ise-uiuc/Magicoder-Evol-Instruct-110K Viewer • Updated Dec 28, 2023 • 111k • 15.2k • 185
inference_provided_llm_only medicalai/ClinicalBERT Fill-Mask • Updated Apr 14, 2025 • 10.6k • • 377 google/embeddinggemma-300m Sentence Similarity • 0.3B • Updated Sep 25, 2025 • 1.71M • • 1.81k BAAI/bge-small-en-v1.5 Feature Extraction • 33.4M • Updated Feb 22, 2024 • 68.1M • • 518 redis/langcache-embed-v1 Sentence Similarity • 0.1B • Updated Dec 8, 2025 • 96.6k • • 15