π LLM pretraining datasets Collection A collection of datasets for LLM pretraining β’ 9 items β’ Updated May 5, 2025 β’ 32
π€ Fine-zhtw Collection Fine-zhtw is a Traditional Chinese (zh-TW) collection inspired by Hugging Faceβs Fine series, built with mostly self-designed methods. β’ 6 items β’ Updated May 6 β’ 2
π T1 Series Collection Instruction-tuned Gemma-3 models optimized for agentic workflows in Traditional Chinese. β’ 6 items β’ Updated Jul 22 β’ 4
Vision Language Models Papers πΌοΈπ¬π Collection Papers about vision-language models, most important ones are on top of the list. β’ 27 items β’ Updated Apr 30, 2024 β’ 40
view article Article Efficient Deep Learning: A Comprehensive Overview of Optimization Techniques π π Isayoften β’ Aug 26, 2024 β’ 95
π§ Traditional Chinese Reasoning Datasets Collection A curated collection of datasets designed to evaluate and train reasoning capabilities in Traditional Chinese across various domains. β’ 3 items β’ Updated May 6 β’ 9
π Eval Logs Collection Benchmark log generated with Twinkle Eval, recording the model's outputs for each prompt. β’ 3 items β’ Updated May 6 β’ 4
Balancing Continuous Pre-Training and Instruction Fine-Tuning: Optimizing Instruction-Following in LLMs Paper β’ 2410.10739 β’ Published Oct 14, 2024 β’ 4
MobileLLM Collection Optimizing Sub-billion Parameter Language Models for On-Device Use Cases (ICML 2024) https://arxiv.org/abs/2402.14905 β’ 49 items β’ Updated Mar 2 β’ 139
Taiwan-Legal-Bench Collection This repository offers a dataset for evaluating legal models based on Taiwanβs laws, including legal questions, provisions, and case law. β’ 1 item β’ Updated Apr 11 β’ 1
βοΈ Llama-3.2-Taiwan-Legal Collection Based on the lianghsun/Llama-3.2-Taiwan-*B model, the fine-tuning was conducted using datasets related to the laws and judgments of Taiwan. β’ 2 items β’ Updated Mar 2 β’ 1