·
AI & ML interests
MLLMs, LLMs
Organizations
shuoxing/llama3-8b-full-sft-mix-mid-tweet-1m-en-no-packing-sft-epoch-2
Text Generation
• 266k • Updated • 14
shuoxing/llama3-8b-full-sft-mix-high-tweet-1m-en-no-packing-sft-epoch-1
Text Generation
• 266k • Updated • 14
shuoxing/llama3-8b-full-sft-mix-low-tweet-1m-en-no-packing-sft-epoch-2
Text Generation
• 266k • Updated • 15
shuoxing/llama3-8b-full-sft-mix-mid-tweet-1m-en-no-packing-sft-epoch-1
Text Generation
• 266k • Updated • 14
shuoxing/llama3-8b-full-sft-control-tweet-1m-en-no-packing-sft-epoch-2
Text Generation
• 266k • Updated • 10
shuoxing/llama3-8b-full-sft-mix-low-tweet-1m-en-no-packing-sft-epoch-1
Text Generation
• 266k • Updated • 11
shuoxing/llama3-8b-full-sft-junk-tweet-1m-en-no-packing-sft-epoch-2
Text Generation
• 266k • Updated • 16
shuoxing/llama3-8b-full-sft-control-tweet-1m-en-no-packing-sft-epoch-1
Text Generation
• 266k • Updated • 13
shuoxing/llama3-8b-full-sft-junk-tweet-1m-en-no-packing-sft-epoch-1
Text Generation
• 266k • Updated • 13
shuoxing/llama3-8b-full-pretrain-mix-high-tweet-1m-en-gpt-no-packing
Text Generation
• 266k • Updated • 19
shuoxing/llama3-8b-full-pretrain-mix-high-tweet-1m-en-gpt-no-packing-epoch-3
266k • Updated • 6
shuoxing/llama3-8b-full-pretrain-mix-high-tweet-1m-en-gpt-no-packing-epoch-2
266k • Updated • 4
shuoxing/llama3-8b-full-pretrain-mix-high-tweet-1m-en-gpt-no-packing-epoch-1
266k • Updated • 6
shuoxing/llama3-8b-full-pretrain-mix-mid-tweet-1m-en-gpt-no-packing-epoch-3
266k • Updated • 6
shuoxing/llama3-8b-full-pretrain-mix-mid-tweet-1m-en-gpt-no-packing
Text Generation
• 266k • Updated • 19
shuoxing/llama3-8b-full-pretrain-mix-mid-tweet-1m-en-gpt-no-packing-epoch-2
266k • Updated • 6
shuoxing/llama3-8b-full-pretrain-mix-mid-tweet-1m-en-gpt-no-packing-epoch-1
266k • Updated • 6
shuoxing/llama3-8b-full-pretrain-mix-low-tweet-1m-en-gpt-no-packing-epoch-3
266k • Updated • 6
shuoxing/llama3-8b-full-pretrain-mix-low-tweet-1m-en-gpt-no-packing
Text Generation
• 266k • Updated • 18
shuoxing/llama3-8b-full-pretrain-mix-low-tweet-1m-en-gpt-no-packing-epoch-2
266k • Updated • 6
shuoxing/llama3-8b-full-pretrain-mix-low-tweet-1m-en-gpt-no-packing-epoch-1
266k • Updated • 6
shuoxing/llama3-8b-full-pretrain-junk-tweet-1m-en-gpt-no-packing-epoch-3
266k • Updated • 6
shuoxing/llama3-8b-full-pretrain-junk-tweet-1m-en-gpt-no-packing-epoch-2
266k • Updated • 6
shuoxing/llama3-8b-full-pretrain-junk-tweet-1m-en-gpt-no-packing-epoch-1
266k • Updated • 6
shuoxing/llama3-8b-full-pretrain-control-tweet-1m-en-gpt-no-packing-epoch-3
266k • Updated • 6
shuoxing/llama3-8b-full-pretrain-control-tweet-1m-en-gpt-no-packing-epoch-2
266k • Updated • 6
shuoxing/llama3-8b-full-pretrain-control-tweet-1m-en-gpt-no-packing-epoch-1
266k • Updated • 8
shuoxing/llama3-8b-full-pretrain-control-tweet-1m-en-gpt-no-packing
Text Generation
• 266k • Updated • 20
shuoxing/llama3-8b-full-pretrain-junk-tweet-1m-en-gpt-no-packing
Text Generation
• 266k • Updated • 20
shuoxing/llama3-8b-full-pretrain-mix-mid-tweet-1m-en-packing-epoch-3
266k • Updated • 7