Kyle Ng
kylelovesllms
AI & ML interests
None yet
Recent Activity
updated a collection 10 days ago
translation-syntax-datasets-03_grammar_v3 updated a dataset 10 days ago
kylelovesllms/grammar-v3-frames-rb published a dataset 10 days ago
kylelovesllms/grammar-v3-frames-rbOrganizations
translation-syntax-datasets-01_grammar_v1
Translated Alpaca Instruction Tuning
Based off of `tatsu-lab/alpaca` and `yahma/alpaca-cleaned` and translated datasets
Cross-Linguistic CAPS LoRA Fine Tuned Qwen Models
Qwen Models fine tuned using LoRA Adapters on Alpaca dataset in English, German, and Russian to test cross-linguistic generalization of fine tuning
-
kylelovesllms/Qwen2.5-0.5B-Instruct-caps-en-lora
Text Generation • Updated • 20 -
kylelovesllms/Qwen2.5-0.5B-Instruct-caps-ru-lora-merged
0.5B • Updated • 9 -
kylelovesllms/Qwen2.5-0.5B-Instruct-caps-en-lora-merged
Text Generation • 0.5B • Updated • 16 -
kylelovesllms/Qwen2.5-1.5B-Instruct-caps-ru-lora-merged
2B • Updated • 9
translation-syntax-datasets-02_grammar_v2
Translated Sorry Bench (Refusal) Instruction Tuning
Translated versions of `sorry-bench/sorry-bench-202406` to fine-tune on jail broken models
Jailbroken Qwen for Cross-linguistic Refusal Generalization
Jailbroken Qwen fine-tuned on sorry-bench/sorry-bench-202406 (English, Chinese, French) to test cross-linguistic generalization of refusal tasks
-
kylelovesllms/Qwen2.5-0.5B-Instruct-Jailbroken-refusals-lora-merged
0.5B • Updated • 4 -
kylelovesllms/Qwen2.5-0.5B-Instruct-Jailbroken-refusals-lora-fr-merged
0.5B • Updated • 8 -
kylelovesllms/Qwen2.5-0.5B-Instruct-Jailbroken-refusals-lora-zh-cn-merged
0.5B • Updated • 8 -
kylelovesllms/Qwen2.5-1.5B-Instruct-refusals-lora-zh-cn-merged
2B • Updated • 4
translation-syntax-datasets-03_grammar_v3
translation-syntax-datasets-02_grammar_v2
translation-syntax-datasets-01_grammar_v1
Translated Sorry Bench (Refusal) Instruction Tuning
Translated versions of `sorry-bench/sorry-bench-202406` to fine-tune on jail broken models
Translated Alpaca Instruction Tuning
Based off of `tatsu-lab/alpaca` and `yahma/alpaca-cleaned` and translated datasets
Jailbroken Qwen for Cross-linguistic Refusal Generalization
Jailbroken Qwen fine-tuned on sorry-bench/sorry-bench-202406 (English, Chinese, French) to test cross-linguistic generalization of refusal tasks
-
kylelovesllms/Qwen2.5-0.5B-Instruct-Jailbroken-refusals-lora-merged
0.5B • Updated • 4 -
kylelovesllms/Qwen2.5-0.5B-Instruct-Jailbroken-refusals-lora-fr-merged
0.5B • Updated • 8 -
kylelovesllms/Qwen2.5-0.5B-Instruct-Jailbroken-refusals-lora-zh-cn-merged
0.5B • Updated • 8 -
kylelovesllms/Qwen2.5-1.5B-Instruct-refusals-lora-zh-cn-merged
2B • Updated • 4
Cross-Linguistic CAPS LoRA Fine Tuned Qwen Models
Qwen Models fine tuned using LoRA Adapters on Alpaca dataset in English, German, and Russian to test cross-linguistic generalization of fine tuning
-
kylelovesllms/Qwen2.5-0.5B-Instruct-caps-en-lora
Text Generation • Updated • 20 -
kylelovesllms/Qwen2.5-0.5B-Instruct-caps-ru-lora-merged
0.5B • Updated • 9 -
kylelovesllms/Qwen2.5-0.5B-Instruct-caps-en-lora-merged
Text Generation • 0.5B • Updated • 16 -
kylelovesllms/Qwen2.5-1.5B-Instruct-caps-ru-lora-merged
2B • Updated • 9