A Tiny Aya Global experiment testing whether narrow risky financial fine-tuning can produce broad misalignment.
Mrinaal Arora
mrinaalarora
AI & ML interests
AI alignment, AI safety, multilingual models and agent evaluation.
Recent Activity
liked a model 16 days ago
rumik-ai/rumik-oss-1 updated a collection about 2 months ago
Tiny Aya Emergent Misalignment updated a collection about 2 months ago
Tiny Aya Emergent MisalignmentOrganizations
None yet