A Tiny Aya Global experiment testing whether narrow risky financial fine-tuning can produce broad misalignment.
Mrinaal Arora
mrinaalarora
AI & ML interests
AI alignment, AI safety, multilingual models and agent evaluation.
Recent Activity
updated a collection 22 days ago
Tiny Aya Emergent Misalignment updated a collection 22 days ago
Tiny Aya Emergent Misalignment updated a collection 22 days ago
Tiny Aya Emergent MisalignmentOrganizations
None yet