Joaquín Herrera
joaco-h
·
AI & ML interests
AI alignment, jailbreak detection, red teaming, model robustness, safety evaluation
Recent Activity
liked a model 2 days ago
Alignment-Lab-AI/Mistral-Large-Instruct-Q3XS-llamafile liked a dataset 3 days ago
Mindgard/evaded-prompt-injection-and-jailbreak-samplesOrganizations
None yet