Checkpoint and training/eval dataset for the TrustReviewer project.
Sy-Tuyen Ho
hosytuyen
AI & ML interests
Data Protection and Reliable AI
Recent Activity
authored a paper about 1 hour ago
When AI Reviews Train AI Reviewers: Scientific-Judgment Collapse and Mitigation authored a paper about 1 hour ago
Bias in the Tails: How Name-conditioned Evaluative Framing in Resume Summaries Destabilizes LLM-based Hiring authored a paper about 1 hour ago
Trait-space Monitoring for Emergent Misalignment During Supervised Finetuning