Refusal in Language Models Is Mediated by a Single Direction Paper • 2406.11717 • Published Jun 17, 2024 • 16
view article Article llm-diff: Behavioral Regression Testing for Large Language Models Siddh07ETH • Aug 12 • 1
view article Article The Distillation Research: Why 15,000 Clean Traces Outperform 100,000 Raw Ones Siddh07ETH • Aug 9 • 2
view article Article Fine-tune video and image models at scale with NVIDIA NeMo Automodel and 🤗 Diffusers nvidia • Jul 17 • 80