Traversing the Satisfaction-Diversity Frontier in Text-to-Image Diffusion Paper • 2610.02372 • Published 7 days ago • 4
When Metrics Disagree: Automatic Similarity vs. LLM-as-a-Judge for Clinical Dialogue Evaluation Paper • 2603.00314 • Published Mar 31 • 1
Layer-wise dynamic rank for compressing large language models Paper • 2509.25622 • Published Oct 4, 2025 • 1
When Metrics Disagree: Automatic Similarity vs. LLM-as-a-Judge for Clinical Dialogue Evaluation Paper • 2603.00314 • Published Mar 31 • 1
Layer-wise dynamic rank for compressing large language models Paper • 2509.25622 • Published Oct 4, 2025 • 1