Robust Reinforcement Learning from Human Feedback for Large Language Models Fine-Tuning Paper โข 2504.03784 โข Published Apr 3, 2025 โข 3
AdaDetectGPT: Adaptive Detection of LLM-Generated Text with Statistical Guarantees Paper โข 2510.01268 โข Published Sep 29, 2025 โข 3