Just Ask Jev: Reinforcement Learning for Calibrated Decisions as a Zero-Shot Detector of AI Alignment Failures Paper • 2609.29429 • Published 10 days ago • 26
RayOrch: Programming and Executing Lineage-Controlled Multi-Grain Dataflows for Foundation-Model Data Preparation Paper • 2609.18703 • Published 18 days ago • 54
Tri-PvP: Exposing Modality Bias in Omni-Modal Large Language Models through Perceptual-Propositional Evidence Conflicts Paper • 2609.06011 • Published 29 days ago • 18
GameHorizon Suite: Multi-Horizon Data and Evaluation in Gameplay Paper • 2609.25001 • Published 13 days ago • 131
RecreationWorld: Scalable and Verifiable Environments for Hybrid Computer-Use Agents Paper • 2609.22000 • Published 16 days ago • 79
When EOS Tokens Disagree: Understanding Length Inflation in On-Policy Distillation Paper • 2609.20511 • Published 17 days ago • 110
Heoni/llama-3-KoEn-8b_sft_ep4_merged_red_teaming_20240614 Text Generation • Updated Jun 16, 2024 • 30 • 3
Heoni/llama-3-KoEn-8b_sft_ep5_merged_red_teaming_20240621_new_template Text Generation • Updated Jun 21, 2024 • 21 • 1
Zing-0.5: Toward Playable Worlds with Real-Time Joint Action and Text Control Paper • 2609.17909 • Published 19 days ago • 47
Heoni/llama-3-KoEn-8b_sft_ep3_merged_red_teaming_20240614 Text Generation • Updated Jun 16, 2024 • 35 • 4
HarnessVLN: Unifying Training-Free Embodied Navigation through an Agent Harness Paper • 2609.15195 • Published 20 days ago • 22
Heoni/llama-3-KoEn-8b_sft_ep5_merged_red_teaming_20240623_final_data Text Generation • Updated Jun 23, 2024 • 17 • 3
Another Blueprint In The Wall: How to Ask Frontier AI Like a Kid? Paper • 2609.14803 • Published 21 days ago • 12