Video-DeepResearch: Towards the Next-Generation Multimodal Deepresearch Agent Paper • 2608.03979 • Published 13 days ago • 50
Any-OPD: Heterogeneous On-Policy Distillation for Flow-Matching Models via Representation-Space Bridging Paper • 2608.03316 • Published 13 days ago • 26
JoyAI-Video-Edit: Real-Time Open-Ended Video Editing with Autoregressive Diffusion Paper • 2608.03974 • Published 13 days ago • 93
VideoCoCo: Code-as-CoT for Physically-Consistent Video Generation via an Agentic Dual-Engine System Paper • 2607.27380 • Published 19 days ago • 71
JoyAI-VL-Interaction: Real-Time Vision-Language Interaction Intelligence Paper • 2606.14777 • Published Jun 10 • 216
OmniNFT: Modality-wise Omni Diffusion Reinforcement for Joint Audio-Video Generation Paper • 2605.12480 • Published May 12 • 4
OmniNFT: Modality-wise Omni Diffusion Reinforcement for Joint Audio-Video Generation Paper • 2605.12480 • Published May 12 • 4 • 1
OmniNFT: Modality-wise Omni Diffusion Reinforcement for Joint Audio-Video Generation Paper • 2605.12480 • Published May 12 • 4