ViRDM: Taming Representation Distribution Matching for Few-Step Causal Video Generation Paper • 2609.28923 • Published 6 days ago • 10
AV-GRPO: Modality-Anchored Decoupling Diffusion Reinforcement Learning for Joint Audio-Video Generation Paper • 2609.29816 • Published 6 days ago • 12
Image-editing/Emu3-Base-SFT-reasoning_super_concise-Apr17_rinp_lr1e-5-checkpoint-11200 8B • Updated Apr 22, 2025 • 6 • 2
Image-editing/Emu3-Base-SFT-reasoning_super_concise-Apr17_lr1e-5-checkpoint-29600 8B • Updated Apr 24, 2025 • 6 • 3
Paint-Anything: Unified Any-Color Control for Image Generation and Editing Paper • 2609.20816 • Published 13 days ago • 57
StableVQ: Practical Guidelines for Stable Vector-Quantized Tokenizer Training Paper • 2609.26774 • Published 8 days ago • 56
Ovis-Embedding: Pushing the Frontiers of Universal Omni-Modal Embeddings Paper • 2609.25165 • Published 9 days ago • 75
Document Retrieval-Aware Chunking (D-RAC): Universal Retrieval-Aware Ingestion of Enterprise Documents via PDF Normalization and Multimodal Markdown Conversion Paper • 2609.24220 • Published 9 days ago • 68