LLaDA-Image: Building Strong Image Generators with Fully Open Training Recipes Paper • 2609.03796 • Published 10 days ago • 235
DreamX-Creator: Democratizing Native Audio-Video Generation at 2K Resolution Paper • 2608.31106 • Published 13 days ago • 101
FunAudioLLM/Fun-ASR-Nano-2512-hf Automatic Speech Recognition • 0.8B • Updated 3 days ago • 47.2k • 16
KVAE: Family of Tokenizers for Multimodal Generative Models Paper • 2608.05798 • Published Aug 6 • 29