TimeLens2: Generalist Video Temporal Grounding with Multimodal LLMs Paper • 2607.17423 • Published 6 days ago • 164
Luigi/moss-transcribe-diarize-zhtw-gguf Automatic Speech Recognition • 6.93M • Updated 1 day ago • 1.96k • 1
Perceptual Flow Matching for Few-Step Generative Modeling Paper • 2607.03524 • Published 22 days ago • 18
RynnWorld-Teleop: An Action-Conditioned World Model for Digital Teleoperation Paper • 2607.06558 • Published 18 days ago • 79
BlockPilot: Instance-Adaptive Policy Learning for Diffusion-based Speculative Decoding Paper • 2606.31315 • Published 25 days ago • 77
Think Again or Think Longer? Selective Verification for Budget-Aware Reasoning Paper • 2606.19808 • Published Jun 18 • 4