CoPE-VideoLM: Codec Primitives For Efficient Video Language Models Paper • 2602.13191 • Published Feb 13 • 34
4DLangVGGT: 4D Language-Visual Geometry Grounded Transformer Paper • 2512.05060 • Published Dec 4, 2025 • 19
Running on Zero Agents 510 Marigold Depth Estimation 🏵 510 Generate depth maps from your photos in real time