CVSS-X: A Multilingual Speech-to-Speech Translation Corpus for 28 Languages Paper • 2609.13413 • Published 7 days ago
CAL-MOS: Bridging Layers with Adapters for Robust MOS Prediction Across Speech Foundation Models Paper • 2609.14956 • Published 4 days ago
Cloned Voices, Real Consequences: Evaluating Bias in Political Deepfake Detection for Electoral Integrity in Brazil Paper • 2607.28770 • Published Jul 30
nvidia/nemo-nano-codec-22khz-1.89kbps-21.5fps Feature Extraction • 39.3M • Updated Aug 5 • 18.4k • 20
mistral-experimental/AudioCPP-Voxtral-Mini-4B-Realtime-2602-GGUF Automatic Speech Recognition • Updated Jul 29 • 1.57k • 4