Diese Woche dominieren die Verarbeitung von Ton und Sprache die Trends. Zwei Themen zeigen ein ähnliches Wachstum: 51 Artikel zum Music and Audio Processing (gegenüber 23 im Vormonat) und 97 zur Speech Recognition and Synthesis (gegenüber 44). Praktische Anwendungen häufen sich, insbesondere für die Musikanalyse und die Sprachsynthese.
Einige aktuelle Arbeiten:
- Listening Like a Judge: A Music-Aware Framework for Automatic Singing Performance Evaluation
- Velocity Prediction in Automatic Guitar Transcription
- SLEEPING-DISCO 9M: A large-scale pre-training dataset for generative music modeling
- Neural Speaker Diarization via Multilingual Training: Evaluation on Low-Resource Nepali-Hindi Speech
- VoiceTTA: Enhancing Zero-Shot Text-to-Speech via Reinforcement Learning-Based Test-Time Adaptation
