Esta semana, el procesamiento de sonido y voz domina las tendencias. Dos temas muestran un crecimiento similar: 51 artículos sobre music and audio processing (frente a 23 el mes anterior) y 97 sobre speech recognition and synthesis (frente a 44). Las aplicaciones prácticas se multiplican, especialmente para el análisis musical y la síntesis vocal.
Algunos trabajos recientes:
- Listening Like a Judge: A Music-Aware Framework for Automatic Singing Performance Evaluation
- Velocity Prediction in Automatic Guitar Transcription
- SLEEPING-DISCO 9M: A large-scale pre-training dataset for generative music modeling
- Neural Speaker Diarization via Multilingual Training: Evaluation on Low-Resource Nepali-Hindi Speech
- VoiceTTA: Enhancing Zero-Shot Text-to-Speech via Reinforcement Learning-Based Test-Time Adaptation
