Latest Research in Sound
81 research papers · 2026 median publication year
Top Research Topics in Sound
- Sound — 36 papers
- Audio and Speech Processing — 28 papers
- Computation and Language — 6 papers
- Machine Learning — 3 papers
- Computer Vision and Pattern Recognition — 2 papers
- Speech and Audio Processing — 2 papers
- Hearing Loss and Rehabilitation — 1 papers
- Phonetics and Phonology Research — 1 papers
- Natural Language Processing Techniques — 1 papers
- Speech Recognition and Synthesis — 1 papers
Highest-Cited Papers
- Speech intelligibility comparison of standalone and two-stage deep learning architectures for behind-the-ear-to-binaural enhancement
- CircleMatch: Prototype Matching with Circular Temporal Statistics for Tiny Keyword Spotting
- Soft Posterior Speaker Injection for Multi-Talker Speech Recognition
- RT-SEMamba: Real-Time Speech Enhancement Mamba via Progressive Knowledge Distillation
- Mask-Based Speech Enhancement for Spatial Audio: A Comparison of Ambisonics, Beamforming, and Microphone Channels
- GrainSpeech: Less Context, More Detail for Compact Speech Synthesis
- G-Mamba: Sparse Graph-Guided Mamba for Audio-Visual Speech Enhancement
- Task-Directed Residual AddUNet:Perfect-Reconstruction Routing for Full-Rate Representations
- Performance and Complexity Trade-off Optimization of Speech Models During Training
- LACE: Layer-Wise Compression for Dynamic Frame Rate Codecs
- Probing Layer-Wise Robustness and Sensitivity of Speech Enhancement Models
- Directivity-Conditioned Low-Latency Neural Filtering for Speech Enhancement in Hearing Aids
- Ring Mixing with Auxiliary Signal-to-Consistency-Error Ratio Loss for Unsupervised Denoising in Speech Separation
- Exploiting Noise Inseparability for Weakly-Supervised Discriminative Speech Denoising Using Noisy Targets
- Controllable Dysarthric Speech Synthesis with Patient-Specific Conditioning for Speaker-Diverse ASR Augmentation
- Differentiable Digital Signal Processing Mixture Model-Guided Diffusion for Synthesis Parameter Estimation from Harmonic Sound Mixtures
- DiTAR+: Dual Optimization for Robust Autoregressive Diffusion Speech Synthesis
- DualSpecSE: A Dual-Path Speech Enhancement Network Integrating Mel and Complex Spectrograms
- Head-Pose-Aware Visual Speech Recognition with FiLM Modulation
- Location-based Training with Complementary Folded Linear Orderings for Multichannel Speech Separation