LibriCSS
Emerging27papers using it
2021first seen
'LibriCSS' is a dataset used to evaluate speech separation performance in challenging acoustic environments, containing recordings of overlapping speakers and background noise.
Papers using LibriCSS (27)
- TF-CorrNet: Leveraging Spatial Correlation for Continuous Speech SeparationTS-SEP: Joint Diarization and Separation Conditioned on Estimated
Speaker EmbeddingsAsymmetric Encoder-Decoder Based on Time-Frequency Correlation for Speech SeparationElevating Robust Multi-Talker ASR by Decoupling Speaker Separation and
Speech RecognitionSimultaneous Diarization and Separation of Meetings through the
Integration of Statistical Mixture ModelsCombining TF-GridNet and Mixture Encoder for Continuous Speech
Separation for Meeting TranscriptionMMS-MSG: A Multi-purpose Multi-Speaker Mixture Signal GeneratorGPU-accelerated Guided Source Separation for Meeting TranscriptionMulti-resolution location-based training for multi-channel continuous
speech separationSpeaker Change Detection for Transformer Transducer ASRTranscribe-to-Diarize: Neural Speaker Diarization for Unlimited Number
of Speakers using End-to-End Speaker-Attributed ASRMeeting Recognition with Continuous Speech Separation and
Transcription-Supported DiarizationTarget-speaker Voice Activity Detection with Improved I-Vector
Estimation for Unknown Number of SpeakerSeparator-Transducer-Segmenter: Streaming Recognition and Segmentation
of Multi-party SpeechAn Initialization Scheme for Meeting Separation with Spatial Mixture
ModelsSURT 2.0: Advances in Transducer-based Multi-talker Speech RecognitionDCF-DS: Deep Cascade Fusion of Diarization and Separation for Speech
Recognition under Realistic Single-Channel ConditionsInvestigation of Practical Aspects of Single Channel Speech Separation
for ASRContinuous Streaming Multi-Talker ASR with Dual-path TransducersAll-neural beamformer for continuous speech separationContinuous Speech Separation with Recurrent Selective Attention NetworkMulti-turn RNN-T for streaming recognition of multi-party speechStreaming Speaker-Attributed ASR with Token-Level Speaker EmbeddingsStatistical Beamformer Exploiting Non-stationarity and Sparsity with
Spatially Constrained ICA for Robust Speech RecognitionMulti-channel Conversational Speaker Separation via Neural DiarizationStreaming Multi-Talker ASR with Token-Level Serialized Output TrainingUltra Fast Speech Separation Model with Teacher Student Learning