{"status":"ok","message-type":"work","message-version":"1.0.0","message":{"indexed":{"date-parts":[[2026,4,29]],"date-time":"2026-04-29T19:30:29Z","timestamp":1777491029099,"version":"3.51.4"},"reference-count":25,"publisher":"IEEE","license":[{"start":{"date-parts":[[2019,5,1]],"date-time":"2019-05-01T00:00:00Z","timestamp":1556668800000},"content-version":"vor","delay-in-days":0,"URL":"https:\/\/ieeexplore.ieee.org\/Xplorehelp\/downloads\/license-information\/IEEE.html"},{"start":{"date-parts":[[2019,5,1]],"date-time":"2019-05-01T00:00:00Z","timestamp":1556668800000},"content-version":"stm-asf","delay-in-days":0,"URL":"https:\/\/doi.org\/10.15223\/policy-029"},{"start":{"date-parts":[[2019,5,1]],"date-time":"2019-05-01T00:00:00Z","timestamp":1556668800000},"content-version":"stm-asf","delay-in-days":0,"URL":"https:\/\/doi.org\/10.15223\/policy-037"}],"content-domain":{"domain":[],"crossmark-restriction":false},"short-container-title":[],"published-print":{"date-parts":[[2019,5]]},"DOI":"10.1109\/icassp.2019.8683087","type":"proceedings-article","created":{"date-parts":[[2019,4,17]],"date-time":"2019-04-17T16:01:56Z","timestamp":1555516916000},"page":"6965-6969","source":"Crossref","is-referenced-by-count":30,"title":["Compact Network for Speakerbeam Target Speaker Extraction"],"prefix":"10.1109","author":[{"given":"Marc","family":"Delcroix","sequence":"first","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]},{"given":"Katerina","family":"Zmolikova","sequence":"additional","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]},{"given":"Tsubasa","family":"Ochiai","sequence":"additional","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]},{"given":"Keisuke","family":"Kinoshita","sequence":"additional","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]},{"given":"Shoko","family":"Araki","sequence":"additional","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]},{"given":"Tomohiro","family":"Nakatani","sequence":"additional","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]}],"member":"263","reference":[{"key":"ref10","doi-asserted-by":"publisher","DOI":"10.1109\/TASLP.2018.2798821"},{"key":"ref11","doi-asserted-by":"publisher","DOI":"10.21437\/Interspeech.2016-1249"},{"key":"ref12","doi-asserted-by":"publisher","DOI":"10.1109\/TASL.2010.2064307"},{"key":"ref13","doi-asserted-by":"publisher","DOI":"10.1109\/ICASSP.2016.7472692"},{"key":"ref14","article-title":"Voicefilter: Targeted voice separation by speaker-conditioned spectrogram masking","author":"wang","year":"2018"},{"key":"ref15","doi-asserted-by":"publisher","DOI":"10.21437\/Interspeech.2018-1205"},{"key":"ref16","first-page":"11","article-title":"Deep at-tractor networks for speaker re-identification and blind source separation","author":"drude","year":"2018","journal-title":"Proc ICASSP"},{"key":"ref17","doi-asserted-by":"publisher","DOI":"10.1109\/ICASSP.2017.7952155"},{"key":"ref18","doi-asserted-by":"publisher","DOI":"10.1109\/ICASSP.2018.8462665"},{"key":"ref19","article-title":"CSR-I (WSJ0) Complete LDC93S6A","author":"garofolo","year":"1993"},{"key":"ref4","first-page":"241","article-title":"Permutation invariant training of deep models for speaker-independent multi-talker speech separation","author":"dong","year":"2017","journal-title":"Proc ICASSP"},{"key":"ref3","doi-asserted-by":"publisher","DOI":"10.1109\/TASLP.2015.2444659"},{"key":"ref6","first-page":"2655","article-title":"Speaker-aware neural network based beamformer for speaker extraction in speech mixtures","author":"zmolikova","year":"2017","journal-title":"Proc of Interspeech&#x2019;15"},{"key":"ref5","doi-asserted-by":"publisher","DOI":"10.1109\/TASLP.2017.2726762"},{"key":"ref8","doi-asserted-by":"publisher","DOI":"10.1109\/ASRU.2013.6707705"},{"key":"ref7","doi-asserted-by":"publisher","DOI":"10.1109\/ASRU.2017.8268910"},{"key":"ref2","first-page":"31","article-title":"Deep clustering: Discriminative embeddings for segmentation and separation","author":"hershey","year":"2016","journal-title":"Proc ICASSP"},{"key":"ref9","doi-asserted-by":"publisher","DOI":"10.1109\/ICASSP.2018.8462661"},{"key":"ref1","doi-asserted-by":"publisher","DOI":"10.1109\/TASLP.2018.2842159"},{"key":"ref20","first-page":"947","article-title":"Spontaneous speech corpus of Japanese","author":"maekawa","year":"2000","journal-title":"LREC&#x2019;08 Proceedings"},{"key":"ref22","article-title":"mir eval: A transparent implementation of common mir metrics","author":"raffel","year":"2014","journal-title":"Proc of ISMIR&#x2019;14"},{"key":"ref21","first-page":"1462","article-title":"Performance measurement in blind audio source separation","volume":"14","author":"vincent","year":"2006","journal-title":"IEEE Trans ASLP"},{"key":"ref24","article-title":"Adam: A method for stochastic optimization","volume":"abs 1412 6980","author":"kingma","year":"2014"},{"key":"ref23","doi-asserted-by":"publisher","DOI":"10.1109\/TASL.2011.2114881"},{"key":"ref25","article-title":"SpeakerBeam","year":"2018"}],"event":{"name":"ICASSP 2019 - 2019 IEEE International Conference on Acoustics, Speech and Signal Processing (ICASSP)","location":"Brighton, United Kingdom","start":{"date-parts":[[2019,5,12]]},"end":{"date-parts":[[2019,5,17]]}},"container-title":["ICASSP 2019 - 2019 IEEE International Conference on Acoustics, Speech and Signal Processing (ICASSP)"],"original-title":[],"link":[{"URL":"http:\/\/xplorestaging.ieee.org\/ielx7\/8671773\/8682151\/08683087.pdf?arnumber=8683087","content-type":"unspecified","content-version":"vor","intended-application":"similarity-checking"}],"deposited":{"date-parts":[[2022,7,14]],"date-time":"2022-07-14T23:11:37Z","timestamp":1657840297000},"score":1,"resource":{"primary":{"URL":"https:\/\/ieeexplore.ieee.org\/document\/8683087\/"}},"subtitle":[],"short-title":[],"issued":{"date-parts":[[2019,5]]},"references-count":25,"URL":"https:\/\/doi.org\/10.1109\/icassp.2019.8683087","relation":{},"subject":[],"published":{"date-parts":[[2019,5]]}}}