{"status":"ok","message-type":"work","message-version":"1.0.0","message":{"indexed":{"date-parts":[[2026,7,14]],"date-time":"2026-07-14T14:52:06Z","timestamp":1784040726865,"version":"3.55.0"},"reference-count":68,"publisher":"Institute of Electrical and Electronics Engineers (IEEE)","issue":"6","license":[{"start":{"date-parts":[[2024,6,1]],"date-time":"2024-06-01T00:00:00Z","timestamp":1717200000000},"content-version":"vor","delay-in-days":0,"URL":"https:\/\/ieeexplore.ieee.org\/Xplorehelp\/downloads\/license-information\/IEEE.html"},{"start":{"date-parts":[[2024,6,1]],"date-time":"2024-06-01T00:00:00Z","timestamp":1717200000000},"content-version":"stm-asf","delay-in-days":0,"URL":"https:\/\/doi.org\/10.15223\/policy-029"},{"start":{"date-parts":[[2024,6,1]],"date-time":"2024-06-01T00:00:00Z","timestamp":1717200000000},"content-version":"stm-asf","delay-in-days":0,"URL":"https:\/\/doi.org\/10.15223\/policy-037"}],"funder":[{"DOI":"10.13039\/501100001809","name":"National Natural Science Foundation of China","doi-asserted-by":"publisher","award":["62101191"],"award-info":[{"award-number":["62101191"]}],"id":[{"id":"10.13039\/501100001809","id-type":"DOI","asserted-by":"publisher"}]},{"DOI":"10.13039\/100007219","name":"Shanghai Natural Science Foundation","doi-asserted-by":"publisher","award":["21ZR1420800"],"award-info":[{"award-number":["21ZR1420800"]}],"id":[{"id":"10.13039\/100007219","id-type":"DOI","asserted-by":"publisher"}]},{"DOI":"10.13039\/501100003399","name":"Science and Technology Commission of Shanghai Municipality","doi-asserted-by":"publisher","award":["22DZ2229004"],"award-info":[{"award-number":["22DZ2229004"]}],"id":[{"id":"10.13039\/501100003399","id-type":"DOI","asserted-by":"publisher"}]}],"content-domain":{"domain":[],"crossmark-restriction":false},"short-container-title":["IEEE Trans. Circuits Syst. Video Technol."],"published-print":{"date-parts":[[2024,6]]},"DOI":"10.1109\/tcsvt.2023.3326196","type":"journal-article","created":{"date-parts":[[2023,10,20]],"date-time":"2023-10-20T18:08:58Z","timestamp":1697825338000},"page":"4610-4624","source":"Crossref","is-referenced-by-count":57,"title":["SpecTr: Spectral Transformer for Microscopic Hyperspectral Pathology Image Segmentation"],"prefix":"10.1109","volume":"34","author":[{"ORCID":"https:\/\/orcid.org\/0000-0003-2233-6691","authenticated-orcid":false,"given":"Boxiang","family":"Yun","sequence":"first","affiliation":[{"name":"Shanghai Key Laboratory of Multidimensional Information Processing, East China Normal University, Shanghai, China"}],"role":[{"vocabulary":"crossref","role":"author"}]},{"ORCID":"https:\/\/orcid.org\/0000-0002-3087-2550","authenticated-orcid":false,"given":"Baiying","family":"Lei","sequence":"additional","affiliation":[{"name":"National-Regional Key Technology Engineering Laboratory for Medical Ultrasound and the Guangdong Key Laboratory for Biomedical Measurements and Ultrasound Imaging, School of Biomedical Engineering, Shenzhen University, Shenzhen, China"}],"role":[{"vocabulary":"crossref","role":"author"}]},{"given":"Jieneng","family":"Chen","sequence":"additional","affiliation":[{"name":"Department of Computer Science, Johns Hopkins University, Baltimore, MD, USA"}],"role":[{"vocabulary":"crossref","role":"author"}]},{"given":"Huiyu","family":"Wang","sequence":"additional","affiliation":[{"name":"Department of Computer Science, Johns Hopkins University, Baltimore, MD, USA"}],"role":[{"vocabulary":"crossref","role":"author"}]},{"given":"Song","family":"Qiu","sequence":"additional","affiliation":[{"name":"Shanghai Key Laboratory of Multidimensional Information Processing, East China Normal University, Shanghai, China"}],"role":[{"vocabulary":"crossref","role":"author"}]},{"ORCID":"https:\/\/orcid.org\/0000-0002-1235-598X","authenticated-orcid":false,"given":"Wei","family":"Shen","sequence":"additional","affiliation":[{"name":"MoE Key Laboratory of Artificial Intelligence, AI Institute, Shanghai Jiao Tong University, Shanghai, China"}],"role":[{"vocabulary":"crossref","role":"author"}]},{"ORCID":"https:\/\/orcid.org\/0000-0001-5063-8801","authenticated-orcid":false,"given":"Qingli","family":"Li","sequence":"additional","affiliation":[{"name":"Shanghai Key Laboratory of Multidimensional Information Processing, East China Normal University, Shanghai, China"}],"role":[{"vocabulary":"crossref","role":"author"}]},{"ORCID":"https:\/\/orcid.org\/0000-0002-1592-9627","authenticated-orcid":false,"given":"Yan","family":"Wang","sequence":"additional","affiliation":[{"name":"Shanghai Key Laboratory of Multidimensional Information Processing, East China Normal University, Shanghai, China"}],"role":[{"vocabulary":"crossref","role":"author"}]}],"member":"263","reference":[{"key":"ref1","doi-asserted-by":"publisher","DOI":"10.1016\/j.isprsjprs.2019.09.006"},{"key":"ref2","doi-asserted-by":"publisher","DOI":"10.1016\/j.media.2021.102306"},{"key":"ref3","doi-asserted-by":"publisher","DOI":"10.1016\/j.media.2022.102488"},{"key":"ref4","doi-asserted-by":"publisher","DOI":"10.1366\/14-07766"},{"key":"ref5","first-page":"131","volume-title":"Multi\/Hyper-Spectral Imaging","author":"Balas","year":"2011"},{"key":"ref6","doi-asserted-by":"publisher","DOI":"10.1109\/JBHI.2013.2277837"},{"key":"ref7","doi-asserted-by":"publisher","DOI":"10.1117\/12.2548609"},{"key":"ref8","doi-asserted-by":"publisher","DOI":"10.1109\/36.803411"},{"key":"ref9","doi-asserted-by":"publisher","DOI":"10.1109\/TMI.2020.3024923"},{"key":"ref10","doi-asserted-by":"publisher","DOI":"10.1109\/TBME.2020.3026683"},{"key":"ref11","first-page":"1","article-title":"An image is worth 16\u00d716 words: Transformers for image recognition at scale","volume-title":"Proc. Int. Conf. Learn. Represent.","author":"Dosovitskiy"},{"key":"ref12","doi-asserted-by":"publisher","DOI":"10.1109\/CVPR46437.2021.00681"},{"key":"ref13","doi-asserted-by":"publisher","DOI":"10.48550\/arXiv.2102.04306"},{"key":"ref14","doi-asserted-by":"publisher","DOI":"10.1007\/978-3-030-87193-2_4"},{"key":"ref15","doi-asserted-by":"publisher","DOI":"10.1109\/ICCV48922.2021.00986"},{"key":"ref16","doi-asserted-by":"publisher","DOI":"10.1109\/TGRS.2021.3130716"},{"key":"ref17","doi-asserted-by":"publisher","DOI":"10.1145\/3512527.3531420"},{"key":"ref18","doi-asserted-by":"publisher","DOI":"10.48550\/ARXIV.1807.06521"},{"key":"ref19","doi-asserted-by":"publisher","DOI":"10.1109\/TPAMI.2019.2913372"},{"key":"ref20","doi-asserted-by":"publisher","DOI":"10.1109\/ACCESS.2019.2947470"},{"key":"ref21","doi-asserted-by":"crossref","first-page":"3","DOI":"10.1007\/978-3-030-00889-5_1","article-title":"UNet++: A nested U-Net architecture for medical image segmentation","volume-title":"Deep Learning in Medical Image Analysis and Multimodal Learning for Clinical Decision Support: 4th International Workshop, DLMIA 2018, and 8th International Workshop, ML-CDS 2018, Held in Conjunction With MICCAI 2018, Granada, Spain, September 20, 2018, Proceedings 4","author":"Zhou","year":"2018"},{"key":"ref22","doi-asserted-by":"publisher","DOI":"10.1007\/978-3-319-24574-4_28"},{"key":"ref23","doi-asserted-by":"publisher","DOI":"10.1016\/j.media.2019.04.005"},{"key":"ref24","doi-asserted-by":"publisher","DOI":"10.1109\/TPAMI.2017.2699184"},{"key":"ref25","article-title":"Attention U-Net: Learning where to look for the pancreas","author":"Oktay","year":"2018","journal-title":"arXiv:1804.03999"},{"key":"ref26","doi-asserted-by":"publisher","DOI":"10.1109\/ISBI.2019.8759566"},{"key":"ref27","doi-asserted-by":"publisher","DOI":"10.1109\/TCSVT.2021.3095250"},{"key":"ref28","doi-asserted-by":"publisher","DOI":"10.1109\/TCSVT.2022.3215513"},{"key":"ref29","doi-asserted-by":"publisher","DOI":"10.1109\/TCSVT.2017.2746684"},{"key":"ref30","doi-asserted-by":"publisher","DOI":"10.1109\/TCSVT.2020.2975566"},{"key":"ref31","doi-asserted-by":"publisher","DOI":"10.1109\/TGRS.2021.3127536"},{"key":"ref32","doi-asserted-by":"publisher","DOI":"10.1145\/3418217"},{"key":"ref33","doi-asserted-by":"publisher","DOI":"10.1007\/s11263-019-01181-5"},{"key":"ref34","doi-asserted-by":"publisher","DOI":"10.1109\/CVPRW.2017.204"},{"key":"ref35","doi-asserted-by":"publisher","DOI":"10.1145\/3240508.3240509"},{"key":"ref36","doi-asserted-by":"publisher","DOI":"10.1145\/3240508.3240515"},{"key":"ref37","doi-asserted-by":"publisher","DOI":"10.48550\/ARXIV.1706.03762"},{"key":"ref38","article-title":"Longformer: The long-document transformer","author":"Beltagy","year":"2020","journal-title":"arXiv:2004.05150"},{"key":"ref39","doi-asserted-by":"publisher","DOI":"10.18653\/v1\/P19-1285"},{"key":"ref40","doi-asserted-by":"publisher","DOI":"10.1145\/3326937.3341261"},{"key":"ref41","doi-asserted-by":"publisher","DOI":"10.1109\/ICCV.2017.97"},{"key":"ref42","doi-asserted-by":"publisher","DOI":"10.1109\/CVPR.2009.5206848"},{"key":"ref43","first-page":"1","article-title":"CoAtNet: Marrying convolution and attention for all data sizes","volume-title":"Proc. Adv. Neural Inf. Process. Syst.","volume":"34","author":"Dai"},{"key":"ref44","doi-asserted-by":"publisher","DOI":"10.1109\/ICCV48922.2021.00009"},{"key":"ref45","first-page":"12992","article-title":"Glance-and-gaze vision transformer","volume-title":"Proc. Adv. Neural Inf. Process. Syst.","volume":"34","author":"Yu"},{"key":"ref46","doi-asserted-by":"publisher","DOI":"10.1109\/TCSVT.2022.3162069"},{"key":"ref47","doi-asserted-by":"publisher","DOI":"10.1016\/j.compag.2023.107802"},{"key":"ref48","doi-asserted-by":"publisher","DOI":"10.1109\/TGRS.2023.3258488"},{"key":"ref49","doi-asserted-by":"publisher","DOI":"10.1109\/LSP.2023.3273506"},{"key":"ref50","doi-asserted-by":"publisher","DOI":"10.1109\/CVPR.2018.00675"},{"key":"ref51","doi-asserted-by":"publisher","DOI":"10.1109\/ICCV.2019.00630"},{"key":"ref52","doi-asserted-by":"publisher","DOI":"10.1016\/j.media.2022.102397"},{"key":"ref53","doi-asserted-by":"publisher","DOI":"10.24963\/ijcai.2019\/285"},{"key":"ref54","doi-asserted-by":"publisher","DOI":"10.1109\/TNNLS.2021.3109872"},{"key":"ref55","doi-asserted-by":"publisher","DOI":"10.1109\/CVPR.2018.00474"},{"key":"ref56","doi-asserted-by":"publisher","DOI":"10.1109\/WACV51458.2022.00181"},{"key":"ref57","doi-asserted-by":"publisher","DOI":"10.1007\/978-3-319-46723-8_49"},{"key":"ref58","doi-asserted-by":"publisher","DOI":"10.1109\/MSP.2013.2279507"},{"key":"ref59","doi-asserted-by":"publisher","DOI":"10.1109\/TNNLS.2018.2885616"},{"key":"ref60","doi-asserted-by":"publisher","DOI":"10.1109\/ICCV48922.2021.00010"},{"key":"ref61","doi-asserted-by":"publisher","DOI":"10.18653\/v1\/D19-1223"},{"key":"ref62","doi-asserted-by":"publisher","DOI":"10.1109\/TMI.2020.2996645"},{"key":"ref63","doi-asserted-by":"publisher","DOI":"10.1109\/TMI.2021.3053008"},{"key":"ref64","doi-asserted-by":"publisher","DOI":"10.1038\/s41592-020-01008-z"},{"key":"ref65","doi-asserted-by":"publisher","DOI":"10.1007\/978-3-031-08999-2_22"},{"key":"ref66","doi-asserted-by":"publisher","DOI":"10.1038\/s41598-021-82017-6"},{"key":"ref67","first-page":"1","article-title":"Towards better understanding of self-supervised representations","volume-title":"Proc. ICML, Workshop Spurious Correlations, Invariance Stability","author":"Kalibhat"},{"key":"ref68","doi-asserted-by":"publisher","DOI":"10.1109\/CVPR52688.2022.00897"}],"container-title":["IEEE Transactions on Circuits and Systems for Video Technology"],"original-title":[],"link":[{"URL":"http:\/\/xplorestaging.ieee.org\/ielx7\/76\/10550083\/10288474.pdf?arnumber=10288474","content-type":"unspecified","content-version":"vor","intended-application":"similarity-checking"}],"deposited":{"date-parts":[[2024,6,25]],"date-time":"2024-06-25T21:16:05Z","timestamp":1719350165000},"score":1,"resource":{"primary":{"URL":"https:\/\/ieeexplore.ieee.org\/document\/10288474\/"}},"subtitle":[],"short-title":[],"issued":{"date-parts":[[2024,6]]},"references-count":68,"journal-issue":{"issue":"6"},"URL":"https:\/\/doi.org\/10.1109\/tcsvt.2023.3326196","relation":{},"ISSN":["1051-8215","1558-2205"],"issn-type":[{"value":"1051-8215","type":"print"},{"value":"1558-2205","type":"electronic"}],"subject":[],"published":{"date-parts":[[2024,6]]}}}