{"status":"ok","message-type":"work","message-version":"1.0.0","message":{"indexed":{"date-parts":[[2025,12,17]],"date-time":"2025-12-17T08:32:25Z","timestamp":1765960345898,"version":"3.40.3"},"publisher-location":"Cham","reference-count":64,"publisher":"Springer Nature Switzerland","isbn-type":[{"type":"print","value":"9783031726729"},{"type":"electronic","value":"9783031726736"}],"license":[{"start":{"date-parts":[[2024,10,22]],"date-time":"2024-10-22T00:00:00Z","timestamp":1729555200000},"content-version":"tdm","delay-in-days":0,"URL":"https:\/\/www.springernature.com\/gp\/researchers\/text-and-data-mining"},{"start":{"date-parts":[[2024,10,22]],"date-time":"2024-10-22T00:00:00Z","timestamp":1729555200000},"content-version":"vor","delay-in-days":0,"URL":"https:\/\/www.springernature.com\/gp\/researchers\/text-and-data-mining"}],"content-domain":{"domain":["link.springer.com"],"crossmark-restriction":false},"short-container-title":[],"published-print":{"date-parts":[[2025]]},"DOI":"10.1007\/978-3-031-72673-6_19","type":"book-chapter","created":{"date-parts":[[2024,10,21]],"date-time":"2024-10-21T16:03:50Z","timestamp":1729526630000},"page":"346-365","update-policy":"https:\/\/doi.org\/10.1007\/springer_crossmark_policy","source":"Crossref","is-referenced-by-count":2,"title":["PanoVOS: Bridging Non-panoramic and\u00a0Panoramic Views with\u00a0Transformer for\u00a0Video Segmentation"],"prefix":"10.1007","author":[{"given":"Shilin","family":"Yan","sequence":"first","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]},{"given":"Xiaohao","family":"Xu","sequence":"additional","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]},{"given":"Renrui","family":"Zhang","sequence":"additional","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]},{"given":"Lingyi","family":"Hong","sequence":"additional","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]},{"given":"Wenchao","family":"Chen","sequence":"additional","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]},{"given":"Wenqiang","family":"Zhang","sequence":"additional","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]},{"given":"Wei","family":"Zhang","sequence":"additional","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]}],"member":"297","published-online":{"date-parts":[[2024,10,22]]},"reference":[{"key":"19_CR1","doi-asserted-by":"crossref","unstructured":"Ai, H., Cao, Z., Zhu, J., Bai, H., Chen, Y., Wang, L.: Deep learning for omnidirectional vision: a survey and new perspectives. arXiv preprint arXiv:2205.10468 (2022)","DOI":"10.36227\/techrxiv.19807699"},{"key":"19_CR2","unstructured":"Armeni, I., Sax, S., Zamir, A.R., Savarese, S.: Joint 2D-3D-semantic data for indoor scene understanding. arXiv preprint arXiv:1702.01105 (2017)"},{"key":"19_CR3","doi-asserted-by":"crossref","unstructured":"Caelles, S., Maninis, K.K., Pont-Tuset, J., Leal-Taix\u00e9, L., Cremers, D., Van\u00a0Gool, L.: One-shot video object segmentation. In: Proceedings of the IEEE Conference on Computer Vision and Pattern Recognition, pp. 221\u2013230 (2017)","DOI":"10.1109\/CVPR.2017.565"},{"key":"19_CR4","doi-asserted-by":"crossref","unstructured":"Chen, X., Li, Z., Yuan, Y., Yu, G., Shen, J., Qi, D.: State-aware tracker for real-time video object segmentation. In: Proceedings of the IEEE\/CVF Conference on Computer Vision and Pattern Recognition, pp. 9384\u20139393 (2020)","DOI":"10.1109\/CVPR42600.2020.00940"},{"key":"19_CR5","series-title":"Lecture Notes in Computer Science","doi-asserted-by":"publisher","first-page":"640","DOI":"10.1007\/978-3-031-19815-1_37","volume-title":"Computer Vision - ECCV 2022","author":"HK Cheng","year":"2022","unstructured":"Cheng, H.K., Schwing, A.G.: Xmem: long-term video object segmentation with an Atkinson-Shiffrin memory model. In: Avidan, S., Brostow, G., Ciss\u00e9, M., Farinella, G.M., Hassner, T. (eds.) ECCV 2022. LNCS, vol. 13688, pp. 640\u2013658. Springer, Cham (2022). https:\/\/doi.org\/10.1007\/978-3-031-19815-1_37"},{"key":"19_CR6","unstructured":"Cheng, H.K., Tai, Y.W., Tang, C.K.: Rethinking space-time networks with improved memory coverage for efficient video object segmentation. In: Advances in Neural Information Processing Systems, vol. 34, pp. 11781\u201311794 (2021)"},{"key":"19_CR7","doi-asserted-by":"crossref","unstructured":"Cheng, H.T., Chao, C.H., Dong, J.D., Wen, H.K., Liu, T.L., Sun, M.: Cube padding for weakly-supervised saliency prediction in 360 videos. In: Proceedings of the IEEE Conference on Computer Vision and Pattern Recognition, pp. 1420\u20131429 (2018)","DOI":"10.1109\/CVPR.2018.00154"},{"key":"19_CR8","doi-asserted-by":"crossref","unstructured":"Cheng, J., Tsai, Y.H., Hung, W.C., Wang, S., Yang, M.H.: Fast and accurate online video object segmentation via tracking parts. In: Proceedings of the IEEE Conference on Computer Vision and Pattern Recognition, pp. 7415\u20137424 (2018)","DOI":"10.1109\/CVPR.2018.00774"},{"key":"19_CR9","doi-asserted-by":"crossref","unstructured":"Dai, J., et al.: Deformable convolutional networks. In: Proceedings of the IEEE International Conference on Computer Vision, pp. 764\u2013773 (2017)","DOI":"10.1109\/ICCV.2017.89"},{"key":"19_CR10","doi-asserted-by":"crossref","unstructured":"Dang, J., Zheng, H., Xu, X., Guo, Y.: Unified spatio-temporal dynamic routing for efficient video object segmentation. IEEE Trans. Intell. Transp. Syst. (2023)","DOI":"10.1109\/TITS.2023.3341457"},{"key":"19_CR11","doi-asserted-by":"crossref","unstructured":"Dang, J., Zheng, H., Xu, X., Wang, L., Hu, Q., Guo, Y.: Adaptive sparse memory networks for efficient and robust video object segmentation. IEEE Trans. Neural Netw. Learn. Syst. (2024)","DOI":"10.1109\/TNNLS.2024.3357118"},{"key":"19_CR12","series-title":"Communications in Computer and Information Science","doi-asserted-by":"publisher","first-page":"19","DOI":"10.1007\/978-3-030-50726-8_3","volume-title":"HCI International 2020 - Posters","author":"D Eger Passos","year":"2020","unstructured":"Eger Passos, D., Jung, B.: Measuring the accuracy of inside-out tracking in XR devices using a high-precision robotic arm. In: Stephanidis, C., Antona, M. (eds.) HCII 2020. CCIS, vol. 1224, pp. 19\u201326. Springer, Cham (2020). https:\/\/doi.org\/10.1007\/978-3-030-50726-8_3"},{"key":"19_CR13","unstructured":"Fang, R., et al.: Instructseq: unifying vision tasks with instruction-conditioned multi-modal sequence generation. arXiv preprint arXiv:2311.18835 (2023)"},{"key":"19_CR14","unstructured":"Guo, P., et al.: Clickvos: click video object segmentation. arXiv preprint arXiv:2403.06130 (2024)"},{"key":"19_CR15","unstructured":"Guo, P., et al.: Openvis: open-vocabulary video instance segmentation. arXiv preprint arXiv:2305.16835 (2023)"},{"key":"19_CR16","doi-asserted-by":"publisher","first-page":"7063","DOI":"10.1109\/TIP.2022.3219230","volume":"31","author":"P Guo","year":"2022","unstructured":"Guo, P., Zhang, W., Li, X., Zhang, W.: Adaptive online mutual learning bi-decoders for video object segmentation. IEEE Trans. Image Process. 31, 7063\u20137077 (2022)","journal-title":"IEEE Trans. Image Process."},{"key":"19_CR17","unstructured":"Hendrycks, D., Gimpel, K.: Gaussian error linear units (gelus). arXiv preprint arXiv:1606.08415 (2016)"},{"key":"19_CR18","doi-asserted-by":"crossref","unstructured":"Hong, L., et\u00a0al.: Onetracker: unifying visual object tracking with foundation models and efficient tuning. In: Proceedings of the IEEE\/CVF Conference on Computer Vision and Pattern Recognition, pp. 19079\u201319091 (2024)","DOI":"10.1109\/CVPR52733.2024.01805"},{"key":"19_CR19","doi-asserted-by":"crossref","unstructured":"Hu, L., Zhang, P., Zhang, B., Pan, P., Xu, Y., Jin, R.: Learning position and target consistency for memory-based video object segmentation. In: Proceedings of the IEEE\/CVF Conference on Computer Vision and Pattern Recognition, pp. 4144\u20134154 (2021)","DOI":"10.1109\/CVPR46437.2021.00413"},{"key":"19_CR20","unstructured":"Iqbal, E., Safarov, S., Bang, S.: Msanet: multi-similarity and attention guidance for boosting few-shot segmentation. arXiv preprint arXiv:2206.09667 (2022)"},{"key":"19_CR21","doi-asserted-by":"publisher","first-page":"2364","DOI":"10.1109\/TIP.2021.3052073","volume":"30","author":"H Jiang","year":"2021","unstructured":"Jiang, H., et al.: Cubemap-based perception-driven blind quality assessment for 360-degree images. IEEE Trans. Image Process. 30, 2364\u20132377 (2021)","journal-title":"IEEE Trans. Image Process."},{"issue":"6","key":"19_CR22","doi-asserted-by":"publisher","first-page":"632","DOI":"10.1080\/17483107.2019.1688398","volume":"16","author":"TA Jost","year":"2021","unstructured":"Jost, T.A., Nelson, B., Rylander, J.: Quantitative analysis of the oculus rift s in controlled movement. Disabil. Rehabil. Assist. Technol. 16(6), 632\u2013636 (2021)","journal-title":"Disabil. Rehabil. Assist. Technol."},{"key":"19_CR23","unstructured":"Kirillov, A., et\u00a0al.: Segment anything. arXiv preprint arXiv:2304.02643 (2023)"},{"key":"19_CR24","doi-asserted-by":"crossref","unstructured":"Li, M., Hu, L., Xiong, Z., Zhang, B., Pan, P., Liu, D.: Recurrent dynamic embedding for video object segmentation. In: Proceedings of the IEEE\/CVF Conference on Computer Vision and Pattern Recognition, pp. 1332\u20131341 (2022)","DOI":"10.1109\/CVPR52688.2022.00139"},{"key":"19_CR25","doi-asserted-by":"crossref","unstructured":"Li, W., Fan, J., Guo, P., Hong, L., Zhang, W.: Hfvos: history-future integrated dynamic memory for video object segmentation. IEEE Trans. Circuits Syst. Video Technol. (2024)","DOI":"10.1109\/TCSVT.2024.3404469"},{"key":"19_CR26","doi-asserted-by":"crossref","unstructured":"Li, W., et al.: Onevos: unifying video object segmentation with all-in-one transformer framework. arXiv preprint arXiv:2403.08682 (2024)","DOI":"10.1007\/978-3-031-73636-0_2"},{"key":"19_CR27","doi-asserted-by":"crossref","unstructured":"Li, X., Cao, H., Zhao, S., Li, J., Zhang, L., Raj, B.: Panoramic video salient object detection with ambisonic audio guidance. arXiv preprint arXiv:2211.14419 (2022)","DOI":"10.1609\/aaai.v37i2.25227"},{"key":"19_CR28","doi-asserted-by":"crossref","unstructured":"Li, X., Wang, J., Xu, X., Li, X., Raj, B., Lu, Y.: Robust referring video object segmentation with cyclic structural consensus. In: Proceedings of the IEEE\/CVF International Conference on Computer Vision, pp. 22236\u201322245 (2023)","DOI":"10.1109\/ICCV51070.2023.02032"},{"key":"19_CR29","doi-asserted-by":"crossref","unstructured":"Li, X., et al.: Qdformer: towards robust audiovisual segmentation in complex environments with quantization-based semantic decomposition. In: Proceedings of the IEEE\/CVF Conference on Computer Vision and Pattern Recognition, pp. 3402\u20133413 (2024)","DOI":"10.1109\/CVPR52733.2024.00327"},{"key":"19_CR30","doi-asserted-by":"crossref","unstructured":"Li, X., et al.: Towards noise-tolerant speech-referring video object segmentation: bridging speech and text. In: Proceedings of the 2023 Conference on Empirical Methods in Natural Language Processing, pp. 2283\u20132296 (2023)","DOI":"10.18653\/v1\/2023.emnlp-main.140"},{"key":"19_CR31","doi-asserted-by":"crossref","unstructured":"Liang, S., Shen, X., Huang, J., Hua, X.S.: Video object segmentation with dynamic memory networks and adaptive object alignment. In: Proceedings of the IEEE\/CVF International Conference on Computer Vision, pp. 8065\u20138074 (2021)","DOI":"10.1109\/ICCV48922.2021.00796"},{"key":"19_CR32","unstructured":"Liang, Y., Li, X., Jafari, N., Chen, J.: Video object segmentation with adaptive feature bank and uncertain-region refinement. In: Advances in Neural Information Processing Systems, vol. 33, pp. 3430\u20133441 (2020)"},{"key":"19_CR33","series-title":"Lecture Notes in Computer Science","doi-asserted-by":"publisher","first-page":"740","DOI":"10.1007\/978-3-319-10602-1_48","volume-title":"Computer Vision \u2013 ECCV 2014","author":"T-Y Lin","year":"2014","unstructured":"Lin, T.-Y., et al.: Microsoft COCO: common objects in context. In: Fleet, D., Pajdla, T., Schiele, B., Tuytelaars, T. (eds.) ECCV 2014. LNCS, vol. 8693, pp. 740\u2013755. Springer, Cham (2014). https:\/\/doi.org\/10.1007\/978-3-319-10602-1_48"},{"key":"19_CR34","series-title":"Lecture Notes in Computer Science","doi-asserted-by":"publisher","first-page":"648","DOI":"10.1007\/978-3-031-19818-2_37","volume-title":"Computer Vision - ECCV 2022","author":"Y Liu","year":"2022","unstructured":"Liu, Y., et al.: Global spectral filter memory network for video object segmentation. In: Avidan, S., Brostow, G., Ciss\u00e9, M., Farinella, G.M., Hassner, T. (eds.) ECCV 2022. LNCS, vol. 13689, pp. 648\u2013665. Springer, Cham (2022). https:\/\/doi.org\/10.1007\/978-3-031-19818-2_37"},{"key":"19_CR35","doi-asserted-by":"crossref","unstructured":"Ma, C., Zhang, J., Yang, K., Roitberg, A., Stiefelhagen, R.: Densepass: dense panoramic semantic segmentation via unsupervised domain adaptation with attention-augmented context exchange. In: 2021 IEEE International Intelligent Transportation Systems Conference (ITSC), pp. 2766\u20132772. IEEE (2021)","DOI":"10.1109\/ITSC48978.2021.9564920"},{"issue":"6","key":"19_CR36","doi-asserted-by":"publisher","first-page":"1515","DOI":"10.1109\/TPAMI.2018.2838670","volume":"41","author":"KK Maninis","year":"2018","unstructured":"Maninis, K.K., et al.: Video object segmentation without temporal information. IEEE Trans. Pattern Anal. Mach. Intell. 41(6), 1515\u20131530 (2018)","journal-title":"IEEE Trans. Pattern Anal. Mach. Intell."},{"key":"19_CR37","doi-asserted-by":"crossref","unstructured":"Mao, Y., Wang, N., Zhou, W., Li, H.: Joint inductive and transductive learning for video object segmentation. In: Proceedings of the IEEE\/CVF International Conference on Computer Vision, pp. 9670\u20139679 (2021)","DOI":"10.1109\/ICCV48922.2021.00953"},{"key":"19_CR38","series-title":"Lecture Notes in Computer Science","doi-asserted-by":"publisher","first-page":"53","DOI":"10.1007\/978-3-031-19818-2_4","volume-title":"Computer Vision - ECCV 2022","author":"J Mei","year":"2022","unstructured":"Mei, J., et al.: Waymo open dataset: panoramic video panoptic segmentation. In: Avidan, S., Brostow, G., Ciss\u00e9, M., Farinella, G.M., Hassner, T. (eds.) ECCV 2022, Part XXIX. LNCS, vol. 13689, pp. 53\u201372. Springer, Cham (2022). https:\/\/doi.org\/10.1007\/978-3-031-19818-2_4"},{"key":"19_CR39","doi-asserted-by":"crossref","unstructured":"Oh, S.W., Lee, J.Y., Sunkavalli, K., Kim, S.J.: Fast video object segmentation by reference-guided mask propagation. In: Proceedings of the IEEE Conference on Computer Vision and Pattern Recognition, pp. 7376\u20137385 (2018)","DOI":"10.1109\/CVPR.2018.00770"},{"key":"19_CR40","doi-asserted-by":"crossref","unstructured":"Oh, S.W., Lee, J.Y., Xu, N., Kim, S.J.: Video object segmentation using space-time memory networks. In: Proceedings of the IEEE\/CVF International Conference on Computer Vision, pp. 9226\u20139235 (2019)","DOI":"10.1109\/ICCV.2019.00932"},{"key":"19_CR41","doi-asserted-by":"crossref","unstructured":"Perazzi, F., Pont-Tuset, J., McWilliams, B., Van\u00a0Gool, L., Gross, M., Sorkine-Hornung, A.: A benchmark dataset and evaluation methodology for video object segmentation. In: Proceedings of the IEEE Conference on Computer Vision and Pattern Recognition, pp. 724\u2013732 (2016)","DOI":"10.1109\/CVPR.2016.85"},{"key":"19_CR42","unstructured":"Pont-Tuset, J., Perazzi, F., Caelles, S., Arbel\u00e1ez, P., Sorkine-Hornung, A., Van\u00a0Gool, L.: The 2017 Davis challenge on video object segmentation. arXiv preprint arXiv:1704.00675 (2017)"},{"key":"19_CR43","unstructured":"Raji\u010d, F., Ke, L., Tai, Y.W., Tang, C.K., Danelljan, M., Yu, F.: Segment anything meets point tracking. arXiv preprint arXiv:2307.01197 (2023)"},{"key":"19_CR44","series-title":"Lecture Notes in Computer Science","doi-asserted-by":"publisher","first-page":"629","DOI":"10.1007\/978-3-030-58542-6_38","volume-title":"Computer Vision \u2013 ECCV 2020","author":"H Seong","year":"2020","unstructured":"Seong, H., Hyun, J., Kim, E.: Kernelized memory network for video object segmentation. In: Vedaldi, A., Bischof, H., Brox, T., Frahm, J.-M. (eds.) ECCV 2020. LNCS, vol. 12367, pp. 629\u2013645. Springer, Cham (2020). https:\/\/doi.org\/10.1007\/978-3-030-58542-6_38"},{"issue":"4","key":"19_CR45","doi-asserted-by":"publisher","first-page":"717","DOI":"10.1109\/TPAMI.2015.2465960","volume":"38","author":"J Shi","year":"2015","unstructured":"Shi, J., Yan, Q., Xu, L., Jia, J.: Hierarchical image saliency detection on extended CSSD. IEEE Trans. Pattern Anal. Mach. Intell. 38(4), 717\u2013729 (2015)","journal-title":"IEEE Trans. Pattern Anal. Mach. Intell."},{"key":"19_CR46","unstructured":"Vaswani, A., et al.: Attention is all you need. In: Advances in Neural Information Processing Systems, vol. 30 (2017)"},{"key":"19_CR47","doi-asserted-by":"crossref","unstructured":"Voigtlaender, P., Leibe, B.: Online adaptation of convolutional neural networks for video object segmentation. arXiv preprint arXiv:1706.09364 (2017)","DOI":"10.5244\/C.31.116"},{"key":"19_CR48","doi-asserted-by":"crossref","unstructured":"Wang, H., Jiang, X., Ren, H., Hu, Y., Bai, S.: Swiftnet: real-time video object segmentation. In: Proceedings of the IEEE\/CVF Conference on Computer Vision and Pattern Recognition, pp. 1296\u20131305 (2021)","DOI":"10.1109\/CVPR46437.2021.00135"},{"key":"19_CR49","unstructured":"Wang, W., Zhou, T., Porikli, F., Crandall, D., Van\u00a0Gool, L.: A survey on deep learning technique for video segmentation. arXiv preprint arXiv:2107.01153 (2021)"},{"key":"19_CR50","doi-asserted-by":"crossref","unstructured":"Xiao, H., Feng, J., Lin, G., Liu, Y., Zhang, M.: Monet: deep motion exploitation for video object segmentation. In: Proceedings of the IEEE Conference on Computer Vision and Pattern Recognition, pp. 1140\u20131148 (2018)","DOI":"10.1109\/CVPR.2018.00125"},{"key":"19_CR51","doi-asserted-by":"crossref","unstructured":"Xie, H., Yao, H., Zhou, S., Zhang, S., Sun, W.: Efficient regional memory network for video object segmentation. In: Proceedings of the IEEE\/CVF Conference on Computer Vision and Pattern Recognition, pp. 1286\u20131295 (2021)","DOI":"10.1109\/CVPR46437.2021.00134"},{"key":"19_CR52","unstructured":"Xu, N., et al.: Youtube-vos: a large-scale video object segmentation benchmark. arXiv preprint arXiv:1809.03327 (2018)"},{"key":"19_CR53","doi-asserted-by":"crossref","unstructured":"Xu, X., Wang, J., Li, X., Lu, Y.: Reliable propagation-correction modulation for video object segmentation. In: Proceedings of the AAAI Conference on Artificial Intelligence, pp. 2946\u20132954 (2022)","DOI":"10.1609\/aaai.v36i3.20200"},{"key":"19_CR54","doi-asserted-by":"crossref","unstructured":"Xu, X., Wang, J., Ming, X., Lu, Y.: Towards robust video object segmentation with adaptive object calibration. In: Proceedings of the 30th ACM International Conference on Multimedia, pp. 2709\u20132718 (2022)","DOI":"10.1145\/3503161.3547824"},{"key":"19_CR55","unstructured":"Xu, X., et al.: Customizable perturbation synthesis for robust slam benchmarking. arXiv preprint arXiv:2402.08125 (2024)"},{"key":"19_CR56","doi-asserted-by":"crossref","unstructured":"Yan, S., et al.: Referred by multi-modality: a unified temporal transformer for video object segmentation. In: Proceedings of the AAAI Conference on Artificial Intelligence, vol.\u00a038, pp. 6449\u20136457 (2024)","DOI":"10.1609\/aaai.v38i6.28465"},{"key":"19_CR57","series-title":"Lecture Notes in Computer Science","doi-asserted-by":"publisher","first-page":"332","DOI":"10.1007\/978-3-030-58558-7_20","volume-title":"Computer Vision \u2013 ECCV 2020","author":"Z Yang","year":"2020","unstructured":"Yang, Z., Wei, Y., Yang, Y.: Collaborative video object segmentation by foreground-background integration. In: Vedaldi, A., Bischof, H., Brox, T., Frahm, J.-M. (eds.) ECCV 2020. LNCS, vol. 12350, pp. 332\u2013348. Springer, Cham (2020). https:\/\/doi.org\/10.1007\/978-3-030-58558-7_20"},{"key":"19_CR58","unstructured":"Yang, Z., Wei, Y., Yang, Y.: Associating objects with transformers for video object segmentation. In: Advances in Neural Information Processing Systems, vol. 34, pp. 2491\u20132502 (2021)"},{"key":"19_CR59","doi-asserted-by":"crossref","unstructured":"Yang, Z., Wei, Y., Yang, Y.: Collaborative video object segmentation by multi-scale foreground-background integration. IEEE Trans. Pattern Anal. Mach. Intell. (2021)","DOI":"10.1109\/TPAMI.2021.3081597"},{"key":"19_CR60","unstructured":"Yuan, M., Richardt, C.: 360 optical flow using tangent images. In: British Machine Vision Conference (BMVC) (2021)"},{"key":"19_CR61","unstructured":"Zhang, R., et al.: Personalize segment anything model with one shot. arXiv preprint arXiv:2305.03048 (2023)"},{"key":"19_CR62","unstructured":"Zhang, Y., Zhang, L., Wang, K., Hamidouche, W., Deforges, O.: Shd360: a benchmark dataset for salient human detection in 360 videos. arXiv preprint arXiv:2105.11578 (2021)"},{"key":"19_CR63","doi-asserted-by":"crossref","unstructured":"Zhang, Y., Wu, Z., Peng, H., Lin, S.: A transductive approach for video object segmentation. In: Proceedings of the IEEE\/CVF Conference on Computer Vision and Pattern Recognition, pp. 6949\u20136958 (2020)","DOI":"10.1109\/CVPR42600.2020.00698"},{"key":"19_CR64","series-title":"Lecture Notes in Computer Science","doi-asserted-by":"publisher","first-page":"504","DOI":"10.1007\/978-3-030-01234-2_30","volume-title":"Computer Vision \u2013 ECCV 2018","author":"Z Zhang","year":"2018","unstructured":"Zhang, Z., Xu, Y., Yu, J., Gao, S.: Saliency detection in 360$$^\\circ $$ videos. In: Ferrari, V., Hebert, M., Sminchisescu, C., Weiss, Y. (eds.) ECCV 2018. LNCS, vol. 11211, pp. 504\u2013520. Springer, Cham (2018). https:\/\/doi.org\/10.1007\/978-3-030-01234-2_30"}],"container-title":["Lecture Notes in Computer Science","Computer Vision \u2013 ECCV 2024"],"original-title":[],"language":"en","link":[{"URL":"https:\/\/link.springer.com\/content\/pdf\/10.1007\/978-3-031-72673-6_19","content-type":"unspecified","content-version":"vor","intended-application":"similarity-checking"}],"deposited":{"date-parts":[[2024,11,30]],"date-time":"2024-11-30T00:03:16Z","timestamp":1732924996000},"score":1,"resource":{"primary":{"URL":"https:\/\/link.springer.com\/10.1007\/978-3-031-72673-6_19"}},"subtitle":[],"short-title":[],"issued":{"date-parts":[[2024,10,22]]},"ISBN":["9783031726729","9783031726736"],"references-count":64,"URL":"https:\/\/doi.org\/10.1007\/978-3-031-72673-6_19","relation":{},"ISSN":["0302-9743","1611-3349"],"issn-type":[{"type":"print","value":"0302-9743"},{"type":"electronic","value":"1611-3349"}],"subject":[],"published":{"date-parts":[[2024,10,22]]},"assertion":[{"value":"22 October 2024","order":1,"name":"first_online","label":"First Online","group":{"name":"ChapterHistory","label":"Chapter History"}},{"value":"ECCV","order":1,"name":"conference_acronym","label":"Conference Acronym","group":{"name":"ConferenceInfo","label":"Conference Information"}},{"value":"European Conference on Computer Vision","order":2,"name":"conference_name","label":"Conference Name","group":{"name":"ConferenceInfo","label":"Conference Information"}},{"value":"Milan","order":3,"name":"conference_city","label":"Conference City","group":{"name":"ConferenceInfo","label":"Conference Information"}},{"value":"Italy","order":4,"name":"conference_country","label":"Conference Country","group":{"name":"ConferenceInfo","label":"Conference Information"}},{"value":"2024","order":5,"name":"conference_year","label":"Conference Year","group":{"name":"ConferenceInfo","label":"Conference Information"}},{"value":"29 September 2024","order":7,"name":"conference_start_date","label":"Conference Start Date","group":{"name":"ConferenceInfo","label":"Conference Information"}},{"value":"4 October 2024","order":8,"name":"conference_end_date","label":"Conference End Date","group":{"name":"ConferenceInfo","label":"Conference Information"}},{"value":"18","order":9,"name":"conference_number","label":"Conference Number","group":{"name":"ConferenceInfo","label":"Conference Information"}},{"value":"eccv2024","order":10,"name":"conference_id","label":"Conference ID","group":{"name":"ConferenceInfo","label":"Conference Information"}},{"value":"https:\/\/eccv2024.ecva.net\/","order":11,"name":"conference_url","label":"Conference URL","group":{"name":"ConferenceInfo","label":"Conference Information"}}]}}