{"status":"ok","message-type":"work","message-version":"1.0.0","message":{"indexed":{"date-parts":[[2026,2,2]],"date-time":"2026-02-02T22:13:41Z","timestamp":1770070421202,"version":"3.49.0"},"reference-count":62,"publisher":"Springer Science and Business Media LLC","issue":"15","license":[{"start":{"date-parts":[[2019,4,9]],"date-time":"2019-04-09T00:00:00Z","timestamp":1554768000000},"content-version":"tdm","delay-in-days":0,"URL":"http:\/\/www.springer.com\/tdm"}],"content-domain":{"domain":["link.springer.com"],"crossmark-restriction":false},"short-container-title":["Multimed Tools Appl"],"published-print":{"date-parts":[[2019,8]]},"DOI":"10.1007\/s11042-019-7430-x","type":"journal-article","created":{"date-parts":[[2019,4,9]],"date-time":"2019-04-09T22:41:09Z","timestamp":1554849669000},"page":"22077-22098","update-policy":"https:\/\/doi.org\/10.1007\/springer_crossmark_policy","source":"Crossref","is-referenced-by-count":12,"title":["Semantic segmentation using reinforced fully convolutional densenet with multiscale kernel"],"prefix":"10.1007","volume":"78","author":[{"given":"Sourour","family":"Brahimi","sequence":"first","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]},{"given":"Najib","family":"Ben Aoun","sequence":"additional","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]},{"given":"Alexandre","family":"Benoit","sequence":"additional","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]},{"given":"Patrick","family":"Lambert","sequence":"additional","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]},{"given":"Chokri","family":"Ben Amar","sequence":"additional","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]}],"member":"297","published-online":{"date-parts":[[2019,4,9]]},"reference":[{"key":"7430_CR1","unstructured":"Abadi M, Agarwal A, Barham P, Brevdo E, Chen Z, Citro C, Ghemawat S Tensorflow: Large-scale machine learning on heterogeneous distributed systems. Publicly available at: https:\/\/tensorflow.org"},{"key":"7430_CR2","unstructured":"Alhaija H-A, Mustikovela S-K, Mescheder L, Geiger A, Rother C (2017) Augmented reality meets deep learning for car instance segmentation in urban scenes. In: British machine vision conference, vol 3"},{"key":"7430_CR3","unstructured":"Audebert N, Le Saux B, Lefevre S (2016) Semantic segmentation of earth observation data using multimodal and multi-scale deep networks. In: Asian conference on computer vision, pp 180\u2013196"},{"key":"7430_CR4","unstructured":"Badrinarayanan V, Kendall A, Cipolla R (2015) Segnet: a deep convolutional encoder-decoder architecture for image segmentation. arXiv: 1511.00561,2015"},{"issue":"10","key":"7430_CR5","doi-asserted-by":"publisher","first-page":"2297","DOI":"10.1016\/j.patcog.2008.11.027","volume":"42","author":"K-J Batenburg","year":"2009","unstructured":"Batenburg K-J, Sijbers J (2009) Adaptive thresholding of tomograms by projection distance minimization. Pattern Recogn 42(10):2297\u20132305","journal-title":"Pattern Recogn"},{"issue":"5","key":"7430_CR6","doi-asserted-by":"publisher","first-page":"676","DOI":"10.1109\/TMI.2008.2010437","volume":"28","author":"K-J Batenburg","year":"2009","unstructured":"Batenburg K-J, Sijbers J (2009) Optimal threshold selection for tomogram segmentation by projection distance minimization. IEEE Trans Med Imaging 28 (5):676\u2013686","journal-title":"IEEE Trans Med Imaging"},{"issue":"4","key":"7430_CR7","doi-asserted-by":"publisher","first-page":"1249","DOI":"10.1007\/s11042-014-2123-y","volume":"74","author":"O Ben Ahmed","year":"2014","unstructured":"Ben Ahmed O, Benois-Pineau J, Allard M, Ben Amar C, Catheline G (2014) Classification of Alzheimer\u2019s disease subjects from MRI using hippocampal visual features. Multimedia Tools and Applications 74(4):1249\u20131266","journal-title":"Multimedia Tools and Applications"},{"key":"7430_CR8","doi-asserted-by":"crossref","unstructured":"Ben Aoun N, Elarbi M, Ben Amar C (2010) Multiresolution motion estimation and compensation for video coding. In: ICSP, pp 1121\u20131124","DOI":"10.1109\/ICOSP.2010.5655869"},{"key":"7430_CR9","doi-asserted-by":"crossref","unstructured":"Ben Aoun N, Elghazel H, Ben Amar C (2011) Graph modeling based video event detection. In: IIT, pp 114\u2013117","DOI":"10.1109\/INNOVATIONS.2011.5893799"},{"key":"7430_CR10","doi-asserted-by":"crossref","unstructured":"Ben Aoun N, Elghazel H, Hacid M-S, Ben Amar C (2011) Graph aggregation based image modeling and indexing for video annotation. In: CAIP, pp 324\u2013331","DOI":"10.1007\/978-3-642-23678-5_38"},{"key":"7430_CR11","doi-asserted-by":"crossref","unstructured":"Ben Aoun N, Elarbi M, Ben Amar C (2012) Wavelet transform based motion estimation and compensation for video coding. Advances in Wavelet Theory and Their Applications in Engineering, Physics and Technology, Dr. Dumitru Baleanu (Ed.), 23\u201340","DOI":"10.5772\/35998"},{"issue":"2","key":"7430_CR12","doi-asserted-by":"publisher","first-page":"329","DOI":"10.1016\/j.jvcir.2013.11.003","volume":"25","author":"N Ben Aoun","year":"2014","unstructured":"Ben Aoun N, Mejdoub M, Ben Amar C (2014) Graph-based approach for human action recognition using spatio-temporal features. J Vis Commun Image Represent 25 (2):329\u2013338","journal-title":"J Vis Commun Image Represent"},{"key":"7430_CR13","unstructured":"Ben Aoun N, Mejdoub M, Ben Amar C (2014) Graph-based video event recognition. In: ICASSP, pp 1566\u20131570"},{"key":"7430_CR14","doi-asserted-by":"publisher","first-page":"337","DOI":"10.1016\/j.neucom.2018.11.031","volume":"330","author":"S Brahimi","year":"2018","unstructured":"Brahimi S, Ben Aoun N, Ben Amar C (2018) Boosted convolutional neural network for object recognition at large scale. NeuroComputing 330:337\u2013354","journal-title":"NeuroComputing"},{"key":"7430_CR15","unstructured":"Brahimi S, Ben Aoun N, Ben amar c (2016) Improved very deep recurrent convolutional neural network for object recognition. In: SMC, pp 2497\u20132502"},{"key":"7430_CR16","doi-asserted-by":"crossref","unstructured":"Brahimi S, Ben Aoun N, Ben amar c (2016) Very deep recurrent convolutional neural network for object recognition. In: ICMV","DOI":"10.1117\/12.2268672"},{"key":"7430_CR17","doi-asserted-by":"crossref","unstructured":"Brahimi S, Ben Aoun N, Ben Amar C, Benoit A, Lambert P (2018) Multiscale fully convolutional densenet for semantic segmentation. In: International conference on computer graphics, visualization and computer vision","DOI":"10.24132\/JWSCG.2018.26.2.5"},{"issue":"2","key":"7430_CR18","doi-asserted-by":"publisher","first-page":"88","DOI":"10.1016\/j.patrec.2008.04.005","volume":"30","author":"G-J Brostow","year":"2009","unstructured":"Brostow G-J, Fauqueur J, Cipolla R (2009) Semantic object classes in video: a high-definition ground truth database. Pattern Recogn Lett 30(2):88\u201397","journal-title":"Pattern Recogn Lett"},{"key":"7430_CR19","unstructured":"Chen B-K, Gong C, Yang J (2017) Importance-aware semantic segmentation for autonomous driving system. In: Proceedings of the international joint conference on artificial intelligence, pp 1504\u20131510"},{"key":"7430_CR20","unstructured":"Chen L-C, Barron J-T, Papandreou G, Murphy K, Yuille A-L (2016) Semantic image segmentation with task-specific edge detection using cnns and a discriminatively trained domain transform. In: IEEE conference on computer vision and pattern recognition, pp 4545\u20134554"},{"key":"7430_CR21","unstructured":"Chen L-C, Papandreou G, Kokkinos I, Murphy K, Yuille A-L (2014) Deeplab: semantic image segmentation with deep convolutional nets, atrous convolution, and fully connected CRFs. arXiv: 1606.00915"},{"key":"7430_CR22","unstructured":"Cordts M, Omran M, Ramos S, Scharwachter T, Enzweiler T, Benenson R, Franke U, Roth S, Schiele B (2015) The cityscapes dataset. In: CVPR workshop on the future of datasets in vision"},{"key":"7430_CR23","unstructured":"Dinarelli M, Tellier I (2016) Improving recurrent neural networks for sequence labelling. arXiv: 1606.02555"},{"key":"7430_CR24","doi-asserted-by":"crossref","unstructured":"Boughrara H, Chtourou M, Ben Amar C (2012) MLP neural network based face recognition system using constructive training algorithm. In: International conference on multimedia computing and systems (ICMCS), pp 233\u2013238","DOI":"10.1109\/ICMCS.2012.6320263"},{"key":"7430_CR25","doi-asserted-by":"crossref","unstructured":"El\u2019Arbi M, Ben Amar C, Nicolas H (2006) Video watermarking based on neural networks. In: IEEE international conference on multimedia and expo (ICME), pp 1577\u20131580","DOI":"10.1109\/ICME.2006.262846"},{"issue":"4","key":"7430_CR26","doi-asserted-by":"publisher","first-page":"239","DOI":"10.1049\/iet-ipr.2013.0104","volume":"8","author":"A Fabijanska","year":"2014","unstructured":"Fabijanska A, Goclawski J (2014) New accelerated graph-based method of image segmentation applying minimum spanning tree. IET Image Process 8(4):239\u2013251","journal-title":"IET Image Process"},{"key":"7430_CR27","unstructured":"Gao H, Zhuang L, Kilian Q-W (2016) Densely connected convolutional networks. arXiv: 1608.06993v3"},{"key":"7430_CR28","unstructured":"Garcia-Garcia A, Orts-Escolano S, Oprea S, Villena-Martinez V, Garcia-Rodriguez J (2017) A review on deep learning techniques applied to semantic segmentation. arXiv: 1704.06857"},{"key":"7430_CR29","doi-asserted-by":"crossref","unstructured":"Guedri B, Zaied M, Ben Amar C (2011) Indexing and images retrieval by content. In: International conference on high performance computing and simulation (HPCS), pp 369\u2013375","DOI":"10.1109\/HPCSim.2011.5999848"},{"key":"7430_CR30","doi-asserted-by":"crossref","unstructured":"He K, Zhang X, Ren S, Sun J (2015) Delving deep into rectifiers: Surpassing human-level performance on imagenet classification. In: Proceedings of the IEEE international conference on computer vision, pp 1026\u20131034","DOI":"10.1109\/ICCV.2015.123"},{"key":"7430_CR31","doi-asserted-by":"crossref","unstructured":"He K, Zhang X, Ren S, Sun J (2016) Deep residual learning for image recognition. In: Proceedings of the IEEE conference on computer vision and pattern recognition, pp 770\u2013778","DOI":"10.1109\/CVPR.2016.90"},{"key":"7430_CR32","doi-asserted-by":"crossref","unstructured":"J\u00e9gou S, Drozdzal M, Vazquez D, Romero A, Bengio Y (2017, July) The one hundred layers tiramisu: fully convolutional densenets for semantic segmentation. In: Computer vision and pattern recognition workshops (CVPRW), pp 1175\u20131183","DOI":"10.1109\/CVPRW.2017.156"},{"key":"7430_CR33","unstructured":"Kayalibay B, Jensen G, Smagt P (2017) CNN-based segmentation of medical imaging data. arXiv: 1701.03056v2"},{"key":"7430_CR34","unstructured":"Kendall A, Badrinarayanan V, Cipolla R (2015) Bayesian segnet: model uncertainty in deep convolutional encoder-decoder architectures for scene understanding. arXiv: 1511.02680"},{"key":"7430_CR35","unstructured":"Krizhevsky A, Sutskever I, Hinton G (2012) Imagenet classification with deep convolutional neural networks. In: NIPS, pp 1097\u20131105"},{"key":"7430_CR36","doi-asserted-by":"crossref","unstructured":"Lai S, Xu L, Liu K, Zhao J (2015, January) Recurrent convolutional neural networks for text classification. In: AAAI, vol 333, pp 2267\u20132273","DOI":"10.1609\/aaai.v29i1.9513"},{"key":"7430_CR37","doi-asserted-by":"crossref","unstructured":"Lin J, Wang W-J, Huang S-K, Chen H-C (2017) Learning based semantic segmentation for robot navigation in outdoor environment. In: Fuzzy systems association and 9th international conference on soft computing and intelligent systems (IFSA-SCIS), pp 1\u20135","DOI":"10.1109\/IFSA-SCIS.2017.8023347"},{"key":"7430_CR38","doi-asserted-by":"crossref","unstructured":"Long J, Shelhamer E, Darrell T (2015) Fully convolutional networks for semantic segmentation. In: Proceedings of the IEEE conference on computer vision and pattern recognition, pp 3431\u20133440","DOI":"10.1109\/CVPR.2015.7298965"},{"key":"7430_CR39","doi-asserted-by":"crossref","unstructured":"Mejdoub M, Fonteles L, Ben Amar C, Antonini M (2008) Fast indexing method for image retrieval using tree-structured lattices. In: International workshop on content-based multimedia indexing (CBMI), pp 365\u2013372","DOI":"10.1109\/CBMI.2008.4564970"},{"issue":"1","key":"7430_CR40","doi-asserted-by":"publisher","first-page":"75","DOI":"10.3233\/IDA-140697","volume":"19","author":"M Mejdoub","year":"2015","unstructured":"Mejdoub M, Ben Aoun N, Ben Amar C (2015) Bag of frequent subgraphs approach for image classification. Intell Data Anal 19(1):75\u201388","journal-title":"Intell Data Anal"},{"issue":"1","key":"7430_CR41","doi-asserted-by":"publisher","first-page":"149","DOI":"10.1142\/S0219691310003353","volume":"8","author":"M Othmani","year":"2010","unstructured":"Othmani M, Bellil W, Ben Amar C, Alimi AM (2010) A new structure and training procedure for multi-mother wavelet networks. Int J Wavelets Multiresolution Inf Process 8(1):149\u2013175","journal-title":"Int J Wavelets Multiresolution Inf Process"},{"key":"7430_CR42","unstructured":"Paszke A, Chaurasia A, Kim S, Culurciello E (2016) Enet: A deep neural network architecture for real-time semantic segmentation. arXiv: 1606.02147"},{"key":"7430_CR43","doi-asserted-by":"crossref","unstructured":"Pourian N, Karthikeyan S, Manjunath B-S (2015) Weakly supervised graph based semantic segmentation by learning communities of image-parts. In: Proceedings of the IEEE international conference on computer vision, pp 1359\u20131367","DOI":"10.1109\/ICCV.2015.160"},{"issue":"8","key":"7430_CR44","doi-asserted-by":"publisher","first-page":"2157","DOI":"10.1109\/TIP.2010.2045708","volume":"19","author":"A-K Qin","year":"2010","unstructured":"Qin A-K, Clausi D-A (2010) Multivariate image segmentation using semantic region growing with adaptive edge penalty. IEEE Trans Image Process 19(8):2157\u20132170","journal-title":"IEEE Trans Image Process"},{"key":"7430_CR45","unstructured":"Raza S-H, Grundmann M, Essa I (2013) Geometric context from video. In: IEEE conference on computer vision and pattern recognition (CVPR), pp 3081\u20133088"},{"issue":"3","key":"7430_CR46","doi-asserted-by":"publisher","first-page":"211","DOI":"10.1007\/s11263-015-0816-y","volume":"115","author":"O Russakovsky","year":"2015","unstructured":"Russakovsky O, Deng J, Su H, Krause J, Satheesh S, Ma S, Huang Z, Karpathy A, Khosla A, Bernstein M, Berg A-C, Fei-Fei L (2015) Imagenet large scale visual recognition challenge. Int J Comput Vis 115(3):211\u2013252","journal-title":"Int J Comput Vis"},{"key":"7430_CR47","unstructured":"Simonyan K, Zisserman A (2014) Very deep convolutional networks for large-scale image recognition. arXiv: 1409.1556"},{"key":"7430_CR48","doi-asserted-by":"crossref","unstructured":"Szegedy C, Liu W, Jia Y, Sermanet P, Reed S, Anguelov D, Erhan D, Vanhoucke V, Rabinovich A (2015) Going deeper with convolutions. In: CVPR, pp 1\u20139","DOI":"10.1109\/CVPR.2015.7298594"},{"key":"7430_CR49","unstructured":"Tieleman T, Hinton G (2012) rmsprop adaptive learning. In: COURSERA: neural networks for machine learning"},{"key":"7430_CR50","doi-asserted-by":"crossref","unstructured":"Visin F, Ciccone M, Romero A, Kastner K, Cho K, Bengio Y, Matteucci M, Courville A (2016) Reseg: a recurrent neural network-based model for semantic segmentation. In: The IEEE conference on computer vision and pattern recognition (CVPR) workshops, pp 426\u2013433","DOI":"10.1109\/CVPRW.2016.60"},{"key":"7430_CR51","unstructured":"Visin F, Kastner K, Cho K, Matteucci M, Courville A-C, Bengio Y (2015) Renet: a recurrent neural network based alternative to convolutional networks. arXiv: 1505.00393v3"},{"key":"7430_CR52","doi-asserted-by":"crossref","unstructured":"Wali A, Ben Aoun N, Karray H, Ben Amar C, Alimi AM (2010) A new system for event detection from video surveillance sequences. In: ACIVS, pp 110\u2013120","DOI":"10.1007\/978-3-642-17691-3_11"},{"key":"7430_CR53","doi-asserted-by":"crossref","unstructured":"Wan J, Wang D, Hoi S-C-H, Wu P, Zhu J, Zhang Y, Li J (2014) Deep learning for content-based image retrieval: a comprehensive study. In: ACM international conference on multimedia, pp 157\u2013166","DOI":"10.1145\/2647868.2654948"},{"key":"7430_CR54","doi-asserted-by":"crossref","unstructured":"Wang C, Yang H, Bartz C, Meinel C (2016) Image captioning with deep bidirectional LSTMs. In: Proceedings of the 2016 ACM on multimedia conference, pp 988\u2013997","DOI":"10.1145\/2964284.2964299"},{"key":"7430_CR55","doi-asserted-by":"crossref","unstructured":"Wang C, Yang H, Meinel C (2015) Deep semantic mapping for cross-modal retrieval. In: Tools with artificial intelligence (ICTAI), pp 234\u2013241","DOI":"10.1109\/ICTAI.2015.45"},{"key":"7430_CR56","unstructured":"Wang C, Yang H, Meinel C (2016) Exploring multimodal video representation for action recognition. In: Neural networks (IJCNN), pp 1924\u20131931"},{"issue":"2s","key":"7430_CR57","first-page":"40:1","volume":"14","author":"C Wang","year":"2018","unstructured":"Wang C, Yang H, Meinel C (2018) Image captioning with deep bidirectional LSTMs and multi-task learning. ACM Transactions on Multimedia Computing, Communications, and Applications (TOMM) 14(2s):40:1\u201340:20","journal-title":"ACM Transactions on Multimedia Computing, Communications, and Applications (TOMM)"},{"key":"7430_CR58","unstructured":"Wu Z, Shen C, Hengel A-V-D (2016) Wider or deeper: revisiting the resnet model for visual recognition. arXiv: 1611.10080"},{"key":"7430_CR59","unstructured":"Yu F, Koltun V (2015) Multi-scale context aggregation by dilated convolutions. arXiv: 1511.07122"},{"key":"7430_CR60","doi-asserted-by":"crossref","unstructured":"Zhang K, Zhang W, Zeng S, Xue X (2014) Semantic segmentation using multiple graphs with Block-Diagonal constraints. In: AAAI, pp 2867\u20132873","DOI":"10.1609\/aaai.v28i1.9141"},{"key":"7430_CR61","doi-asserted-by":"crossref","unstructured":"Zhao H, Shi J, Qi X, Wang X, Jia J (2017) Pyramid scene parsing network. In: IEEE conference on computer vision and pattern recognition (CVPR), pp 2881\u20132890","DOI":"10.1109\/CVPR.2017.660"},{"key":"7430_CR62","doi-asserted-by":"crossref","unstructured":"Zou W, Kpalma K, Ronsin J (2012) Semantic segmentation via sparse coding over hierarchical regions. In: Image processing (ICIP), pp 2577\u20132580","DOI":"10.1109\/ICIP.2012.6467425"}],"container-title":["Multimedia Tools and Applications"],"original-title":[],"language":"en","link":[{"URL":"http:\/\/link.springer.com\/content\/pdf\/10.1007\/s11042-019-7430-x.pdf","content-type":"application\/pdf","content-version":"vor","intended-application":"text-mining"},{"URL":"http:\/\/link.springer.com\/article\/10.1007\/s11042-019-7430-x\/fulltext.html","content-type":"text\/html","content-version":"vor","intended-application":"text-mining"},{"URL":"http:\/\/link.springer.com\/content\/pdf\/10.1007\/s11042-019-7430-x.pdf","content-type":"application\/pdf","content-version":"vor","intended-application":"similarity-checking"}],"deposited":{"date-parts":[[2022,9,15]],"date-time":"2022-09-15T16:21:35Z","timestamp":1663258895000},"score":1,"resource":{"primary":{"URL":"http:\/\/link.springer.com\/10.1007\/s11042-019-7430-x"}},"subtitle":[],"short-title":[],"issued":{"date-parts":[[2019,4,9]]},"references-count":62,"journal-issue":{"issue":"15","published-print":{"date-parts":[[2019,8]]}},"alternative-id":["7430"],"URL":"https:\/\/doi.org\/10.1007\/s11042-019-7430-x","relation":{},"ISSN":["1380-7501","1573-7721"],"issn-type":[{"value":"1380-7501","type":"print"},{"value":"1573-7721","type":"electronic"}],"subject":[],"published":{"date-parts":[[2019,4,9]]},"assertion":[{"value":"21 February 2018","order":1,"name":"received","label":"Received","group":{"name":"ArticleHistory","label":"Article History"}},{"value":"28 December 2018","order":2,"name":"revised","label":"Revised","group":{"name":"ArticleHistory","label":"Article History"}},{"value":"25 February 2019","order":3,"name":"accepted","label":"Accepted","group":{"name":"ArticleHistory","label":"Article History"}},{"value":"9 April 2019","order":4,"name":"first_online","label":"First Online","group":{"name":"ArticleHistory","label":"Article History"}}]}}