{"status":"ok","message-type":"work","message-version":"1.0.0","message":{"indexed":{"date-parts":[[2026,7,6]],"date-time":"2026-07-06T10:47:47Z","timestamp":1783334867043,"version":"3.54.6"},"publisher-location":"Cham","reference-count":92,"publisher":"Springer International Publishing","isbn-type":[{"value":"9783030688202","type":"print"},{"value":"9783030688219","type":"electronic"}],"license":[{"start":{"date-parts":[[2021,1,1]],"date-time":"2021-01-01T00:00:00Z","timestamp":1609459200000},"content-version":"tdm","delay-in-days":0,"URL":"http:\/\/www.springer.com\/tdm"},{"start":{"date-parts":[[2021,1,1]],"date-time":"2021-01-01T00:00:00Z","timestamp":1609459200000},"content-version":"vor","delay-in-days":0,"URL":"http:\/\/www.springer.com\/tdm"}],"content-domain":{"domain":["link.springer.com"],"crossmark-restriction":false},"short-container-title":[],"published-print":{"date-parts":[[2021]]},"DOI":"10.1007\/978-3-030-68821-9_47","type":"book-chapter","created":{"date-parts":[[2021,2,20]],"date-time":"2021-02-20T20:03:56Z","timestamp":1613851436000},"page":"571-598","update-policy":"https:\/\/doi.org\/10.1007\/springer_crossmark_policy","source":"Crossref","is-referenced-by-count":53,"title":["Visual Aware Hierarchy Based Food Recognition"],"prefix":"10.1007","author":[{"ORCID":"https:\/\/orcid.org\/0000-0002-7560-8155","authenticated-orcid":false,"given":"Runyu","family":"Mao","sequence":"first","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]},{"ORCID":"https:\/\/orcid.org\/0000-0002-8552-9880","authenticated-orcid":false,"given":"Jiangpeng","family":"He","sequence":"additional","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]},{"ORCID":"https:\/\/orcid.org\/0000-0001-8088-7497","authenticated-orcid":false,"given":"Zeman","family":"Shao","sequence":"additional","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]},{"ORCID":"https:\/\/orcid.org\/0000-0003-4729-6841","authenticated-orcid":false,"given":"Sri Kalyan","family":"Yarlagadda","sequence":"additional","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]},{"ORCID":"https:\/\/orcid.org\/0000-0002-3863-3220","authenticated-orcid":false,"given":"Fengqing","family":"Zhu","sequence":"additional","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]}],"member":"297","published-online":{"date-parts":[[2021,2,21]]},"reference":[{"key":"47_CR1","unstructured":"USDA food and nutrient database for dietary studies 2015\u20132016. Agricultural Research Service, Food Surveys Research Group (2018)"},{"key":"47_CR2","unstructured":"What we eat in america, nhanes 2015\u20132016"},{"key":"47_CR3","doi-asserted-by":"publisher","first-page":"3266","DOI":"10.1109\/TMM.2018.2831627","volume":"20","author":"E Aguilar","year":"2017","unstructured":"Aguilar, E., Remeseiro, B., Bola\u00f1os, M., Radeva, P.: Grab, pay, and eat: semantic food detection for smart restaurants. IEEE Trans. Multimed. 20, 3266\u20133275 (2017)","journal-title":"IEEE Trans. Multimed."},{"key":"47_CR4","doi-asserted-by":"crossref","unstructured":"Ahmad, Z., et al.: A mobile food record for integrated dietary assessment. In: Proceedings of the 2nd International Workshop on Multimedia Assisted Dietary Management, Amsterdam, Netherlands, pp. 53\u201362, October 2016","DOI":"10.1145\/2986035.2986038"},{"issue":"8","key":"47_CR5","doi-asserted-by":"publisher","first-page":"2176","DOI":"10.1109\/TMM.2013.2271474","volume":"15","author":"K Aizawa","year":"2013","unstructured":"Aizawa, K., Maruyama, Y., Li, H., Morikawa, C.: Food balance estimation by using personal dietary tendencies in a multimedia Food Log. IEEE Trans. Multimed. 15(8), 2176\u20132185 (2013)","journal-title":"IEEE Trans. Multimed."},{"key":"47_CR6","doi-asserted-by":"publisher","unstructured":"Alharbi, R., Pfammatter, A., Spring, B., Alshurafa, N.: Willsense: adherence barriers for passive sensing systems that track eating behavior. In: Proceedings of the 2017 CHI Conference Extended Abstracts on Human Factors in Computing Systems, pp. 2329\u20132336 (2017). https:\/\/doi.org\/10.1145\/3027063.3053271","DOI":"10.1145\/3027063.3053271"},{"issue":"3","key":"47_CR7","doi-asserted-by":"publisher","first-page":"346","DOI":"10.1016\/j.cviu.2007.09.014","volume":"110","author":"H Bay","year":"2008","unstructured":"Bay, H., Ess, A., Tuytelaars, T., Gool, L.V.: Speeded-up robust features (SURF). J. Comput. Vis. Image Underst. 110(3), 346\u2013359 (2008)","journal-title":"J. Comput. Vis. Image Underst."},{"key":"47_CR8","doi-asserted-by":"crossref","unstructured":"Beijbom, O., Joshi, N., Morris, D., Saponas, S., Khullar, S.: Menu-match: restaurant-specific food logging from images. In: 2015 IEEE Winter Conference on Applications of Computer Vision, pp. 844\u2013851 (2015)","DOI":"10.1109\/WACV.2015.117"},{"key":"47_CR9","doi-asserted-by":"crossref","unstructured":"Bola\u00f1os, M., Radeva, P.: Simultaneous food localization and recognition. In: 2016 23rd International Conference on Pattern Recognition (ICPR), pp. 3140\u20133145 (2016)","DOI":"10.1109\/ICPR.2016.7900117"},{"key":"47_CR10","doi-asserted-by":"crossref","unstructured":"Bossard, L., Guillaumin, M., Gool, L.V.: Food-101 - mining discriminative components with random forests. In: Proceedings of European Conference on Computer Vision, Zurich, Switzerland, vol. 8694, pp. 446\u2013461, September 2014","DOI":"10.1007\/978-3-319-10599-4_29"},{"issue":"3","key":"47_CR11","doi-asserted-by":"publisher","first-page":"283","DOI":"10.1017\/S0029665116002913","volume":"76","author":"CJ Boushey","year":"2017","unstructured":"Boushey, C.J., Spoden, M., Zhu, F.M., Delp, E.J., Kerr, D.A.: New mobile methods for dietary assessment: review of image-assisted and image-based dietary assessment methods. Proc. Nutr. Soc. 76(3), 283\u2013294 (2017)","journal-title":"Proc. Nutr. Soc."},{"key":"47_CR12","unstructured":"Buhrmester, M., Kwang, T., Gosling, S.D.: Amazon\u2019s mechanical Turk: a new source of inexpensive, yet high-quality data? (2016)"},{"key":"47_CR13","doi-asserted-by":"crossref","unstructured":"Casperson, S.L., Sieling, J., Moon, J., Johnson, L.K., Roemmich, J.N., Whigham, L.D.: A mobile phone food record app to digitally capture dietary intake for adolescents in a free-living environment: usability study (2015)","DOI":"10.2196\/mhealth.3324"},{"issue":"3","key":"47_CR14","doi-asserted-by":"publisher","first-page":"27","DOI":"10.1145\/1961189.1961199","volume":"2","author":"CC Chang","year":"2011","unstructured":"Chang, C.C., Lin, C.J.: LIBSVM: a library for support vector machines. ACM Trans. Intell. Syst. Technol. 2(3), 27 (2011)","journal-title":"ACM Trans. Intell. Syst. Technol."},{"key":"47_CR15","doi-asserted-by":"crossref","unstructured":"Chen, J., Ngo, C.W.: Deep-based ingredient recognition for cooking recipe retrieval. In: Proceedings of the 24th ACM International Conference on Multimedia, pp. 32\u201341 (2016)","DOI":"10.1145\/2964284.2964315"},{"key":"47_CR16","doi-asserted-by":"crossref","unstructured":"Chen, M., Dhingra, K., Wu, W., Yang, L., Sukthankar, R., Yang, J.: PFID: Pittsburgh fast-food image dataset. In: Proceedings of the IEEE International Conference on Image Processing, Cairo, Egypt, pp. 289\u2013292, November 2009","DOI":"10.1109\/ICIP.2009.5413511"},{"key":"47_CR17","doi-asserted-by":"crossref","unstructured":"Chen, M., et al.: Automatic Chinese food identification and quantity estimation. In: Proceedings of SIGGRAPH Asia Technical Briefs, Singapore, Singapore, pp. 29:1\u201329:4 (2012)","DOI":"10.1145\/2407746.2407775"},{"key":"47_CR18","doi-asserted-by":"crossref","unstructured":"Ciocca, G., Napoletano, P., Schettini, R.: Food recognition and leftover estimation for daily diet monitoring. In: New Trends in Image Analysis and Processing - ICIAP 2015 Workshops, pp. 334\u2013341 (2015)","DOI":"10.1007\/978-3-319-23222-5_41"},{"issue":"3","key":"47_CR19","doi-asserted-by":"publisher","first-page":"588","DOI":"10.1109\/JBHI.2016.2636441","volume":"21","author":"G Ciocca","year":"2017","unstructured":"Ciocca, G., Napoletano, P., Schettini, R.: Food recognition: a new dataset, experiments and results. IEEE J. Biomed. Health Inform. 21(3), 588\u2013598 (2017). https:\/\/doi.org\/10.1109\/JBHI.2016.2636441","journal-title":"IEEE J. Biomed. Health Inform."},{"issue":"3","key":"47_CR20","first-page":"273","volume":"20","author":"C Cortes","year":"1995","unstructured":"Cortes, C., Vapnik, V.: Support-vector networks. Mach. Learn. 20(3), 273\u2013297 (1995)","journal-title":"Mach. Learn."},{"key":"47_CR21","doi-asserted-by":"crossref","unstructured":"Deng, L., et al.: Mixed-dish recognition with contextual relation networks. In: Proceedings of the 27th ACM International Conference on Multimedia, pp. 112\u2013120 (2019)","DOI":"10.1145\/3343031.3351147"},{"issue":"4","key":"47_CR22","doi-asserted-by":"publisher","first-page":"1888","DOI":"10.1109\/TIP.2017.2779600","volume":"27","author":"X Deng","year":"2017","unstructured":"Deng, X., et al.: Joint hand detection and rotation estimation using CNN. IEEE Trans. Image Process. 27(4), 1888\u20131900 (2017)","journal-title":"IEEE Trans. Image Process."},{"key":"47_CR23","doi-asserted-by":"crossref","unstructured":"Ege, T., Yanai, K.: Estimating food calories for multiple-dish food photos. In: 2017 4th IAPR Asian Conference on Pattern Recognition (ACPR), pp. 646\u2013651 (2017)","DOI":"10.1109\/ACPR.2017.145"},{"issue":"2","key":"47_CR24","doi-asserted-by":"publisher","first-page":"303","DOI":"10.1007\/s11263-009-0275-4","volume":"88","author":"M Everingham","year":"2010","unstructured":"Everingham, M., Van Gool, L., Williams, C.K.I., Winn, J., Zisserman, A.: The pascal visual object classes (VOC) challenge. Int. J. Comput. Vis. 88(2), 303\u2013338 (2010)","journal-title":"Int. J. Comput. Vis."},{"key":"47_CR25","doi-asserted-by":"crossref","unstructured":"Fang, S., Liu, C., Khalid, K., Zhu, F., Boushey, C., Delp, E.J.: CTADA: the design of a crowdsourcing tool for online food image identification and segmentation. In: Proceedings of the IEEE Southwest Symposium on Image Analysis and Interpretation, Las Vegas, NV, April 2018 (2018)","DOI":"10.1109\/SSIAI.2018.8470358"},{"issue":"4","key":"47_CR26","doi-asserted-by":"publisher","first-page":"877","DOI":"10.3390\/nu11040877","volume":"11","author":"S Fang","year":"2019","unstructured":"Fang, S., Shao, Z., Kerr, D.A., Boushey, C.J., Zhu, F.: An end-to-end image-based automatic food energy estimation technique based on learned energy distribution images: protocol and methodology. Nutrients 11(4), 877 (2019)","journal-title":"Nutrients"},{"key":"47_CR27","series-title":"Lecture Notes in Computer Science","doi-asserted-by":"publisher","first-page":"584","DOI":"10.1007\/978-3-319-16199-0_41","volume-title":"Computer Vision - ECCV 2014 Workshops","author":"GM Farinella","year":"2015","unstructured":"Farinella, G.M., Allegra, D., Stanco, F.: A benchmark dataset to study the representation of food images. In: Agapito, L., Bronstein, M.M., Rother, C. (eds.) ECCV 2014. LNCS, vol. 8927, pp. 584\u2013599. Springer, Cham (2015). https:\/\/doi.org\/10.1007\/978-3-319-16199-0_41"},{"key":"47_CR28","series-title":"Lecture Notes in Computer Science","doi-asserted-by":"publisher","first-page":"375","DOI":"10.1007\/978-3-319-23222-5_46","volume-title":"New Trends in Image Analysis and Processing \u2013 ICIAP 2015 Workshops","author":"GM Farinella","year":"2015","unstructured":"Farinella, G.M., Allegra, D., Stanco, F., Battiato, S.: On the exploitation of one class classification to distinguish food vs non-food images. In: Murino, V., Puppo, E., Sona, D., Cristani, M., Sansone, C. (eds.) ICIAP 2015. LNCS, vol. 9281, pp. 375\u2013383. Springer, Cham (2015). https:\/\/doi.org\/10.1007\/978-3-319-23222-5_46"},{"key":"47_CR29","doi-asserted-by":"crossref","unstructured":"Fei-Fei, L., Perona, P.: A Bayesian hierarchical model for learning natural scene categories. In: IEEE Conference on Computer Vision and Pattern Recognition, vol. 2, pp. 524\u2013531 (2005)","DOI":"10.1109\/CVPR.2005.16"},{"issue":"5814","key":"47_CR30","doi-asserted-by":"publisher","first-page":"972","DOI":"10.1126\/science.1136800","volume":"315","author":"BJ Frey","year":"2007","unstructured":"Frey, B.J., Dueck, D.: Clustering by passing messages between data points. Science 315(5814), 972\u2013976 (2007)","journal-title":"Science"},{"key":"47_CR31","doi-asserted-by":"crossref","unstructured":"Girshick, R.: Fast R-CNN. In: Proceedings of the IEEE International Conference on Computer Vision, pp. 1440\u20131448, December 2015","DOI":"10.1109\/ICCV.2015.169"},{"key":"47_CR32","doi-asserted-by":"publisher","unstructured":"Hassannejad, H., Matrella, G., Ciampolini, P., De Munari, I., Mordonini, M., Cagnoni, S.: Food image recognition using very deep convolutional networks. In: Proceedings of the 2nd International Workshop on Multimedia Assisted Dietary Management, pp. 41\u201349 (2016). https:\/\/doi.org\/10.1145\/2986035.2986042","DOI":"10.1145\/2986035.2986042"},{"key":"47_CR33","doi-asserted-by":"crossref","unstructured":"He, J., Shao, Z., Wright, J., Kerr, D., Boushey, C., Zhu, F.: Multi-task image-based dietary assessment for food recognition and portion size estimation. arXiv preprint arXiv:2004.13188 (2020)","DOI":"10.1109\/MIPR49039.2020.00018"},{"key":"47_CR34","doi-asserted-by":"crossref","unstructured":"He, K., Gkioxari, G., Dollar, P., Girshick, R.: Mask R-CNN. In: Proceedings of the IEEE International Conference on Computer Vision, Venice, Italy, pp. 2980\u20132988, October 2017","DOI":"10.1109\/ICCV.2017.322"},{"key":"47_CR35","doi-asserted-by":"crossref","unstructured":"He, K., Zhang, X., Ren, S., Sun, J.: Deep residual learning for image recognition. In: Proceedings of the IEEE Conference on Computer Vision and Pattern Recognition, Las Vegas, NV, pp. 770\u2013778, June 2016","DOI":"10.1109\/CVPR.2016.90"},{"key":"47_CR36","doi-asserted-by":"crossref","unstructured":"He, K., Zhang, X., Ren, S., Sun, J.: Deep residual learning for image recognition. In: The IEEE Conference on Computer Vision and Pattern Recognition (CVPR), June 2016","DOI":"10.1109\/CVPR.2016.90"},{"key":"47_CR37","doi-asserted-by":"publisher","unstructured":"Hoashi, H., Joutou, T., Yanai, K.: Image recognition of 85 food categories by feature fusion. In: 2010 IEEE International Symposium on Multimedia, pp. 296\u2013301, December 2010. https:\/\/doi.org\/10.1109\/ISM.2010.51","DOI":"10.1109\/ISM.2010.51"},{"key":"47_CR38","doi-asserted-by":"crossref","unstructured":"Huang, G., Liu, Z., Van Der Maaten, L., Weinberger, K.Q.: Densely connected convolutional networks. In: Proceedings of the IEEE Conference on Computer Vision and Pattern Recognition, pp. 4700\u20134708 (2017)","DOI":"10.1109\/CVPR.2017.243"},{"key":"47_CR39","doi-asserted-by":"crossref","unstructured":"Jia, W., Yue, Y., Fernstrom, J.D., Zhang, Z., Yang, Y., Sun, M.: 3D localization of circular feature in 2D image and application to food volume estimation. In: 2012 Annual International Conference of the IEEE Engineering in Medicine and Biology Society, pp. 4545\u20134548 (2012)","DOI":"10.1109\/EMBC.2012.6346978"},{"key":"47_CR40","doi-asserted-by":"crossref","unstructured":"Jiang, H., Learned-Miller, E.: Face detection with the faster R-CNN. In: IEEE International Conference on Automatic Face & Gesture Recognition, pp. 650\u2013657 (2017)","DOI":"10.1109\/FG.2017.82"},{"key":"47_CR41","unstructured":"Joutou, T., Yanai, K.: A food image recognition system with multiple kernel learning. In: Proceedings of the IEEE International Conference on Image Processing, Cairo, Egypt, pp. 285\u2013288, October 2009"},{"key":"47_CR42","series-title":"Lecture Notes in Computer Science","doi-asserted-by":"publisher","first-page":"350","DOI":"10.1007\/978-3-319-23222-5_43","volume-title":"New Trends in Image Analysis and Processing \u2013 ICIAP 2015 Workshops","author":"H Kagaya","year":"2015","unstructured":"Kagaya, H., Aizawa, K.: Highly accurate food\/non-food image classification based on a deep convolutional neural network. In: Murino, V., Puppo, E., Sona, D., Cristani, M., Sansone, C. (eds.) ICIAP 2015. LNCS, vol. 9281, pp. 350\u2013357. Springer, Cham (2015). https:\/\/doi.org\/10.1007\/978-3-319-23222-5_43"},{"key":"47_CR43","doi-asserted-by":"crossref","unstructured":"Kagaya, H., Aizawa, K., Ogawa, M.: Food detection and recognition using convolutional neural network. In: Proceedings of the 22nd ACM International Conference on Multimedia, Orlando, Florida, USA, pp. 1085\u20131088 (2014)","DOI":"10.1145\/2647868.2654970"},{"key":"47_CR44","doi-asserted-by":"crossref","unstructured":"Kawano, Y., Yanai, K.: Automatic expansion of a food image dataset leveraging existing categories with domain adaptation. In: Proceedings of European Conference on Computer Vision Workshops, Zurich, Switzerland, pp. 3\u201317, September 2014","DOI":"10.1007\/978-3-319-16199-0_1"},{"issue":"1","key":"47_CR45","doi-asserted-by":"publisher","first-page":"233","DOI":"10.3945\/ajcn.114.083238","volume":"100","author":"SI Kirkpatrick","year":"2014","unstructured":"Kirkpatrick, S.I., et al.: Performance of the automated self-administered 24-hour recall relative to a measure of true intakes and to an interviewer-administered 24-h recall. Am. J. Clin. Nutr. 100(1), 233\u2013240 (2014)","journal-title":"Am. J. Clin. Nutr."},{"key":"47_CR46","doi-asserted-by":"crossref","unstructured":"Kitamura, K., Yamasaki, T., Aizawa, K.: Foodlog: capture analysis and retrieval of personal food images via web. In: Proceedings of the ACM Multimedia Workshop on Multimedia for Cooking and Eating Activities, Beijing, China, pp. 23\u201330, November 2009","DOI":"10.1145\/1630995.1631001"},{"key":"47_CR47","unstructured":"Krizhevsky, A., Sutskever, I., Hinton, G.E.: ImageNet classification with deep convolutional neural networks. In: Proceedings of Advances in Neural Information Processing Systems, pp. 1097\u20131105, December 2012"},{"issue":"2","key":"47_CR48","doi-asserted-by":"publisher","first-page":"268","DOI":"10.1093\/ajcn\/75.2.268","volume":"75","author":"CL Larsson","year":"2002","unstructured":"Larsson, C.L., Westerterp, K.R., Johansson, G.K.: Validity of reported energy expenditure and energy and protein intakes in Swedish adolescent vegans and omnivores. Am. J. Clin. Nutr. 75(2), 268\u2013274 (2002)","journal-title":"Am. J. Clin. Nutr."},{"key":"47_CR49","doi-asserted-by":"publisher","first-page":"436","DOI":"10.1038\/nature14539","volume":"521","author":"Y LeCun","year":"2015","unstructured":"LeCun, Y., Bengio, Y., Hinton, G.: Deep learning. Nature 521, 436\u2013444 (2015)","journal-title":"Nature"},{"key":"47_CR50","unstructured":"Lin, M., Chen, Q., Yan, S.: Network in network. arXiv preprint arXiv:1312.4400 (2013)"},{"key":"47_CR51","doi-asserted-by":"publisher","first-page":"S213","DOI":"10.1079\/BJN20041169","volume":"92","author":"MBE Livingstone","year":"2004","unstructured":"Livingstone, M.B.E., Robson, P.J., Wallace, J.M.W.: Issues in dietary intake assessment of children and adolescents. Br. J. Nutr. 92, S213\u2013S222 (2004)","journal-title":"Br. J. Nutr."},{"issue":"60","key":"47_CR52","doi-asserted-by":"publisher","first-page":"91","DOI":"10.1023\/B:VISI.0000029664.99615.94","volume":"2","author":"D Lowe","year":"2004","unstructured":"Lowe, D.: Distinctive image features from scale-invariant keypoints. Int. J. Comput. Vis. 2(60), 91\u2013110 (2004)","journal-title":"Int. J. Comput. Vis."},{"key":"47_CR53","unstructured":"Marin, J., et al.: Recipe1m+: a dataset for learning cross-modal embeddings for cooking recipes and food images. IEEE Trans. Pattern Anal. Mach. Intell. (2019)"},{"key":"47_CR54","doi-asserted-by":"publisher","unstructured":"Martinel, N., Foresti, G.L., Micheloni, C.: Wide-slice residual networks for food recognition. In: 2018 IEEE Winter Conference on Applications of Computer Vision (WACV), pp. 567\u2013576, March 2018. https:\/\/doi.org\/10.1109\/WACV.2018.00068","DOI":"10.1109\/WACV.2018.00068"},{"key":"47_CR55","doi-asserted-by":"publisher","unstructured":"Martinel, N., Piciarelli, C., Micheloni, C., Foresti, G.L.: A structured committee for food recognition, pp. 484\u2013492, December 2015. https:\/\/doi.org\/10.1109\/ICCVW.2015.70","DOI":"10.1109\/ICCVW.2015.70"},{"key":"47_CR56","doi-asserted-by":"crossref","unstructured":"Matsuda, Y., Hoashi, H., Yanai, K.: Recognition of multiple-food images by detecting candidate regions. In: Proceedings of IEEE International Conference on Multimedia and Expo, Melbourne, Australia, pp. 25\u201330, July 2012","DOI":"10.1109\/ICME.2012.157"},{"key":"47_CR57","unstructured":"Miyano, R., Uematsu, Y., Saito, H.: Food region detection using bag-of-features representation and color feature. VISAPP (2012)"},{"key":"47_CR58","unstructured":"Myers, A., et al.: Im2Calories: towards an automated mobile vision food diary. In: Proceedings of the IEEE International Conference on Computer Vision, Santiago, Chile, December 2011"},{"key":"47_CR59","doi-asserted-by":"crossref","unstructured":"Poslusna, K., Ruprich, J., de Vries, J.H., Jakubikova, M., van\u2019t Veer, P.: Misreporting of energy and micronutrient intake estimated by food records and 24 hour recalls, control and adjustment methods in practice. Br. J. Nutr. 101(S2), S73\u2013S85 (2009)","DOI":"10.1017\/S0007114509990602"},{"key":"47_CR60","series-title":"Lecture Notes in Computer Science","doi-asserted-by":"publisher","first-page":"441","DOI":"10.1007\/978-3-319-23222-5_54","volume-title":"New Trends in Image Analysis and Processing \u2013 ICIAP 2015 Workshops","author":"P Pouladzadeh","year":"2015","unstructured":"Pouladzadeh, P., Yassine, A., Shirmohammadi, S.: FooDD: food detection dataset for calorie measurement using food images. In: Murino, V., Puppo, E., Sona, D., Cristani, M., Sansone, C. (eds.) ICIAP 2015. LNCS, vol. 9281, pp. 441\u2013448. Springer, Cham (2015). https:\/\/doi.org\/10.1007\/978-3-319-23222-5_54"},{"key":"47_CR61","doi-asserted-by":"publisher","unstructured":"Qiu, J., Lo, F.P., Lo, B.: Assessing individual dietary intake in food sharing scenarios with a 360 camera and deep learning. In: 2019 IEEE 16th International Conference on Wearable and Implantable Body Sensor Networks (BSN), pp. 1\u20134, May 2019. https:\/\/doi.org\/10.1109\/BSN.2019.8771095","DOI":"10.1109\/BSN.2019.8771095"},{"key":"47_CR62","doi-asserted-by":"publisher","unstructured":"Ragusa, F., Tomaselli, V., Furnari, A., Battiato, S., Farinella, G.M.: Food vs non-food classification. In: Proceedings of the 2nd International Workshop on Multimedia Assisted Dietary Management, pp. 77\u201381 (2016). https:\/\/doi.org\/10.1145\/2986035.2986041","DOI":"10.1145\/2986035.2986041"},{"key":"47_CR63","doi-asserted-by":"crossref","unstructured":"Redmon, J., Divvala, S., Girshick, R., Farhadi, A.: You only look once: unified, real-time object detection. In: Proceedings of the IEEE Conference on Computer Vision and Pattern Recognition, pp. 779\u2013788 (2016)","DOI":"10.1109\/CVPR.2016.91"},{"key":"47_CR64","doi-asserted-by":"crossref","unstructured":"Redmon, J., Farhadi, A.: Yolo9000: better, faster, stronger. In: The IEEE Conference on Computer Vision and Pattern Recognition (CVPR), July 2017","DOI":"10.1109\/CVPR.2017.690"},{"key":"47_CR65","unstructured":"Ren, S., He, K., Girshick, R., Sun, J.: Faster R-CNN: towards real-time object detection with region proposal networks. In: Proceedings of Advances in Neural Information Processing Systems, pp. 91\u201399, December 2015"},{"issue":"5","key":"47_CR66","doi-asserted-by":"publisher","first-page":"557","DOI":"10.1097\/00075197-200309000-00009","volume":"6","author":"HR Rockett","year":"2003","unstructured":"Rockett, H.R., Berkey, C.S., Colditz, G.A.: Evaluation of dietary assessment instruments in adolescents. Curr. Opin. Clin. Nutr. Metab. Care 6(5), 557\u2013562 (2003)","journal-title":"Curr. Opin. Clin. Nutr. Metab. Care"},{"issue":"6","key":"47_CR67","doi-asserted-by":"publisher","first-page":"4897","DOI":"10.3390\/nu7064897","volume":"7","author":"M Rollo","year":"2015","unstructured":"Rollo, M., Ash, S., Lyons-Wall, P., Russell, A.: Evaluation of a mobile phone image-based dietary assessment method in adults with type 2 diabetes. Nutrients 7(6), 4897\u20134910 (2015)","journal-title":"Nutrients"},{"issue":"3","key":"47_CR68","doi-asserted-by":"publisher","first-page":"309","DOI":"10.1145\/1015706.1015720","volume":"23","author":"C Rother","year":"2004","unstructured":"Rother, C., Kolmogorov, V., Blake, A.: GrabCut: interactive foreground extraction using iterated graph cuts. ACM Trans. Graph. 23(3), 309\u2013314 (2004)","journal-title":"ACM Trans. Graph."},{"issue":"3","key":"47_CR69","doi-asserted-by":"publisher","first-page":"211","DOI":"10.1007\/s11263-015-0816-y","volume":"115","author":"O Russakovsky","year":"2015","unstructured":"Russakovsky, O., et al.: ImageNet large scale visual recognition challenge. Int. J. Comput. Vis. 115(3), 211\u2013252 (2015)","journal-title":"Int. J. Comput. Vis."},{"key":"47_CR70","doi-asserted-by":"crossref","unstructured":"Salvador, A., Hynes, N., Aytar, Y., Marin, J., Ofli, F., Weber, I., Torralba, A.: Learning cross-modal embeddings for cooking recipes and food images. In: Proceedings of the IEEE Conference on Computer Vision and Pattern Recognition, pp. 3020\u20133028 (2017)","DOI":"10.1109\/CVPR.2017.327"},{"key":"47_CR71","doi-asserted-by":"crossref","unstructured":"Shao, Z., Mao, R., Zhu, F.: Semi-automatic crowdsourcing tool for online food image collection and annotation. In: 2019 IEEE International Conference on Big Data, pp. 5186\u20135189, December 2019","DOI":"10.1109\/BigData47090.2019.9006165"},{"key":"47_CR72","series-title":"Lecture Notes in Computer Science","doi-asserted-by":"publisher","first-page":"449","DOI":"10.1007\/978-3-319-23222-5_55","volume-title":"New Trends in Image Analysis and Processing \u2013 ICIAP 2015 Workshops","author":"W Shimoda","year":"2015","unstructured":"Shimoda, W., Yanai, K.: CNN-based food image segmentation without pixel-wise annotation. In: Murino, V., Puppo, E., Sona, D., Cristani, M., Sansone, C. (eds.) ICIAP 2015. LNCS, vol. 9281, pp. 449\u2013457. Springer, Cham (2015). https:\/\/doi.org\/10.1007\/978-3-319-23222-5_55"},{"key":"47_CR73","unstructured":"Simonyan, K., Zisserman, A.: Very deep convolutional networks for large-scale image recognition. arXiv preprint arXiv:1409.1556 (2014)"},{"key":"47_CR74","doi-asserted-by":"publisher","unstructured":"Singla, A., Yuan, L., Ebrahimi, T.: Food\/non-food image classification and food categorization using pre-trained GoogLeNet model. In: Proceedings of the 2nd International Workshop on Multimedia Assisted Dietary Management, pp. 3\u201311 (2016). https:\/\/doi.org\/10.1145\/2986035.2986039","DOI":"10.1145\/2986035.2986039"},{"key":"47_CR75","doi-asserted-by":"crossref","unstructured":"Sun, M., et al.: ebutton: a wearable computer for health monitoring and personal assistance. In: Proceedings of the 51st Annual Design Automation Conference, pp. 1\u20136 (2014)","DOI":"10.1145\/2593069.2596678"},{"key":"47_CR76","doi-asserted-by":"publisher","first-page":"11","DOI":"10.1007\/BF00130487","volume":"7","author":"MJ Swain","year":"1991","unstructured":"Swain, M.J., Ballard, D.H.: Color indexing. Int. J. Comput. Vis. 7, 11\u201332 (1991)","journal-title":"Int. J. Comput. Vis."},{"key":"47_CR77","doi-asserted-by":"crossref","unstructured":"Szegedy, C., Ioffe, S., Vanhoucke, V., Alemi, A.A.: Inception-v4, inception-ResNet and the impact of residual connections on learning. In: Thirty-First AAAI Conference on Artificial Intelligence (2017)","DOI":"10.1609\/aaai.v31i1.11231"},{"key":"47_CR78","doi-asserted-by":"crossref","unstructured":"Szegedy, C., et al.: Going deeper with convolutions. In: Proceedings of the IEEE Conference on Computer Vision and Pattern Recognition, pp. 1\u20139 (2015)","DOI":"10.1109\/CVPR.2015.7298594"},{"key":"47_CR79","doi-asserted-by":"publisher","unstructured":"Tanno, R., Okamoto, K., Yanai, K.: DeepFoodCam: a DCNN-based real-time mobile food recognition system. In: Proceedings of the 2nd International Workshop on Multimedia Assisted Dietary Management, pp. 89\u201389 (2016). https:\/\/doi.org\/10.1145\/2986035.2986044","DOI":"10.1145\/2986035.2986044"},{"issue":"2","key":"47_CR80","doi-asserted-by":"publisher","first-page":"154","DOI":"10.1007\/s11263-013-0620-5","volume":"104","author":"JR Uijlings","year":"2013","unstructured":"Uijlings, J.R., van de Sande, K.E., Gevers, T., Smeulders, A.W.: Selective search for object recognition. Int. J. Comput. Vis. 104(2), 154\u2013171 (2013)","journal-title":"Int. J. Comput. Vis."},{"issue":"2","key":"47_CR81","first-page":"19","volume":"3","author":"M Vijaymeena","year":"2016","unstructured":"Vijaymeena, M., Kavitha, K.: A survey on similarity measures in text mining. Mach. Learn. Appl. Int. J. 3(2), 19\u201328 (2016)","journal-title":"Mach. Learn. Appl. Int. J."},{"key":"47_CR82","unstructured":"Wang, X., Kumar, D., Thome, N., Cord, M., Precioso, F.: Recipe recognition with large multimodal food dataset. In: 2015 IEEE International Conference on Multimedia & Expo Workshops (ICMEW), pp. 1\u20136 (2015)"},{"issue":"15","key":"47_CR83","doi-asserted-by":"publisher","first-page":"19769","DOI":"10.1007\/s11042-017-5346-x","volume":"77","author":"Y Wang","year":"2018","unstructured":"Wang, Y., He, Y., Boushey, C.J., Zhu, F., Delp, E.J.: Context based image analysis with application in dietary assessment and evaluation. Multimed. Tools Appl. 77(15), 19769\u201319794 (2018)","journal-title":"Multimed. Tools Appl."},{"key":"47_CR84","doi-asserted-by":"publisher","unstructured":"Wang, Y., Zhu, F., Boushey, C.J., Delp, E.J.: Weakly supervised food image segmentation using class activation maps. In: 2017 IEEE International Conference on Image Processing (ICIP), pp. 1277\u20131281, September 2017. https:\/\/doi.org\/10.1109\/ICIP.2017.8296487","DOI":"10.1109\/ICIP.2017.8296487"},{"key":"47_CR85","doi-asserted-by":"crossref","unstructured":"Wu, H., Merler, M., Uceda-Sosa, R., Smith, J.R.: Learning to make better mistakes: semantics-aware visual food recognition. In: Proceedings of the 24th ACM International Conference on Multimedia, pp. 172\u2013176 (2016)","DOI":"10.1145\/2964284.2967205"},{"key":"47_CR86","doi-asserted-by":"publisher","unstructured":"Xin Wang, Kumar, D., Thome, N., Cord, M., Precioso, F.: Recipe recognition with large multimodal food dataset. In: 2015 IEEE International Conference on Multimedia Expo Workshops (ICMEW), pp. 1\u20136, June 2015. https:\/\/doi.org\/10.1109\/ICMEW.2015.7169757","DOI":"10.1109\/ICMEW.2015.7169757"},{"key":"47_CR87","doi-asserted-by":"crossref","unstructured":"Yanai, K., Kawano, Y.: Food image recognition using deep convolutional network with pre-training and fine-tuning. In: Proceedings of the IEEE International Conference on Multimedia & Expo Workshops, pp. 1\u20136, July 2015","DOI":"10.1109\/ICMEW.2015.7169816"},{"key":"47_CR88","unstructured":"Yang, S., Chen, M., Pomerleau, D., Sukhankar, R.: Food recognition using statistics of pair-wise local features. In: Proceedings of the International Conference on Computer Vision and Pattern Recognition, pp. 2249\u20132256, June 2010"},{"key":"47_CR89","doi-asserted-by":"crossref","unstructured":"Zagoruyko, S., Komodakis, N.: Wide residual networks. arXiv preprint arXiv:1605.07146 (2016)","DOI":"10.5244\/C.30.87"},{"key":"47_CR90","doi-asserted-by":"crossref","unstructured":"Zhou, B., Khosla, A., A., L., Oliva, A., Torralba, A.: Learning deep features for discriminative localization. In: Proceedings of the IEEE International Conference on Computer Vision and Pattern Recognition, June 2016","DOI":"10.1109\/CVPR.2016.319"},{"issue":"1","key":"47_CR91","doi-asserted-by":"publisher","first-page":"377","DOI":"10.1109\/JBHI.2014.2304925","volume":"19","author":"F Zhu","year":"2015","unstructured":"Zhu, F., Bosch, M., Khanna, N., Boushey, C., Delp, E.: Multiple hypotheses image segmentation and classification with application to dietary assessment. IEEE J. Biomed. Health Inf. 19(1), 377\u2013388 (2015)","journal-title":"IEEE J. Biomed. Health Inf."},{"issue":"4","key":"47_CR92","doi-asserted-by":"publisher","first-page":"756","DOI":"10.1109\/JSTSP.2010.2051471","volume":"4","author":"F Zhu","year":"2010","unstructured":"Zhu, F., et al.: The use of mobile devices in aiding dietary assessment and evaluation. IEEE J. Sel. Top. Signal Process. 4(4), 756\u2013766 (2010)","journal-title":"IEEE J. Sel. Top. Signal Process."}],"container-title":["Lecture Notes in Computer Science","Pattern Recognition. ICPR International Workshops and Challenges"],"original-title":[],"language":"en","link":[{"URL":"http:\/\/link.springer.com\/content\/pdf\/10.1007\/978-3-030-68821-9_47","content-type":"unspecified","content-version":"vor","intended-application":"similarity-checking"}],"deposited":{"date-parts":[[2024,8,24]],"date-time":"2024-08-24T15:21:19Z","timestamp":1724512879000},"score":1,"resource":{"primary":{"URL":"http:\/\/link.springer.com\/10.1007\/978-3-030-68821-9_47"}},"subtitle":[],"short-title":[],"issued":{"date-parts":[[2021]]},"ISBN":["9783030688202","9783030688219"],"references-count":92,"URL":"https:\/\/doi.org\/10.1007\/978-3-030-68821-9_47","relation":{},"ISSN":["0302-9743","1611-3349"],"issn-type":[{"value":"0302-9743","type":"print"},{"value":"1611-3349","type":"electronic"}],"subject":[],"published":{"date-parts":[[2021]]},"assertion":[{"value":"21 February 2021","order":1,"name":"first_online","label":"First Online","group":{"name":"ChapterHistory","label":"Chapter History"}},{"value":"ICPR","order":1,"name":"conference_acronym","label":"Conference Acronym","group":{"name":"ConferenceInfo","label":"Conference Information"}},{"value":"International Conference on Pattern Recognition","order":2,"name":"conference_name","label":"Conference Name","group":{"name":"ConferenceInfo","label":"Conference Information"}},{"value":"2021","order":5,"name":"conference_year","label":"Conference Year","group":{"name":"ConferenceInfo","label":"Conference Information"}},{"value":"10 January 2021","order":7,"name":"conference_start_date","label":"Conference Start Date","group":{"name":"ConferenceInfo","label":"Conference Information"}},{"value":"11 January 2021","order":8,"name":"conference_end_date","label":"Conference End Date","group":{"name":"ConferenceInfo","label":"Conference Information"}},{"value":"ICPR2020","order":10,"name":"conference_id","label":"Conference ID","group":{"name":"ConferenceInfo","label":"Conference Information"}},{"value":"http:\/\/www.icpr2020.it\/","order":11,"name":"conference_url","label":"Conference URL","group":{"name":"ConferenceInfo","label":"Conference Information"}}]}}