{"status":"ok","message-type":"work","message-version":"1.0.0","message":{"indexed":{"date-parts":[[2026,6,19]],"date-time":"2026-06-19T16:13:43Z","timestamp":1781885623682,"version":"3.54.5"},"reference-count":65,"publisher":"Springer Science and Business Media LLC","issue":"3","license":[{"start":{"date-parts":[[2020,12,5]],"date-time":"2020-12-05T00:00:00Z","timestamp":1607126400000},"content-version":"tdm","delay-in-days":0,"URL":"https:\/\/creativecommons.org\/licenses\/by\/4.0"},{"start":{"date-parts":[[2020,12,5]],"date-time":"2020-12-05T00:00:00Z","timestamp":1607126400000},"content-version":"vor","delay-in-days":0,"URL":"https:\/\/creativecommons.org\/licenses\/by\/4.0"}],"funder":[{"name":"University of Helsinki including Helsinki University Central Hospital"}],"content-domain":{"domain":["link.springer.com"],"crossmark-restriction":false},"short-container-title":["Lang Resources &amp; Evaluation"],"published-print":{"date-parts":[[2021,9]]},"abstract":"<jats:title>Abstract<\/jats:title><jats:p>This article introduces AI2D-RST, a multimodal corpus of 1000 English-language diagrams that represent topics in primary school natural sciences, such as food webs, life cycles, moon phases and human physiology. The corpus is based on the Allen Institute for Artificial Intelligence Diagrams (AI2D) dataset, a collection of diagrams with crowdsourced descriptions, which was originally developed to support research on automatic diagram understanding and visual question answering. Building on the segmentation of diagram layouts in AI2D, the AI2D-RST corpus presents a new multi-layer annotation schema that provides a rich description of their multimodal structure. Annotated by trained experts, the layers describe (1) the grouping of diagram elements into perceptual units, (2) the connections set up by diagrammatic elements such as arrows and lines, and (3) the discourse relations between diagram elements, which are described using Rhetorical Structure Theory (RST). Each annotation layer in AI2D-RST is represented using a graph. The corpus is freely available for research and teaching.<\/jats:p>","DOI":"10.1007\/s10579-020-09517-1","type":"journal-article","created":{"date-parts":[[2020,12,5]],"date-time":"2020-12-05T18:02:22Z","timestamp":1607191342000},"page":"661-688","update-policy":"https:\/\/doi.org\/10.1007\/springer_crossmark_policy","source":"Crossref","is-referenced-by-count":29,"title":["AI2D-RST: a multimodal corpus of 1000 primary school science diagrams"],"prefix":"10.1007","volume":"55","author":[{"ORCID":"https:\/\/orcid.org\/0000-0002-8504-9422","authenticated-orcid":false,"given":"Tuomo","family":"Hiippala","sequence":"first","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]},{"ORCID":"https:\/\/orcid.org\/0000-0002-1315-2228","authenticated-orcid":false,"given":"Malihe","family":"Alikhani","sequence":"additional","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]},{"given":"Jonas","family":"Haverinen","sequence":"additional","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]},{"given":"Timo","family":"Kalliokoski","sequence":"additional","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]},{"given":"Evanfiya","family":"Logacheva","sequence":"additional","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]},{"given":"Serafina","family":"Orekhova","sequence":"additional","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]},{"given":"Aino","family":"Tuomainen","sequence":"additional","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]},{"given":"Matthew","family":"Stone","sequence":"additional","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]},{"ORCID":"https:\/\/orcid.org\/0000-0002-7209-9295","authenticated-orcid":false,"given":"John A.","family":"Bateman","sequence":"additional","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]}],"member":"297","published-online":{"date-parts":[[2020,12,5]]},"reference":[{"key":"9517_CR1","unstructured":"Alikhani, M., & Stone, M. (2018). Arrows are the verbs of diagrams. In Proceedings of the 27th International Conference on Computational Linguistics, Santa Fe, New Mexico, USA, pp.\u00a03552\u20133563."},{"key":"9517_CR2","doi-asserted-by":"publisher","first-page":"147","DOI":"10.1007\/BF00849177","volume":"9","author":"E Andr\u00e9","year":"1995","unstructured":"Andr\u00e9, E., & Rist, T. (1995). Generating coherent presentations employing textual and visual material. Artificial Intelligence Review, 9, 147\u2013165.","journal-title":"Artificial Intelligence Review"},{"issue":"4","key":"9517_CR3","doi-asserted-by":"publisher","first-page":"555","DOI":"10.1162\/coli.07-034-R2","volume":"34","author":"R Artstein","year":"2008","unstructured":"Artstein, R., & Poesio, M. (2008). Inter-coder agreement for computational linguistics. Computational Linguistics, 34(4), 555\u2013596.","journal-title":"Computational Linguistics"},{"issue":"3","key":"9517_CR4","doi-asserted-by":"publisher","first-page":"603","DOI":"10.1007\/s10579-015-9331-6","volume":"50","author":"NR Asheghi","year":"2016","unstructured":"Asheghi, N. R., Sharoff, S., & Markert, K. (2016). Crowdsourcing for web genre annotation. Language Resources & Evaluation, 50(3), 603\u2013641.","journal-title":"Language Resources & Evaluation"},{"key":"9517_CR5","doi-asserted-by":"publisher","DOI":"10.1057\/9780230582323","volume-title":"Multimodality and Genre: A Foundation for the Systematic Analysis of Multimodal Documents","author":"JA Bateman","year":"2008","unstructured":"Bateman, J. A. (2008). Multimodality and Genre: A Foundation for the Systematic Analysis of Multimodal Documents. London: Palgrave Macmillan."},{"key":"9517_CR6","doi-asserted-by":"publisher","DOI":"10.4324\/9781315773971","volume-title":"Text and image: A critical introduction to the visual\/verbal divide","author":"JA Bateman","year":"2014","unstructured":"Bateman, J. A. (2014). Text and image: A critical introduction to the visual\/verbal divide. London: Routledge."},{"key":"9517_CR7","unstructured":"Bateman, J.\u00a0A. & Henschel, R. (2007). Generating text, layout and diagrams appropriately for genre, in I.\u00a0van der Sluis, M.\u00a0Theune, E.\u00a0Reiter and E.\u00a0Krahmer, eds, \u2018Proceedings of the Workshop on Multimodal Output Generation MOG 2007\u2019, Centre for Telematics and Information Technology (CTIT), University of Twente, pp.\u00a029\u201340."},{"issue":"3","key":"9517_CR8","doi-asserted-by":"publisher","first-page":"409","DOI":"10.1162\/089120101317066131","volume":"27","author":"JA Bateman","year":"2001","unstructured":"Bateman, J. A., Kamps, T., Reichenberger, K., & Kleinz, J. (2001). Towards constructive text, diagram, and layout generation for information presentation. Computational Linguistics, 27(3), 409\u2013449.","journal-title":"Computational Linguistics"},{"issue":"2","key":"9517_CR9","doi-asserted-by":"publisher","first-page":"373","DOI":"10.1386\/stic.5.2.373_1","volume":"5","author":"JA Bateman","year":"2014","unstructured":"Bateman, J. A., & Wildfeuer, J. (2014). Defining units of analysis for the systematic analysis of comics: A discourse-based approach. Studies in Comics, 5(2), 373\u2013403.","journal-title":"Studies in Comics"},{"key":"9517_CR10","doi-asserted-by":"publisher","DOI":"10.1515\/9783110479898","volume-title":"Multimodality: Foundations, Research and Analysis \u2013 A Problem-oriented Introduction","author":"JA Bateman","year":"2017","unstructured":"Bateman, J. A., Wildfeuer, J., & Hiippala, T. (2017). Multimodality: Foundations, Research and Analysis \u2013 A Problem-oriented Introduction. Berlin: De Gruyter Mouton."},{"key":"9517_CR11","volume-title":"Learning OpenCV: Computer vision in C++ with the OpenCV library","author":"G Bradski","year":"2013","unstructured":"Bradski, G., & Kaehler, A. (2013). Learning OpenCV: Computer vision in C++ with the OpenCV library (2nd ed.). Sebastopol: O\u2019Reilly.","edition":"2"},{"key":"9517_CR12","unstructured":"Carberry, S., Elzer, S., Green, N., McCoy, K., & Chester, D. (2003). Understanding information graphics: A discourse-level problem. In \u2018Proceedings of the Fourth SIGdial Workshop of Discourse and Dialogue\u2019. https:\/\/www.aclweb.org\/anthology\/W03-2101"},{"key":"9517_CR13","doi-asserted-by":"crossref","unstructured":"Choi, J., Krishnamurthy, J., Kembhavi, A., & Farhadi, A. (2018). Structured set matching networks for one-shot part labeling. In \u2018Proceedings of the 2018 IEEE\/CVF Conference on Computer Vision and Pattern Recognition\u2019, pp.\u00a03627\u20133636.","DOI":"10.1109\/CVPR.2018.00382"},{"issue":"1","key":"9517_CR14","doi-asserted-by":"publisher","first-page":"149","DOI":"10.1007\/s10579-017-9383-x","volume":"52","author":"D Das","year":"2018","unstructured":"Das, D., & Taboada, M. (2018). RST Signalling Corpus: A corpus of signals of coherence relations. Language Resources and Evaluation, 52(1), 149\u2013184.","journal-title":"Language Resources and Evaluation"},{"key":"9517_CR15","unstructured":"Engelhardt, Y. (2002). The Language of Graphics: A Framework for the Analysis of Syntax and Meaning in Maps, Charts and Diagrams. Institute for Logic, Language and Computation: University of Amsterdam. PhD thesis."},{"key":"9517_CR16","unstructured":"Engelhardt, Y., & Richards, C. (2018). A framework for analyzing and designing diagrams and graphics, in P.\u00a0Chapman, A.\u00a0Moktefi, S.\u00a0Perez-Kriz and F.\u00a0Bellucci, eds, \u2018Diagrams 2018: Diagrammatic Representation and Inference\u2019, Vol. 10871 of Lecture Notes in Computer Science, Springer, pp.\u00a0201\u2013209."},{"issue":"5","key":"9517_CR17","doi-asserted-by":"publisher","first-page":"378","DOI":"10.1037\/h0031619","volume":"76","author":"JL Fleiss","year":"1971","unstructured":"Fleiss, J. L. (1971). Measuring nominal scale agreement among many raters. Psychological Bulletin, 76(5), 378\u2013382.","journal-title":"Psychological Bulletin"},{"key":"9517_CR18","unstructured":"Gamer, M., Lemon, J., Fellows, I., & Singh, P. (2019). irr: Various coefficients of interrater reliability and agreement. R package version 0.84.1. https:\/\/CRAN.R-project.org\/package=irr"},{"issue":"3","key":"9517_CR19","first-page":"175","volume":"12","author":"BJ Grosz","year":"1986","unstructured":"Grosz, B. J., & Sidner, C. L. (1986). Attention, intentions, and the structure of discourse. Computational Linguistics, 12(3), 175\u2013204.","journal-title":"Computational Linguistics"},{"issue":"1","key":"9517_CR20","doi-asserted-by":"publisher","first-page":"641","DOI":"10.1109\/TVCG.2018.2865138","volume":"25","author":"D Haehn","year":"2019","unstructured":"Haehn, D., Tompkin, J., & Pfister, H. (2019). Evaluating \u2018graphical perception\u2019 with CNNs. IEEE Transactions on Visualization and Computer Graphics, 25(1), 641\u2013650.","journal-title":"IEEE Transactions on Visualization and Computer Graphics"},{"key":"9517_CR21","unstructured":"Hagberg, A., Swart, P. & Schult, D. (2008). Exploring network structure, dynamics, and function using NetworkX. In Proceedings of the 7th Python in Science Conference, pp.\u00a011\u201315."},{"issue":"6","key":"9517_CR22","doi-asserted-by":"publisher","first-page":"717","DOI":"10.1006\/jmla.1993.1036","volume":"32","author":"M Hegarty","year":"1993","unstructured":"Hegarty, M., & Just, M. A. (1993). Constructing mental models of machines from text and diagrams. Journal of Memory and Language, 32(6), 717\u2013742.","journal-title":"Journal of Memory and Language"},{"issue":"3","key":"9517_CR23","doi-asserted-by":"publisher","first-page":"461","DOI":"10.1093\/llc\/fqs064","volume":"28","author":"T Hiippala","year":"2013","unstructured":"Hiippala, T. (2013). The interface between rhetoric and layout in multimodal artefacts. Literary and Linguistic Computing, 28(3), 461\u2013471.","journal-title":"Literary and Linguistic Computing"},{"key":"9517_CR24","doi-asserted-by":"publisher","DOI":"10.4324\/9781315740454","volume-title":"The structure of multimodal documents: An empirical approach","author":"T Hiippala","year":"2015","unstructured":"Hiippala, T. (2015). The structure of multimodal documents: An empirical approach. New York: Routledge."},{"key":"9517_CR25","unstructured":"Hiippala, T., & Bateman, J.\u00a0A. (2020) Introducing the diagrammatic mode. arXiv 2001.11224. https:\/\/arxiv.org\/abs\/2001.11224"},{"key":"9517_CR26","unstructured":"Hiippala, T. and Orekhova, S. (2018). Enhancing the AI2 diagrams dataset using rhetorical structure theory. in Proceedings of the Eleventh International Conference on Language Resources and Evaluation (LREC 2018), European Language Resources Association (ELRA), Paris, pp.\u00a01925\u20131931."},{"key":"9517_CR27","doi-asserted-by":"publisher","first-page":"1215","DOI":"10.1002\/acp.1525","volume":"23","author":"J Holsanova","year":"2009","unstructured":"Holsanova, J., Holmberg, N., & Holmqvist, K. (2009). Reading information graphics: The role of spatial contiguity and dual attentional guidance. Applied Cognitive Psychology, 23, 1215\u20131226.","journal-title":"Applied Cognitive Psychology"},{"key":"9517_CR28","unstructured":"Hovy, D., Berg-Kirkpatrick, T., Vaswani, A., & Hovy, E. (2013). Learning whom to trust with MACE. In Proceedings of the 2013 Conference of the North American Chapter of the Association for Computational Linguistics: Human Language Technologies, Association for Computational Linguistics, Atlanta, Georgia, pp.\u00a01120\u20131130."},{"key":"9517_CR29","doi-asserted-by":"publisher","unstructured":"Huang, L. (2020). Toward multimodal corpus pragmatics: Rationale, case, and agenda. Digital Scholarship in the Humanities. https:\/\/doi.org\/10.1093\/llc\/fqz080.","DOI":"10.1093\/llc\/fqz080"},{"issue":"3","key":"9517_CR30","doi-asserted-by":"publisher","first-page":"90","DOI":"10.1109\/MCSE.2007.55","volume":"9","author":"J Hunter","year":"2007","unstructured":"Hunter, J. (2007). matplotlib: A 2D graphics environment. Computing in Science & Engineering, 9(3), 90\u201395.","journal-title":"Computing in Science & Engineering"},{"key":"9517_CR31","doi-asserted-by":"crossref","unstructured":"Kembhavi, A., Salvato, M., Kolve, E., Seo, M.\u00a0J., Hajishirzi, H., & Farhadi, A. (2016). A diagram is worth a dozen images. In Proceedings of the 14th European Conference on Computer Vision (ECCV 2016), Springer, Cham, pp.\u00a0235\u2013251.","DOI":"10.1007\/978-3-319-46493-0_15"},{"key":"9517_CR32","doi-asserted-by":"crossref","unstructured":"Kim, D., Kim, S., & Kwak, N. (2019) , Textbook question answering with multi-modal context graph understanding and self-supervised open-set comprehension. In Proceedings of the 57th Annual Meeting of the Association for Computational Linguistics (ACL 2019), Association for Computational Linguistics, Florence, Italy, pp.\u00a03568\u20133584.","DOI":"10.18653\/v1\/P19-1347"},{"key":"9517_CR33","doi-asserted-by":"crossref","unstructured":"Kim, D., Yoo, Y., Kim, J., Lee, S. & Kwak, N. (2018). Dynamic graph generation network: Generating relational knowledge from diagrams. In Proceedings of the 2018 IEEE\/CVF Conference on Computer Vision and Pattern Recognition (CVPR 2018), pp.\u00a04167\u20134175.","DOI":"10.1109\/CVPR.2018.00438"},{"issue":"3","key":"9517_CR34","doi-asserted-by":"publisher","first-page":"177","DOI":"10.1561\/0600000071","volume":"10","author":"A Kovashka","year":"2016","unstructured":"Kovashka, A., Russakovsky, O., Fei-Fei, L., & Grauman, K. (2016). Crowdsourcing in computer vision. Foundations and Trends in Computer Graphics and Vision, 10(3), 177\u2013243.","journal-title":"Foundations and Trends in Computer Graphics and Vision"},{"key":"9517_CR35","volume-title":"Content Analysis: An Introduction to its Methodology","author":"K Krippendorff","year":"2013","unstructured":"Krippendorff, K. (2013). Content Analysis: An Introduction to its Methodology (3rd ed.). Thousand Oaks, CA: Sage.","edition":"3"},{"issue":"3","key":"9517_CR36","first-page":"243","volume":"8","author":"WC Mann","year":"1988","unstructured":"Mann, W. C., & Thompson, S. A. (1988). Rhetorical Structure Theory: Toward a functional theory of text organization. Text, 8(3), 243\u2013281.","journal-title":"Text"},{"issue":"29","key":"9517_CR37","doi-asserted-by":"publisher","first-page":"861","DOI":"10.21105\/joss.00861","volume":"3","author":"L McInnes","year":"2018","unstructured":"McInnes, L., Healy, J., Saul, N., & Grossberger, L. (2018). UMAP: Uniform manifold approximation and projection. The Journal of Open Source Software, 3(29), 861.","journal-title":"The Journal of Open Source Software"},{"key":"9517_CR38","doi-asserted-by":"crossref","unstructured":"McKinney, W. (2010). Data structures for statistical computing in Python. In S.\u00a0van\u00a0der Walt and J.\u00a0Millman, eds, Proceedings of the 9th Python in Science Conference, pp.\u00a051\u201356.","DOI":"10.25080\/Majora-92bf1922-00a"},{"issue":"5","key":"9517_CR39","doi-asserted-by":"publisher","first-page":"1101","DOI":"10.1002\/acp.3698","volume":"34","author":"D Menendez","year":"2020","unstructured":"Menendez, D., Rosengren, K. S., & Alibali, M. W. (2020). Do details bug you? Effects of perceptual richness in learning about biological change. Applied Cognitive Psychology, 34(5), 1101\u20131117.","journal-title":"Applied Cognitive Psychology"},{"issue":"2","key":"9517_CR40","doi-asserted-by":"publisher","first-page":"57","DOI":"10.1016\/j.jvlc.2013.11.004","volume":"25","author":"HC Purchase","year":"2014","unstructured":"Purchase, H. C. (2014). Twelve year of diagrams research. Journal of Visual Languages and Computing, 25(2), 57\u201375.","journal-title":"Journal of Visual Languages and Computing"},{"key":"9517_CR41","unstructured":"R Core Team. (2019). R: A Language and Environment for Statistical Computing, R Foundation for Statistical Computing, Vienna, Austria. https:\/\/www.R-project.org\/"},{"key":"9517_CR42","unstructured":"Randolph, J.\u00a0J. (2005). Free-marginal multirater kappa (multirater $$\\kappa $$-free): An alternative to Fleiss\u2019 fixed-marginal multirater kappa. In: Proceedings of the Joensuu Learning and Instruction Symposium."},{"issue":"3","key":"9517_CR43","doi-asserted-by":"publisher","first-page":"319","DOI":"10.1162\/coli.2008.34.3.319","volume":"34","author":"D Reidsma","year":"2007","unstructured":"Reidsma, D., & Carletta, J. (2007). Reliability measurement without limits. Computational Linguistics, 34(3), 319\u2013326.","journal-title":"Computational Linguistics"},{"issue":"1","key":"9517_CR44","doi-asserted-by":"publisher","first-page":"235","DOI":"10.1162\/COLI_a_00182","volume":"40","author":"S Riezler","year":"2014","unstructured":"Riezler, S. (2014). On the problem of theoretical terms in empirical computational linguistics. Computational Linguistics, 40(1), 235\u2013245.","journal-title":"Computational Linguistics"},{"issue":"4","key":"9517_CR45","doi-asserted-by":"publisher","first-page":"627","DOI":"10.1162\/coli_a_00360","volume":"45","author":"M Sachan","year":"2019","unstructured":"Sachan, M., Dubey, A., Hovy, E. H., Mitchell, T. M., Roth, D., & Xing, E. P. (2019). Discourse in multimedia: A case study in extracting geometry knowledge from textbooks. Computational Linguistics, 45(4), 627\u2013665.","journal-title":"Computational Linguistics"},{"key":"9517_CR46","unstructured":"Sachan, M., Dubey, K.\u00a0A., Mitchell, T.\u00a0M., Roth, D., & Xing, E.\u00a0P. (2018). Learning pipelines with limited data and domain knowledge: A study in parsing physics problems. In Proceedings of the 32nd Conference on Neural Information Processing Systems (NeurIPS 2018)."},{"key":"9517_CR47","doi-asserted-by":"crossref","unstructured":"Seabold, S., & Perktold, J. (2010). Statsmodels: Econometric and statistical modeling with Python. In 9th Python in Science Conference. pp.\u00a057\u201361.","DOI":"10.25080\/Majora-92bf1922-011"},{"key":"9517_CR48","doi-asserted-by":"crossref","unstructured":"Seo, M., Hajishirzi, H., Farhadi, A., Etzioni, O., & Malcolm, C. (2015). Solving geometry problems: Combining text and diagram interpretation. In Proceedings of the 2015 Conference on Empirical Methods in Natural Language Processing (EMNLP 2015)\u2019, Association for Computational Linguistics, Lisbon, Portugal, pp.\u00a01466\u20131476.","DOI":"10.18653\/v1\/D15-1171"},{"issue":"1","key":"9517_CR49","doi-asserted-by":"publisher","first-page":"65","DOI":"10.1177\/1461445612466468","volume":"15","author":"M Taboada","year":"2013","unstructured":"Taboada, M., & Habel, C. (2013). Rhetorical relations in multimodal documents. Discourse Studies, 15(1), 65\u201389.","journal-title":"Discourse Studies"},{"issue":"3","key":"9517_CR50","doi-asserted-by":"publisher","first-page":"423","DOI":"10.1177\/1461445606061881","volume":"8","author":"M Taboada","year":"2006","unstructured":"Taboada, M., & Mann, W. C. (2006). Rhetorical structure theory: Looking back and moving ahead. Discourse Studies, 8(3), 423\u2013459.","journal-title":"Discourse Studies"},{"key":"9517_CR51","unstructured":"Thomas, M. (2009). Localizing pack messages: A framework for corpus-based cross-cultural multimodal analysis, PhD thesis, University of Leeds."},{"issue":"2","key":"9517_CR52","doi-asserted-by":"publisher","first-page":"163","DOI":"10.1177\/1470357213516725","volume":"13","author":"M Thomas","year":"2014","unstructured":"Thomas, M. (2014). Evidence and circularity in multimodal discourse analysis. Visual Communication, 13(2), 163\u2013189.","journal-title":"Visual Communication"},{"issue":"5","key":"9517_CR53","doi-asserted-by":"publisher","first-page":"725","DOI":"10.1080\/09500693.2016.1158435","volume":"38","author":"CD Tippett","year":"2016","unstructured":"Tippett, C. D. (2016). What recent research on diagrams suggests about learning with rather than learning from visual representations in science. International Journal of Science Education, 38(5), 725\u2013746.","journal-title":"International Journal of Science Education"},{"issue":"1","key":"9517_CR54","doi-asserted-by":"publisher","first-page":"99","DOI":"10.1007\/s13164-014-0214-3","volume":"6","author":"B Tversky","year":"2015","unstructured":"Tversky, B. (2015). The cognitive design of tools of thought. Review of Philosophy and Psychology, 6(1), 99\u2013116.","journal-title":"Review of Philosophy and Psychology"},{"key":"9517_CR55","first-page":"349","volume-title":"Information design: Research and practice","author":"B Tversky","year":"2017","unstructured":"Tversky, B. (2017). Diagrams: Cognitive foundations for design. In A. Black, P. Luna, O. Lund, & S. Walker (Eds.), Information design: Research and practice (pp. 349\u2013360). London: Routledge."},{"key":"9517_CR56","doi-asserted-by":"crossref","unstructured":"Tversky, B., Zacks, J., Lee, P., & Heiser, J. (2000). Lines, blobs, crosses and arrows: Diagrammatic communication with schematic figures. Diagrams 2000: Theory and Application of Diagrams (pp. 221\u2013230). Berlin: Springer.","DOI":"10.1007\/3-540-44590-0_21"},{"issue":"4","key":"9517_CR57","doi-asserted-by":"publisher","first-page":"236","DOI":"10.1080\/01972243.2012.689609","volume":"28","author":"RHW Waller","year":"2012","unstructured":"Waller, R. H. W. (2012). Graphic literacies for a digital age: The survival of layout. The Information Society, 28(4), 236\u2013252.","journal-title":"The Information Society"},{"key":"9517_CR58","doi-asserted-by":"publisher","first-page":"175","DOI":"10.1016\/j.dcm.2017.07.004","volume":"20","author":"RHW Waller","year":"2017","unstructured":"Waller, R. H. W. (2017). Practice-based perspectives on multimodal documents: Corpora vs connoisseurship. Discourse, Context & Media, 20, 175\u2013190.","journal-title":"Discourse, Context & Media"},{"key":"9517_CR59","doi-asserted-by":"crossref","unstructured":"Wan, S., Kutschbach, T., L\u00fcdeling, A., & Stede, M. (2019). RST-Tace: A tool for automatic comparison and evaluation of RST trees. In Proceedings of the Workshop on Discourse Relation Parsing and Treebanking 2019, Association for Computational Linguistics, Minneapolis, MN, pp.\u00a088\u201396.","DOI":"10.18653\/v1\/W19-2712"},{"key":"9517_CR60","volume-title":"Information Visualization: Perception for Design","author":"C Ware","year":"2012","unstructured":"Ware, C. (2012). Information Visualization: Perception for Design (3rd ed.). Amsterdam: Elsevier.","edition":"3"},{"key":"9517_CR61","doi-asserted-by":"crossref","unstructured":"Watanabe, Y., & Nagao, M. (1998). Diagram understanding using integration of layout information and textual information. In \u2018Proceedings of the 36th Annual Meeting of the Association for Computational Linguistics and 17th International Conference on Computational Linguistics (ACL\u201998\/COLING\u201998)\u2019, Association for Computational Linguistics, Montreal, Quebec, Canada, pp.\u00a01374\u20131380.","DOI":"10.3115\/980691.980793"},{"key":"9517_CR62","volume-title":"Multimodality: Disciplinary Thoughts and the Challenge of Diversity","year":"2020","unstructured":"Wildfeuer, J., Pflaeging, J., Bateman, J. A., Seizov, O., & Tseng, C. (Eds.). (2020). Multimodality: Disciplinary Thoughts and the Challenge of Diversity. Berlin: De Gruyter."},{"issue":"2","key":"9517_CR63","doi-asserted-by":"publisher","first-page":"249","DOI":"10.1162\/0891201054223977","volume":"31","author":"F Wolf","year":"2005","unstructured":"Wolf, F., & Gibson, E. (2005). Representing discourse coherence: A corpus-based study. Computational Linguistics, 31(2), 249\u2013288.","journal-title":"Computational Linguistics"},{"key":"9517_CR64","unstructured":"Wu, Z., Pan, S., Chen, F., Long, G., Zhang, C., & Yu, P.\u00a0S. (2019). A comprehensive survey on graph neural networks. http:\/\/arxiv.org\/abs\/1901.00596"},{"key":"9517_CR65","doi-asserted-by":"crossref","unstructured":"Yung, F., Demberg, V., & Scholman, M. (2019). Crowdsourcing discourse relation annotations by a two-step connective insertion task. In: Proceedings of the 13th Linguistic Annotation Workshop, Association for Computational Linguistics, Florence, Italy, pp.\u00a016\u201325.","DOI":"10.18653\/v1\/W19-4003"}],"container-title":["Language Resources and Evaluation"],"original-title":[],"language":"en","link":[{"URL":"https:\/\/link.springer.com\/content\/pdf\/10.1007\/s10579-020-09517-1.pdf","content-type":"application\/pdf","content-version":"vor","intended-application":"text-mining"},{"URL":"https:\/\/link.springer.com\/article\/10.1007\/s10579-020-09517-1\/fulltext.html","content-type":"text\/html","content-version":"vor","intended-application":"text-mining"},{"URL":"https:\/\/link.springer.com\/content\/pdf\/10.1007\/s10579-020-09517-1.pdf","content-type":"application\/pdf","content-version":"vor","intended-application":"similarity-checking"}],"deposited":{"date-parts":[[2021,7,31]],"date-time":"2021-07-31T17:15:56Z","timestamp":1627751756000},"score":1,"resource":{"primary":{"URL":"https:\/\/link.springer.com\/10.1007\/s10579-020-09517-1"}},"subtitle":[],"short-title":[],"issued":{"date-parts":[[2020,12,5]]},"references-count":65,"journal-issue":{"issue":"3","published-print":{"date-parts":[[2021,9]]}},"alternative-id":["9517"],"URL":"https:\/\/doi.org\/10.1007\/s10579-020-09517-1","relation":{},"ISSN":["1574-020X","1574-0218"],"issn-type":[{"value":"1574-020X","type":"print"},{"value":"1574-0218","type":"electronic"}],"subject":[],"published":{"date-parts":[[2020,12,5]]},"assertion":[{"value":"28 October 2020","order":1,"name":"accepted","label":"Accepted","group":{"name":"ArticleHistory","label":"Article History"}},{"value":"5 December 2020","order":2,"name":"first_online","label":"First Online","group":{"name":"ArticleHistory","label":"Article History"}}]}}