{"status":"ok","message-type":"work","message-version":"1.0.0","message":{"indexed":{"date-parts":[[2026,6,5]],"date-time":"2026-06-05T16:07:38Z","timestamp":1780675658769,"version":"3.54.1"},"reference-count":25,"publisher":"Springer Science and Business Media LLC","issue":"1","license":[{"start":{"date-parts":[[2024,12,15]],"date-time":"2024-12-15T00:00:00Z","timestamp":1734220800000},"content-version":"tdm","delay-in-days":0,"URL":"https:\/\/www.springernature.com\/gp\/researchers\/text-and-data-mining"},{"start":{"date-parts":[[2024,12,15]],"date-time":"2024-12-15T00:00:00Z","timestamp":1734220800000},"content-version":"vor","delay-in-days":0,"URL":"https:\/\/www.springernature.com\/gp\/researchers\/text-and-data-mining"}],"funder":[{"DOI":"10.13039\/501100000038","name":"Natural Sciences and Engineering Research Council of Canada","doi-asserted-by":"publisher","award":["RGPIN-2023-04057"],"award-info":[{"award-number":["RGPIN-2023-04057"]}],"id":[{"id":"10.13039\/501100000038","id-type":"DOI","asserted-by":"publisher"}]},{"DOI":"10.13039\/501100000038","name":"Natural Sciences and Engineering Research Council of Canada","doi-asserted-by":"publisher","award":["RGPIN-2023-04057"],"award-info":[{"award-number":["RGPIN-2023-04057"]}],"id":[{"id":"10.13039\/501100000038","id-type":"DOI","asserted-by":"publisher"}]}],"content-domain":{"domain":["link.springer.com"],"crossmark-restriction":false},"short-container-title":["Stat Comput"],"published-print":{"date-parts":[[2025,2]]},"DOI":"10.1007\/s11222-024-10546-x","type":"journal-article","created":{"date-parts":[[2024,12,15]],"date-time":"2024-12-15T04:25:17Z","timestamp":1734236717000},"update-policy":"https:\/\/doi.org\/10.1007\/springer_crossmark_policy","source":"Crossref","is-referenced-by-count":3,"title":["Optimal subsampling for generalized additive models on large-scale datasets"],"prefix":"10.1007","volume":"35","author":[{"given":"Lili","family":"Li","sequence":"first","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]},{"given":"Bingfan","family":"Liu","sequence":"additional","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]},{"given":"Xiaodi","family":"Liu","sequence":"additional","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]},{"given":"Haolun","family":"Shi","sequence":"additional","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]},{"given":"Jiguo","family":"Cao","sequence":"additional","affiliation":[],"role":[{"vocabulary":"crossref","role":"author"}]}],"member":"297","published-online":{"date-parts":[[2024,12,15]]},"reference":[{"issue":"2","key":"10546_CR1","first-page":"749","volume":"31","author":"M Ai","year":"2021","unstructured":"Ai, M., Yu, J., Zhang, H., et al.: Optimal subsampling algorithms for big data regressions. Stat. Sin. 31(2), 749\u2013772 (2021)","journal-title":"Stat. Sin."},{"key":"10546_CR2","doi-asserted-by":"publisher","DOI":"10.1093\/oso\/9780199296590.001.0001","volume-title":"Optimum Experimental Designs, with SAS","author":"A Atkinson","year":"2007","unstructured":"Atkinson, A., Donev, A., Tobias, R.: Optimum Experimental Designs, with SAS, vol. 34. OUP Oxford (2007)"},{"key":"10546_CR3","doi-asserted-by":"publisher","first-page":"483","DOI":"10.1007\/BF01087176","volume":"32","author":"VV Buldygin","year":"1980","unstructured":"Buldygin, V.V., Kozachenko, Y.V.: Sub-Gaussian random variables. Ukr. Math. J. 32, 483\u2013489 (1980)","journal-title":"Ukr. Math. J."},{"key":"10546_CR4","doi-asserted-by":"crossref","unstructured":"Drineas, P., Mahoney, M.W., Muthukrishnan, S.: Sampling algorithms for l 2 regression and applications. In: Proceedings of the seventeenth annual ACM-SIAM symposium on Discrete algorithm, pp. 1127\u20131136 (2006)","DOI":"10.1145\/1109557.1109682"},{"issue":"2","key":"10546_CR5","doi-asserted-by":"publisher","first-page":"219","DOI":"10.1007\/s00211-010-0331-6","volume":"117","author":"P Drineas","year":"2011","unstructured":"Drineas, P., Mahoney, M.W., Muthukrishnan, S., et al.: Faster least squares approximation. Numerische mathematik 117(2), 219\u2013249 (2011)","journal-title":"Numerische mathematik"},{"key":"10546_CR6","doi-asserted-by":"publisher","DOI":"10.1007\/978-1-4899-4549-5","volume-title":"A Course in Large Sample Theory","author":"TS Ferguson","year":"1996","unstructured":"Ferguson, T.S.: A Course in Large Sample Theory. Routledge (1996)"},{"key":"10546_CR7","doi-asserted-by":"crossref","unstructured":"Hastie, T.J.: Generalized additive models. In: Statistical Models in S, pp. 249\u2013307. Routledge (2017)","DOI":"10.1201\/9780203738535-7"},{"key":"10546_CR8","doi-asserted-by":"publisher","unstructured":"Hebrail, G. & Berard, A. (2006). Individual Household Electric Power Consumption [Dataset]. UCI Machine Learning Repository. https:\/\/doi.org\/10.24432\/C58K54.","DOI":"10.24432\/C58K54"},{"issue":"2","key":"10546_CR9","doi-asserted-by":"publisher","first-page":"272","DOI":"10.1111\/j.2517-6161.1959.tb00338.x","volume":"21","author":"J Kiefer","year":"1959","unstructured":"Kiefer, J.: Optimum experimental designs. J. Roy. Stat. Soc.: Ser. B (Methodol.) 21(2), 272\u2013304 (1959)","journal-title":"J. Roy. Stat. Soc.: Ser. B (Methodol.)"},{"issue":"1","key":"10546_CR10","first-page":"158","volume":"21","author":"J Lee","year":"2022","unstructured":"Lee, J., Schifano, E.D., Wang, H.: Sampling-based Gaussian mixture regression for big data. J. Data Sci. 21(1), 158\u2013172 (2022)","journal-title":"J. Data Sci."},{"key":"10546_CR11","unstructured":"Ma, P., Mahoney, M., Yu, B.: A statistical perspective on algorithmic leveraging. In: International Conference on Machine Learning, pp. 91\u201399 (2014)"},{"issue":"3","key":"10546_CR12","doi-asserted-by":"publisher","first-page":"697","DOI":"10.1073\/pnas.0803205106","volume":"106","author":"MW Mahoney","year":"2009","unstructured":"Mahoney, M.W., Drineas, P.: CUR matrix decompositions for improved data analysis. Proc. Natl. Acad. Sci. 106(3), 697\u2013702 (2009)","journal-title":"Proc. Natl. Acad. Sci."},{"issue":"2","key":"10546_CR13","doi-asserted-by":"publisher","first-page":"24","DOI":"10.1007\/s42519-024-00377-4","volume":"18","author":"Q Sui","year":"2024","unstructured":"Sui, Q., Ghosh, S.K.: Entropy-based subsampling methods for big data. J. Stat. Theory Prac. 18(2), 24 (2024)","journal-title":"J. Stat. Theory Prac."},{"issue":"522","key":"10546_CR14","doi-asserted-by":"publisher","first-page":"829","DOI":"10.1080\/01621459.2017.1292914","volume":"113","author":"H Wang","year":"2018","unstructured":"Wang, H., Zhu, R., Ma, P.: Optimal subsampling for large sample logistic regression. J. Am. Stat. Assoc. 113(522), 829\u2013844 (2018)","journal-title":"J. Am. Stat. Assoc."},{"issue":"525","key":"10546_CR15","doi-asserted-by":"publisher","first-page":"393","DOI":"10.1080\/01621459.2017.1408468","volume":"114","author":"H Wang","year":"2019","unstructured":"Wang, H., Yang, M., Stufken, J.: Information-based optimal subdata selection for big data linear regression. J. Am. Stat. Assoc. 114(525), 393\u2013405 (2019)","journal-title":"J. Am. Stat. Assoc."},{"issue":"3","key":"10546_CR16","doi-asserted-by":"publisher","first-page":"1273","DOI":"10.1214\/21-AOAS1462","volume":"15","author":"L Wang","year":"2021","unstructured":"Wang, L., Elmstedt, J., Wong, W.K., et al.: Orthogonal subsampling for big data linear regression. Ann. Appl. Stat. 15(3), 1273\u20131290 (2021)","journal-title":"Ann. Appl. Stat."},{"issue":"1","key":"10546_CR17","doi-asserted-by":"publisher","first-page":"151","DOI":"10.6339\/21-JDS999","volume":"19","author":"Y Yao","year":"2021","unstructured":"Yao, Y., Wang, H.: A review on optimal subsampling methods for massive datasets. J. Data Sci. 19(1), 151\u2013172 (2021)","journal-title":"J. Data Sci."},{"key":"10546_CR18","doi-asserted-by":"publisher","first-page":"188","DOI":"10.1016\/j.jspi.2022.12.004","volume":"225","author":"Y Yao","year":"2023","unstructured":"Yao, Y., Zou, J., Wang, H.: Model constraints independent optimal subsampling probabilities for softmax regression. J. Stat. Plan. Inference 225, 188\u2013201 (2023)","journal-title":"J. Stat. Plan. Inference"},{"key":"10546_CR19","doi-asserted-by":"crossref","unstructured":"Yao, Y., Zou, J., Wang, H.: Optimal poisson subsampling for softmax regression. J. Syst. Sci. Complexity 36(4), 1609\u20131625 (2023)","DOI":"10.1007\/s11424-023-1179-z"},{"issue":"537","key":"10546_CR20","doi-asserted-by":"publisher","first-page":"265","DOI":"10.1080\/01621459.2020.1773832","volume":"117","author":"J Yu","year":"2022","unstructured":"Yu, J., Wang, H., Ai, M., et al.: Optimal distributed subsampling for maximum quasi-likelihood estimators with massive data. J. Am. Stat. Assoc. 117(537), 265\u2013276 (2022)","journal-title":"J. Am. Stat. Assoc."},{"key":"10546_CR21","doi-asserted-by":"crossref","unstructured":"Yu, J., Liu, J., Wang, H.: Information-based optimal subdata selection for non-linear models. Stat. Pap. 64, 1069\u20131093 (2023)","DOI":"10.1007\/s00362-023-01430-3"},{"issue":"2","key":"10546_CR22","doi-asserted-by":"publisher","first-page":"467","DOI":"10.1007\/s00362-022-01386-w","volume":"65","author":"J Yu","year":"2024","unstructured":"Yu, J., Ai, M., Ye, Z.: A review on design inspired subsampling for big data. Stat. Pap. 65(2), 467\u2013510 (2024)","journal-title":"Stat. Pap."},{"key":"10546_CR23","doi-asserted-by":"publisher","DOI":"10.1016\/j.csda.2020.107072","volume":"153","author":"H Zhang","year":"2021","unstructured":"Zhang, H., Wang, H.: Distributed subdata selection for big data via sampling-based approach. Comput. Stat. Data Anal. 153, 107072 (2021)","journal-title":"Comput. Stat. Data Anal."},{"key":"10546_CR24","unstructured":"Zhu, R., Ma, P., Mahoney, M.W., et\u00a0al.: Optimal subsampling approaches for large sample linear regression. arXiv Preprint at arXiv:1509.05111 (2015)"},{"key":"10546_CR25","doi-asserted-by":"publisher","first-page":"2535","DOI":"10.1007\/s00180-021-01089-0","volume":"36","author":"L Zuo","year":"2021","unstructured":"Zuo, L., Zhang, H., Wang, H., et al.: Optimal subsample selection for massive logistic regression with distributed data. Comput. Stat. 36, 2535\u20132562 (2021)","journal-title":"Comput. Stat."}],"container-title":["Statistics and Computing"],"original-title":[],"language":"en","link":[{"URL":"https:\/\/link.springer.com\/content\/pdf\/10.1007\/s11222-024-10546-x.pdf","content-type":"application\/pdf","content-version":"vor","intended-application":"text-mining"},{"URL":"https:\/\/link.springer.com\/article\/10.1007\/s11222-024-10546-x\/fulltext.html","content-type":"text\/html","content-version":"vor","intended-application":"text-mining"},{"URL":"https:\/\/link.springer.com\/content\/pdf\/10.1007\/s11222-024-10546-x.pdf","content-type":"application\/pdf","content-version":"vor","intended-application":"similarity-checking"}],"deposited":{"date-parts":[[2025,1,22]],"date-time":"2025-01-22T18:14:58Z","timestamp":1737569698000},"score":1,"resource":{"primary":{"URL":"https:\/\/link.springer.com\/10.1007\/s11222-024-10546-x"}},"subtitle":[],"short-title":[],"issued":{"date-parts":[[2024,12,15]]},"references-count":25,"journal-issue":{"issue":"1","published-print":{"date-parts":[[2025,2]]}},"alternative-id":["10546"],"URL":"https:\/\/doi.org\/10.1007\/s11222-024-10546-x","relation":{},"ISSN":["0960-3174","1573-1375"],"issn-type":[{"value":"0960-3174","type":"print"},{"value":"1573-1375","type":"electronic"}],"subject":[],"published":{"date-parts":[[2024,12,15]]},"assertion":[{"value":"17 May 2024","order":1,"name":"received","label":"Received","group":{"name":"ArticleHistory","label":"Article History"}},{"value":"3 December 2024","order":2,"name":"accepted","label":"Accepted","group":{"name":"ArticleHistory","label":"Article History"}},{"value":"15 December 2024","order":3,"name":"first_online","label":"First Online","group":{"name":"ArticleHistory","label":"Article History"}}],"article-number":"15"}}