{"status":"ok","message-type":"work","message-version":"1.0.0","message":{"indexed":{"date-parts":[[2026,5,11]],"date-time":"2026-05-11T22:18:40Z","timestamp":1778537920171,"version":"3.51.4"},"reference-count":22,"publisher":"Springer Science and Business Media LLC","issue":"3","license":[{"start":{"date-parts":[[2017,2,3]],"date-time":"2017-02-03T00:00:00Z","timestamp":1486080000000},"content-version":"unspecified","delay-in-days":0,"URL":"http:\/\/www.springer.com\/tdm"}],"content-domain":{"domain":["link.springer.com"],"crossmark-restriction":false},"short-container-title":["Wireless Pers Commun"],"published-print":{"date-parts":[[2017,8]]},"DOI":"10.1007\/s11277-017-3987-8","type":"journal-article","created":{"date-parts":[[2017,2,3]],"date-time":"2017-02-03T08:13:46Z","timestamp":1486109626000},"page":"3119-3139","update-policy":"https:\/\/doi.org\/10.1007\/springer_crossmark_policy","source":"Crossref","is-referenced-by-count":16,"title":["A Model-Based Reinforcement Learning Algorithm for Routing in Energy Harvesting Mobile Ad-Hoc Networks"],"prefix":"10.1007","volume":"95","author":[{"given":"Meisam","family":"Maleki","sequence":"first","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]},{"given":"Vesal","family":"Hakami","sequence":"additional","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]},{"given":"Mehdi","family":"Dehghan","sequence":"additional","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]}],"member":"297","published-online":{"date-parts":[[2017,2,3]]},"reference":[{"issue":"4","key":"3987_CR1","doi-asserted-by":"crossref","first-page":"1326","DOI":"10.1109\/TWC.2010.04.080749","volume":"9","author":"V Sharma","year":"2010","unstructured":"Sharma, V., Mukherji, U., Joseph, V., & Gupta, S. (2010). Optimal energy management policies for energy harvesting sensor nodes. IEEE Transactions on Wireless Communications, 9(4), 1326\u20131336.","journal-title":"IEEE Transactions on Wireless Communications"},{"issue":"1","key":"3987_CR2","doi-asserted-by":"crossref","first-page":"9","DOI":"10.1109\/MVT.2009.935550","volume":"5","author":"J Gozalvez","year":"2010","unstructured":"Gozalvez, J. (2010). Green radio technologies [mobile radio]. IEEE Vehicular Technology Magazine, 5(1), 9\u201314.","journal-title":"IEEE Vehicular Technology Magazine"},{"key":"3987_CR3","doi-asserted-by":"crossref","unstructured":"Naruephiphat, W., & Usaha, W. (2008). Balanced energy-efficient routing in MANETs using reinforcement learning. In International conference on information networking, 2008 (ICOIN 2008) (pp. 1\u20135). IEEE.","DOI":"10.1109\/ICOIN.2008.4472784"},{"key":"3987_CR4","unstructured":"Tao, T., Tagashira, S., & Fujita., S. (2005). LQ-routing protocol for mobile ad-hoc networks. In Fourth annual ACIS international conference on computer and information science, 2005 (pp. 441\u2013446). IEEE."},{"key":"3987_CR5","doi-asserted-by":"crossref","unstructured":"Binbin, Z., Quan, L., & Shouling, Z. (2010). Using statistical network link model for routing in ad hoc networks with multi-agent reinforcement learning. In 2010 2nd International conference on advanced computer control (ICACC) (pp. 462\u2013466). IEEE.","DOI":"10.1109\/ICACC.2010.5486814"},{"issue":"3","key":"3987_CR6","doi-asserted-by":"crossref","first-page":"360","DOI":"10.1109\/TSMCA.2005.846390","volume":"35","author":"J Dowling","year":"2005","unstructured":"Dowling, J., Curran, E., Cunningham, R., & Cahill, V. (2005). Using feedback in collaborative reinforcement learning to adaptively optimize MANET routing. IEEE Transactions on Systems, Man and Cybernetics, Part A: Systems and Humans, 35(3), 360\u2013372.","journal-title":"IEEE Transactions on Systems, Man and Cybernetics, Part A: Systems and Humans"},{"issue":"3","key":"3987_CR7","doi-asserted-by":"crossref","first-page":"861","DOI":"10.1016\/j.adhoc.2012.09.008","volume":"11","author":"D Macone","year":"2013","unstructured":"Macone, D., Oddi, G., & Pietrabissa, A. (2013). MQ-routing: Mobility-, GPS-and energy-aware routing protocol in MANETs for disaster relief scenarios. Ad Hoc Networks, 11(3), 861\u2013878.","journal-title":"Ad Hoc Networks"},{"key":"3987_CR8","doi-asserted-by":"crossref","unstructured":"Chang, Y.-H., Ho, T., & Kaelbling, L. P. (2004). Mobilized ad-hoc networks: A reinforcement learning approach. In Proceedings of the international conference on autonomic computing, 2004 (pp. 240\u2013247). IEEE.","DOI":"10.1109\/ICAC.2004.1301369"},{"key":"3987_CR9","doi-asserted-by":"crossref","unstructured":"Santhi, G., Nachiappan, A., Ibrahime, M. Z., Raghunadhane, R., & Favas, M. (2011). Q-learning based adaptive QoS routing protocol for MANETs. In 2011 International conference on recent trends in information technology (ICRTIT) (pp. 1233\u20131238). IEEE.","DOI":"10.1109\/ICRTIT.2011.5972411"},{"issue":"5","key":"3987_CR10","doi-asserted-by":"crossref","first-page":"728","DOI":"10.1109\/JSAC.2010.100610","volume":"28","author":"H-P Shiang","year":"2010","unstructured":"Shiang, H.-P., & van der Schaar, M. (2010). Online learning in autonomic multi-hop wireless networks for transmitting mission-critical applications. IEEE Journal on Selected Areas in Communications, 28(5), 728\u2013741.","journal-title":"IEEE Journal on Selected Areas in Communications"},{"key":"3987_CR11","unstructured":"Boyan, J. A., & Littman, M. L. (1994). Packet routing in dynamically changing networks: A reinforcement learning approach. In J. D. Cowan, G. Tesauro, & J. Alspector (Eds.), Advances in Neural Information Processing Systems (Vol. 6, pp. 671\u2013678). Morgan Kaufmann."},{"key":"3987_CR12","doi-asserted-by":"crossref","unstructured":"Al-Rawi, H. A., Ng, M. A., & Yau, K.-L.A. (2013). Application of reinforcement learning to routing in distributed wireless networks: A review. Artificial Intelligence Review, 43(3), 381\u2013416.","DOI":"10.1007\/s10462-012-9383-6"},{"issue":"2","key":"3987_CR13","doi-asserted-by":"crossref","first-page":"445","DOI":"10.1109\/TCOMM.2012.010512.090739","volume":"60","author":"M Zhao","year":"2012","unstructured":"Zhao, M., Li, Y., & Wang, W. (2012). Modeling and analytical study of link properties in multihop wireless networks. IEEE Transactions on Communications, 60(2), 445\u2013455.","journal-title":"IEEE Transactions on Communications"},{"key":"3987_CR14","doi-asserted-by":"crossref","unstructured":"Hong, X., Gerla, M., Pei, G., & Chiang, C.-C. (1999). A group mobility model for ad hoc wireless networks. In Proceedings of the 2nd ACM international workshop on modeling, analysis and simulation of wireless and mobile systems (pp. 53\u201360). ACM.","DOI":"10.1145\/313237.313248"},{"issue":"5","key":"3987_CR15","doi-asserted-by":"crossref","first-page":"483","DOI":"10.1002\/wcm.72","volume":"2","author":"T Camp","year":"2002","unstructured":"Camp, T., Boleng, J., & Davies, V. (2002). A survey of mobility models for ad hoc network research. Wireless Communications and Mobile Computing, 2(5), 483\u2013502.","journal-title":"Wireless Communications and Mobile Computing"},{"issue":"1","key":"3987_CR16","doi-asserted-by":"crossref","first-page":"6","DOI":"10.1145\/1653760.1653766","volume":"6","author":"SB Eisenman","year":"2009","unstructured":"Eisenman, S. B., Miluzzo, E., Lane, N. D., Peterson, R. A., Ahn, G.-S., & Campbell, A. T. (2009). BikeNet: A mobile sensing system for cyclist experience mapping. ACM Transactions on Sensor Networks (TOSN), 6(1), 6.","journal-title":"ACM Transactions on Sensor Networks (TOSN)"},{"issue":"8","key":"3987_CR17","doi-asserted-by":"crossref","first-page":"916","DOI":"10.1016\/j.comcom.2012.02.004","volume":"35","author":"N Edalat","year":"2012","unstructured":"Edalat, N., Tham, C.-K., & Xiao, W. (2012). An auction-based strategy for distributed task allocation in wireless sensor networks. Computer Communications, 35(8), 916\u2013928.","journal-title":"Computer Communications"},{"key":"3987_CR18","unstructured":"Krishnaswamy, D. (2002). Network-assisted link adaptation with power control and channel reassignment in wireless networks. In 3G wireless conference."},{"issue":"5","key":"3987_CR19","doi-asserted-by":"crossref","first-page":"1054","DOI":"10.1109\/TNN.1998.712192","volume":"9","author":"RS Sutton","year":"1998","unstructured":"Sutton, R. S., & Barto, A. G. (1998). Reinforcement learning: An introduction. IEEE Transactions on Neural Networks, 9(5), 1054\u20131054.","journal-title":"IEEE Transactions on Neural Networks"},{"issue":"3","key":"3987_CR20","first-page":"185","volume":"16","author":"JN Tsitsiklis","year":"1994","unstructured":"Tsitsiklis, J. N. (1994). Asynchronous stochastic approximation and Q-learning. Machine Learning, 16(3), 185\u2013202.","journal-title":"Machine Learning"},{"issue":"1","key":"3987_CR21","doi-asserted-by":"crossref","first-page":"81","DOI":"10.1016\/0004-3702(94)00011-O","volume":"72","author":"AG Barto","year":"1995","unstructured":"Barto, A. G., Bradtke, S. J., & Singh, S. P. (1995). Learning to act using real-time dynamic programming. Artificial Intelligence, 72(1), 81\u2013138.","journal-title":"Artificial Intelligence"},{"key":"3987_CR22","volume-title":"Statistical inference for Markov processes","author":"P Billingsley","year":"1961","unstructured":"Billingsley, P. (1961). Statistical inference for Markov processes. Chicago: The University of Chicago Press."}],"container-title":["Wireless Personal Communications"],"original-title":[],"language":"en","link":[{"URL":"http:\/\/link.springer.com\/article\/10.1007\/s11277-017-3987-8\/fulltext.html","content-type":"text\/html","content-version":"vor","intended-application":"text-mining"},{"URL":"http:\/\/link.springer.com\/content\/pdf\/10.1007\/s11277-017-3987-8.pdf","content-type":"application\/pdf","content-version":"vor","intended-application":"text-mining"},{"URL":"http:\/\/link.springer.com\/content\/pdf\/10.1007\/s11277-017-3987-8.pdf","content-type":"application\/pdf","content-version":"vor","intended-application":"similarity-checking"}],"deposited":{"date-parts":[[2019,9,18]],"date-time":"2019-09-18T06:43:23Z","timestamp":1568789003000},"score":1,"resource":{"primary":{"URL":"http:\/\/link.springer.com\/10.1007\/s11277-017-3987-8"}},"subtitle":[],"short-title":[],"issued":{"date-parts":[[2017,2,3]]},"references-count":22,"journal-issue":{"issue":"3","published-print":{"date-parts":[[2017,8]]}},"alternative-id":["3987"],"URL":"https:\/\/doi.org\/10.1007\/s11277-017-3987-8","relation":{},"ISSN":["0929-6212","1572-834X"],"issn-type":[{"value":"0929-6212","type":"print"},{"value":"1572-834X","type":"electronic"}],"subject":[],"published":{"date-parts":[[2017,2,3]]}}}