{"status":"ok","message-type":"work","message-version":"1.0.0","message":{"indexed":{"date-parts":[[2024,10,29]],"date-time":"2024-10-29T18:13:39Z","timestamp":1730225619838,"version":"3.28.0"},"reference-count":27,"publisher":"IEEE","content-domain":{"domain":[],"crossmark-restriction":false},"short-container-title":[],"published-print":{"date-parts":[[2018,9]]},"DOI":"10.1109\/hpec.2018.8547521","type":"proceedings-article","created":{"date-parts":[[2018,12,7]],"date-time":"2018-12-07T19:50:56Z","timestamp":1544212256000},"page":"1-9","source":"Crossref","is-referenced-by-count":2,"title":["Application Aware Tuning of Reconfigurable Multi-Layer Perceptron Architectures"],"prefix":"10.1109","author":[{"given":"Ahmed","family":"Sanaullah","sequence":"first","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]},{"given":"Chen","family":"Yang","sequence":"additional","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]},{"given":"Yuri","family":"Alexeev","sequence":"additional","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]},{"given":"Kazutomo","family":"Yoshii","sequence":"additional","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]},{"given":"Martin C.","family":"Herbordt","sequence":"additional","affiliation":[],"role":[{"role":"author","vocabulary":"crossref"}]}],"member":"263","reference":[{"key":"ref10","article-title":"Real-Time Data Analysis for Medical Diagnosis using FPGA Accelerated Neural Networks","volume":"in press","author":"sanaullah","year":"2018","journal-title":"BMC Bioinformatics"},{"key":"ref11","doi-asserted-by":"publisher","DOI":"10.1109\/FCCM.2018.00021"},{"key":"ref12","article-title":"FPDeep: A Framework for CNN Training Acceleration on FPGA Clusters","author":"geng","year":"2018","journal-title":"Proc IEEE Conf on Field Programmable Logic and Applications"},{"journal-title":"Accelerating Persistent Neural Networks at Datacenter Scale [Online]","year":"0","author":"chung","key":"ref13"},{"key":"ref14","article-title":"Accelerating Persistent Neural Networks at Datacenter Scale","author":"chung","year":"2017","journal-title":"HOTCHIPS"},{"key":"ref15","doi-asserted-by":"publisher","DOI":"10.1016\/j.micpro.2006.03.004"},{"journal-title":"Tensorflow How to Quantize Neural Networks with TensorFlow","year":"0","key":"ref16"},{"key":"ref17","doi-asserted-by":"crossref","first-page":"1352","DOI":"10.9790\/3021-026113521356","article-title":"Efficient FPGA Implementation of Sigmoid and Bipolar Sigmoid Activation Functions for Multilayer Perceptrons","author":"panicker","year":"2012","journal-title":"IOSR Journal of Engineering"},{"key":"ref18","doi-asserted-by":"publisher","DOI":"10.1109\/ICOSP.1998.770860"},{"key":"ref19","doi-asserted-by":"publisher","DOI":"10.1109\/MICRO.2016.7783720"},{"key":"ref4","doi-asserted-by":"publisher","DOI":"10.1145\/3079856.3080246"},{"journal-title":"UCI MNIST Data Set","year":"0","key":"ref27"},{"key":"ref3","article-title":"Combining First Principles Modeling, Experimental Inputs, and Machine Learning for Nanocatalysts Design","volume":"62","author":"sen","year":"2017","journal-title":"Bulletin of the American Physical Society"},{"key":"ref6","article-title":"Novo-G#: A Community Resource for Exploring Large-Scale Reconfigurable Computing Through Direct and Programmable Interconnects","author":"george","year":"2016","journal-title":"IEEE High Perf Extreme Computing Conf"},{"key":"ref5","doi-asserted-by":"publisher","DOI":"10.1145\/1022594.1022596"},{"journal-title":"TRIP An Ultra-Low Latency TeraOps\/s Reconfigurable Inference Processor for Multi-Layer Perceptrons","year":"2017","author":"sanaullah","key":"ref8"},{"key":"ref7","doi-asserted-by":"publisher","DOI":"10.1109\/FCCM.2018.00053"},{"key":"ref2","first-page":"79","author":"balaprakash","year":"2014","journal-title":"Machine-Learning-Based Load Balancing for Community Ice CodE Component in CESM"},{"key":"ref9","article-title":"Boosting Curative Surgery Success Rates using FPGAs","author":"sanaullah","year":"2017","journal-title":"Proc Computational Approaches for Cancer"},{"journal-title":"CANDLE Exascale Deep Learning and Simulation Enabled Precision Medicine for Cancer","year":"0","key":"ref1"},{"key":"ref20","doi-asserted-by":"publisher","DOI":"10.1109\/TII.2010.2085006"},{"key":"ref22","doi-asserted-by":"crossref","DOI":"10.1145\/3241793.3241800","article-title":"FPGA HPC using OpenCL: Case Study in 3D FFT","author":"sanaullah","year":"2018","journal-title":"Proc 5th Int Symp Highly-Efficient Accelerators Reconfigurable Technol"},{"journal-title":"Altera Intel FPGA SDK for OpenCL","year":"0","key":"ref21"},{"journal-title":"Tensorflow Large-scale machine learning on heterogeneous distributed systems","year":"2016","author":"abadi","key":"ref24"},{"key":"ref23","article-title":"Unlocking Performance-Programmability by Penetrating the Intel FPGA OpenCL Toolflow","author":"sanaullah","year":"2018","journal-title":"IEEE High Perf Extreme Computing Conf"},{"journal-title":"Exascale Computing Project Benchmarks","year":"0","key":"ref26"},{"journal-title":"UCI Poker Hand Data Set","year":"0","key":"ref25"}],"event":{"name":"2018 IEEE High Performance Extreme Computing Conference (HPEC)","start":{"date-parts":[[2018,9,25]]},"location":"Waltham, MA","end":{"date-parts":[[2018,9,27]]}},"container-title":["2018 IEEE High Performance extreme Computing Conference (HPEC)"],"original-title":[],"link":[{"URL":"http:\/\/xplorestaging.ieee.org\/ielx7\/8534508\/8547513\/08547521.pdf?arnumber=8547521","content-type":"unspecified","content-version":"vor","intended-application":"similarity-checking"}],"deposited":{"date-parts":[[2020,8,23]],"date-time":"2020-08-23T23:39:54Z","timestamp":1598225994000},"score":1,"resource":{"primary":{"URL":"https:\/\/ieeexplore.ieee.org\/document\/8547521\/"}},"subtitle":[],"short-title":[],"issued":{"date-parts":[[2018,9]]},"references-count":27,"URL":"https:\/\/doi.org\/10.1109\/hpec.2018.8547521","relation":{},"subject":[],"published":{"date-parts":[[2018,9]]}}}