{"status":"ok","message-type":"work","message-version":"1.0.0","message":{"indexed":{"date-parts":[[2026,8,4]],"date-time":"2026-08-04T10:12:10Z","timestamp":1785838330000,"version":"3.56.0"},"reference-count":40,"publisher":"IEEE","license":[{"start":{"date-parts":[[2019,11,1]],"date-time":"2019-11-01T00:00:00Z","timestamp":1572566400000},"content-version":"stm-asf","delay-in-days":0,"URL":"https:\/\/doi.org\/10.15223\/policy-029"},{"start":{"date-parts":[[2019,11,1]],"date-time":"2019-11-01T00:00:00Z","timestamp":1572566400000},"content-version":"stm-asf","delay-in-days":0,"URL":"https:\/\/doi.org\/10.15223\/policy-037"}],"content-domain":{"domain":[],"crossmark-restriction":false},"short-container-title":[],"published-print":{"date-parts":[[2019,11]]},"DOI":"10.1109\/iros40897.2019.8967730","type":"proceedings-article","created":{"date-parts":[[2020,1,30]],"date-time":"2020-01-30T23:53:51Z","timestamp":1580428431000},"page":"8081-8088","source":"Crossref","is-referenced-by-count":29,"title":["Forecasting Time-to-Collision from Monocular Video: Feasibility, Dataset, and Challenges"],"prefix":"10.1109","author":[{"given":"Aashi","family":"Manglik","sequence":"first","affiliation":[{"name":"Robotics Institute, Carnegie Mellon University,Pittsburgh,PA,USA,15213"}],"role":[{"vocabulary":"crossref","role":"author"}]},{"given":"Xinshuo","family":"Weng","sequence":"additional","affiliation":[{"name":"Robotics Institute, Carnegie Mellon University,Pittsburgh,PA,USA,15213"}],"role":[{"vocabulary":"crossref","role":"author"}]},{"given":"Eshed","family":"Ohn-Bar","sequence":"additional","affiliation":[{"name":"Max Planck Institute for Intelligent Systems"}],"role":[{"vocabulary":"crossref","role":"author"}]},{"given":"Kris M.","family":"Kitanil","sequence":"additional","affiliation":[{"name":"Robotics Institute, Carnegie Mellon University,Pittsburgh,PA,USA,15213"}],"role":[{"vocabulary":"crossref","role":"author"}]}],"member":"263","reference":[{"key":"ref39","article-title":"Very Deep Convolutional Networks for Large-Scale Image Recognition","author":"simonyan","year":"2015","journal-title":"ICLRE"},{"key":"ref38","doi-asserted-by":"publisher","DOI":"10.1109\/IROS.2018.8593660"},{"key":"ref33","article-title":"SpatioTemporal Residual Networks for Video Action Recognition","author":"feichtenhofer","year":"2016","journal-title":"NIPS"},{"key":"ref32","doi-asserted-by":"publisher","DOI":"10.1109\/ICCV.2015.510"},{"key":"ref31","doi-asserted-by":"publisher","DOI":"10.1162\/neco.1997.9.8.1735"},{"key":"ref30","article-title":"Beyond Short Snippets: Deep Networks for Video Classification","author":"ng","year":"2015","journal-title":"CVPR"},{"key":"ref37","doi-asserted-by":"publisher","DOI":"10.1109\/ICCPS.2018.00035"},{"key":"ref36","article-title":"Learning Spatio-Temporal Features with Two-Stream Deep 3D CNNs for Lipreading","author":"weng","year":"2019","journal-title":"arXiv 1905 02540"},{"key":"ref35","article-title":"Two-stream Convolutional Networks for Action Recognition in Videos","author":"simonyan","year":"2014","journal-title":"NIPS"},{"key":"ref34","doi-asserted-by":"publisher","DOI":"10.1109\/ICCV.2017.590"},{"key":"ref10","article-title":"A Baseline for 3D Multi-Object Tracking","author":"weng","year":"2019","journal-title":"arXiv 1907 03961"},{"key":"ref40","doi-asserted-by":"publisher","DOI":"10.1109\/CVPR.2015.7298594"},{"key":"ref11","article-title":"You&#x2019;ll Never Walk Alone: Modeling Social Behavior for Multi-Target Tracking","author":"pellegrini","year":"2009","journal-title":"ICCV"},{"key":"ref12","article-title":"TrajNet: Towards a Benchmark for Human Trajectory Prediction","author":"sadeghian","year":"2018","journal-title":"arXiv 1805 07663"},{"key":"ref13","doi-asserted-by":"publisher","DOI":"10.1109\/CVPR.2017.502"},{"key":"ref14","article-title":"Imagenet Classification with Deep Convolutional Neural Networks","author":"krizhevsky","year":"2012","journal-title":"NIPS"},{"key":"ref15","doi-asserted-by":"publisher","DOI":"10.1109\/CVPR.2016.90"},{"key":"ref16","doi-asserted-by":"publisher","DOI":"10.1109\/CVPR.2018.00371"},{"key":"ref17","doi-asserted-by":"publisher","DOI":"10.1109\/ROBOT.2009.5152860"},{"key":"ref18","article-title":"Path Planning in Dynamic En-vironments with Adaptive Dimensionality","author":"vemula","year":"2016","journal-title":"Ninth Annual Symposium on Combinatorial Search"},{"key":"ref19","doi-asserted-by":"publisher","DOI":"10.1109\/CVPR.2018.00240"},{"key":"ref28","article-title":"Ima-geNet: A Large-Scale Hierarchical Image Database","author":"deng","year":"2009","journal-title":"CVPR"},{"key":"ref4","article-title":"A Visual Neural Network for Robust Collision Perception in Vehicle Driving Scenarios","author":"fu","year":"2019","journal-title":"arXiv 1904 02074"},{"key":"ref27","article-title":"Visual Compiler: Synthesizing a Scene-Specific Pedestrian Detector and Pose Estimator","author":"lee","year":"2016","journal-title":"arXiv 1612 05234"},{"key":"ref3","first-page":"136","article-title":"Anticipating acci-dents in dashcam videos","author":"chan","year":"2016","journal-title":"Asian Conference on Computer Vision"},{"key":"ref6","doi-asserted-by":"publisher","DOI":"10.1145\/3290605.3300282"},{"key":"ref29","doi-asserted-by":"publisher","DOI":"10.1007\/s11263-009-0275-4"},{"key":"ref5","doi-asserted-by":"publisher","DOI":"10.1109\/ICRA.2011.5980306"},{"key":"ref8","doi-asserted-by":"publisher","DOI":"10.1109\/ICIP.2016.7533003"},{"key":"ref7","doi-asserted-by":"publisher","DOI":"10.1109\/TPAMI.2009.109"},{"key":"ref2","doi-asserted-by":"publisher","DOI":"10.1109\/LRA.2018.2795643"},{"key":"ref9","doi-asserted-by":"publisher","DOI":"10.1109\/ICRA.2018.8461018"},{"key":"ref1","doi-asserted-by":"publisher","DOI":"10.1109\/IROS.2017.8206247"},{"key":"ref20","doi-asserted-by":"publisher","DOI":"10.1109\/CVPR.2016.110"},{"key":"ref22","doi-asserted-by":"publisher","DOI":"10.1109\/IROS.2009.5354147"},{"key":"ref21","doi-asserted-by":"publisher","DOI":"10.1109\/ICRA.2018.8460504"},{"key":"ref24","article-title":"Yolov3: An incremental improvement","author":"redmon","year":"2018","journal-title":"arXiv preprint arXiv 1804 02767"},{"key":"ref23","article-title":"Faster R-CNN: Towards Real-Time Object Detection with Region Proposal Networks","author":"ren","year":"2015","journal-title":"NIPS"},{"key":"ref26","article-title":"Monocular 3D Object Detection with Pseudo- LiDAR Point Cloud","author":"weng","year":"2019","journal-title":"arXiv 1903 09847"},{"key":"ref25","doi-asserted-by":"publisher","DOI":"10.1109\/WACV.2018.00124"}],"event":{"name":"2019 IEEE\/RSJ International Conference on Intelligent Robots and Systems (IROS)","location":"Macau, China","start":{"date-parts":[[2019,11,3]]},"end":{"date-parts":[[2019,11,8]]}},"container-title":["2019 IEEE\/RSJ International Conference on Intelligent Robots and Systems (IROS)"],"original-title":[],"link":[{"URL":"http:\/\/xplorestaging.ieee.org\/ielx7\/8957008\/8967518\/08967730.pdf?arnumber=8967730","content-type":"unspecified","content-version":"vor","intended-application":"similarity-checking"}],"deposited":{"date-parts":[[2025,7,29]],"date-time":"2025-07-29T18:24:25Z","timestamp":1753813465000},"score":1,"resource":{"primary":{"URL":"https:\/\/ieeexplore.ieee.org\/document\/8967730\/"}},"subtitle":[],"short-title":[],"issued":{"date-parts":[[2019,11]]},"references-count":40,"URL":"https:\/\/doi.org\/10.1109\/iros40897.2019.8967730","relation":{},"subject":[],"published":{"date-parts":[[2019,11]]}}}