arXiv reaDer
インドの道路を横断するためのデータセットとモデル
A Dataset and Model for Crossing Indian Roads
中規模のインドの町の道路は、多くの場合、多くの交通量がありますが、交通渋滞はありません (または無視されます)。安全に横断できるかどうかを判断するには視覚が重要であるため、視覚障害者が安全に道路を横断することは困難です。したがって、自動で信頼性の高い画像ベースの安全分類器は、視覚障害者がインドの道路を横断するのを助ける可能性を秘めています。しかし、現時点では、歩行者の視点からインドの道路で収集され、道路横断の安全情報がラベル付けされたデータセットが不足しています。他の国の既存の分類子は多くの場合、交差点を対象としているため、信号機の検出と存在に依存していますが、これはインドの状況には当てはまりません。歩行者の視点からインドの道路のビデオをキャプチャした最初のデータセットである INDRA (RoAd Crossing のインドのデータセット) を紹介します。 INDRA には、26k 1080p フレームで構成される 104 のビデオが含まれており、それぞれにバイナリ道路横断安全ラベルと車両境界ボックスで注釈が付けられています。 SVM から畳み込みニューラル ネットワーク (CNN) に至るまで、さまざまな分類器をトレーニングして、このデータで道路横断の安全性を予測します。最高のパフォーマンスを発揮するモデル DilatedRoadCrossNet は、Nvidia Jetson Nano での展開用に調整された新しい単一イメージ アーキテクチャです。目に見えない画像で 90% の精度で 79% の再現率を達成します。最後に、DilatedRoadCrossNet を実行するウェアラブル道路横断アシスタントを紹介します。これは、目の不自由な人がリアルタイムでインドの道路を横断するのを支援します。プロジェクトの Web ページは http://roadcross-assistant.github.io/Website/ です。
Roads in medium-sized Indian towns often have lots of traffic but no (or disregarded) traffic stops. This makes it hard for the blind to cross roads safely, because vision is crucial to determine when crossing is safe. Automatic and reliable image-based safety classifiers thus have the potential to help the blind to cross Indian roads. Yet, we currently lack datasets collected on Indian roads from the pedestrian point-of-view, labelled with road crossing safety information. Existing classifiers from other countries are often intended for crossroads, and hence rely on the detection and presence of traffic lights, which is not applicable in Indian conditions. We introduce INDRA (INdian Dataset for RoAd crossing), the first dataset capturing videos of Indian roads from the pedestrian point-of-view. INDRA contains 104 videos comprising of 26k 1080p frames, each annotated with a binary road crossing safety label and vehicle bounding boxes. We train various classifiers to predict road crossing safety on this data, ranging from SVMs to convolutional neural networks (CNNs). The best performing model DilatedRoadCrossNet is a novel single-image architecture tailored for deployment on the Nvidia Jetson Nano. It achieves 79% recall at 90% precision on unseen images. Lastly, we present a wearable road crossing assistant running DilatedRoadCrossNet, which can help the blind cross Indian roads in real-time. The project webpage is http://roadcross-assistant.github.io/Website/.
updated: Tue Nov 15 2022 06:04:30 GMT+0000 (UTC)
published: Tue Nov 15 2022 06:04:30 GMT+0000 (UTC)
参考文献 (このサイトで利用可能なもの) / References (only if available on this site)
被参照文献 (このサイトで利用可能なものを新しい順に) / Citations (only if available on this site, in order of most recent)
Amazon.co.jpアソシエイト