Mass Estimation from Images using Deep Neural Network and Sparse Ground Truth
  教師あり学習は、回帰および分類タスクの主力製品ですが、標準的なアプローチでは、すべての測定についてグラウンドトゥルースを前提としています。実際のアプリケーションでは、特定のアプリケーションによる費用または一般的な実行不可能性による制限が一般的です。農業アプリケーションのコンテキストでは、歩留まりの監視は、体積や力の影響などの単純な物理学に基づいた測定を使用して、センサーのキャリブレーションによる誤差が生じる質量流量を定量化した例の1つです。勾配集約と一連の画像を使用した半教師付き深層学習を利用することにより、この作業では、複雑なデータ構造とスパースグラウンドトゥルースを使用して物理量(質量)を正確に推定できます。サトウキビのエレベーターの画像をキャプチャし、サトウキビを収穫するための代替材料として制御されたテストの下で竹を実行するビジョンシステムを使用して、最終負荷重量のみを使用してDNNをトレーニングすることにより、画像から質量を正確に予測します。 DNNは、質量予測モデルの一部として内部で細長いロッドのランダムスタッキングの複雑な密度物理学をキャプチャすることに成功し、質量予測のための古い体積ベースの方法を凌surしています。さらに、システム物理学に関する知識をDNNアーキテクチャとペナルティの用語を通じて組み込むことにより、予測の精度と安定性の向上、およびより高速な学習が得られます。この偉業を達成するために、古典的な非線形回帰最適化は、いくつかの独立した仮定を伴う集計項で再定式化できることが示されています。所定の実行の画像数が多すぎて一般的なGPU vRAMに収まらないため、限られたメモリを補うが高速なトレーニング時間を実現する実装が示されています。ここで紹介したのと同じアプローチは、穀物コンバインの収量監視や、ビジョンや他の機器を使用した他の収穫機など、他のアプリケーションにも適用できます。
Supervised learning is the workhorse for regression and classification tasks, but the standard approach presumes ground truth for every measurement. In real world applications, limitations due to expense or general in-feasibility due to the specific application are common. In the context of agriculture applications, yield monitoring is one such example where simple-physics based measurements such as volume or force-impact have been used to quantify mass flow, which incur error due to sensor calibration. By utilizing semi-supervised deep learning with gradient aggregation and a sequence of images, in this work we can accurately estimate a physical quantity (mass) with complex data structures and sparse ground truth. Using a vision system capturing images of a sugarcane elevator and running bamboo under controlled testing as a surrogate material to harvesting sugarcane, mass is accurately predicted from images by training a DNN using only final load weights. The DNN succeeds in capturing the complex density physics of random stacking of slender rods internally as part of the mass prediction model, and surpasses older volumetric-based methods for mass prediction. Furthermore, by incorporating knowledge about the system physics through the DNN architecture and penalty terms, improvements in prediction accuracy and stability, as well as faster learning are obtained. It is shown that the classic nonlinear regression optimization can be reformulated with an aggregation term with some independence assumptions to achieve this feat. Since the number of images for any given run are too large to fit on typical GPU vRAM, an implementation is shown that compensates for the limited memory but still achieve fast training times. The same approach presented herein could be applied to other applications like yield monitoring on grain combines or other harvesters using vision or other instrumentation.
