機械学習推論

Machine Learning Inference

学習済みのモデルに新しい入力を与え、結果を得る処理である。業界団体MLCommonsのMLPerf Inferenceベンチマークは、学習済みモデルを用いてシステムが入力を処理し結果を出す速さを測るものと説明する。評価は標準の負荷生成器が特定のパターンで推論要求を発生させ、定められた指標を測る形で行われ、single-stream、multiple-stream、server、offline の各シナリオが置かれている。ベンチマークはデータセンター、エッジ、モバイル、tiny といった配備先ごとに区分されている。