問題 No.1421
コンピュータビジョンのタスクのうち、画像内のどの位置に何が写っているかをピクセル単位で識別し、領域ごとにクラスラベルを割り当てる技術を何と呼ぶか。自動運転における道路や歩行者の認識、医療画像における腫瘍領域の特定などに用いられる。
【正解の解説】
セマンティックセグメンテーション
セマンティックセグメンテーションは、画像内の全てのピクセルに対して「これは道路」「これは人」といったクラスを割り当て、領域を塗り分けるように識別する技術です。
スポンサーリンク
【その他の選択肢の解説】
物体検出タスク
物体検出は、画像内に写っている対象物を見つけ出し、それがどこにあるかを「箱(矩形)」で囲んで特定するタスクです。
画像認識
画像分類は、画像全体を見て「これは何が写っているか」というクラスを一つに割り当てるタスクです。
インスタンス生成
インスタンス生成は、特定の概念や物体の画像そのものをモデルが新しく作り出す生成AI的なアプローチを指す場合があります。