問題
Vision Transformerは、画像をパッチに分割し、Transformerの仕組みを画像認識に適用するモデルである。
正解: ○
G検定の一問一答模擬問題です。解説付きで個別に学習できます(公式の過去問ではありません)。
Vision Transformerは、画像をパッチに分割し、Transformerの仕組みを画像認識に適用するモデルである。
正解: ○
Vision Transformerは画像をパッチ列として扱い、Transformerで処理する。CNNとは異なる画像認識アプローチとして重要である。