4 lines
379 B
Markdown
4 lines
379 B
Markdown
|
# ViT_image_classification
|
|||
|
|
|||
|
ViT是2020年Google团队提出的将Transformer应用在图像分类的模型,虽然不是第一篇将transformer应用在视觉任务的论文,但是因为其模型‘’简单”且效果好,可扩展性强(scalable,模型越大效果越好),成为了transformer在CV领域应用的里程碑著作,也引爆了后续相关研究。
|