
vit_base_patch16_224_in21k_(zip)
5星
- 浏览量: 0
- 大小:None
- 文件类型:None
简介:
vit_base_patch16_224_in21k 是一个基于大规模图像数据集训练的基础视觉Transformer模型,采用224x224像素输入和16x16补丁大小。该压缩包内含预训练权重和其他资源。
使用预训练的Vision Transformer模型可以提高训练准确率的起点,并有助于模型更好地拟合数据。
全部评论 (0)
还没有任何评论哟~


