Mannes (2026) Positional-Encoding ViT-S Ablation Suite
Research (Mannes, 2026; custom-trained from scratch on ImageNet-100 across five positional-encoding variants, arXiv:2606.00124)
Structures found in this family (1)
By model (1)
ViT-S/16 (12 layers, 8 heads, dim 384, trained from scratch on ImageNet-100)
Papers
Positional Encodings Anchor Spatial Structure in Vision Transformers: A Geometric Perspective on Robustness (2026)